找到 1 篇关于此标签的文章
一位开发者实测发现,同一个本地 Llama 3.1 8B 模型,命令行 2 秒出结果,装进 VSCode 的 Roo Code 插件要等 10 秒。这 5-10 倍的性能差距,问题 100% 出在插件中间层,不是模型本身。值得每个想「本地部署 AI」的人看清楚。