返回首页
llama-server
找到 3 篇关于此标签的文章
llama.cppllama-server
llama.cpp 把网页界面做成可安装应用,本地大模型离日常使用又近了一步
llama.cpp 已合并 PWA(渐进式网页应用,可像原生 App 一样安装运行)支持。它不是模型能力升级,却直接改善本地大模型的打开、更新和常用体验。值得关心的是,开源 AI 的竞争正在从“能不能跑”转向“能不能长期用”。
6月12日2 分钟
llama.cppGemma-4
llama.cpp Adds Audio Processing Support via Gemma-4 E2 A/E4A Models
llama-server 现已支持通过 Google Gemma-4 E2A 与 E4A 多模态模型在本地运行语音转文字推理, 大幅扩展了这一开源推理引擎的应用边界。
4月12日2 分钟
OpenCodellama-server
OpenCode + 本地 LLM:哪些模型最适合独立开发者任务
在 RTX 4080 上对 OpenCode 与 6+ 款自托管 LLM 进行实战基准测试,涵盖真实编码任务。
4月6日2 分钟