找到 1 篇关于此标签的文章
一个叫 Strata 的开源项目声称把 llama.cpp 的 MoE 模型推理速度拉高 5-10 倍,开发仅花两周。值得关心的是:本地跑大模型的性价比正在快速重写,企业私有化部署的临界点可能比预期更早到来。