LocalLLaMAAI-benchmarks
AI 跑分越来越没人信了:评测体系到了该重写的时候
Reddit 上 LocalLLaMA 开发者社区本周出现一篇高赞讨论:跑了 2-3 年模型后,开发者集体说官方跑分和真实体验对不上。Qwen 35B 成为社区'实测之王'。对企业采购、和投资人看榜单意味着什么?
8月22日·2 分钟
solopreneurGLM-5.1
GLM-5.1:一个能自我修正代码的754B开源模型
Z.ai的MIT许可GLM-5.1通过后续提示调试自身输出——适合预算有限的独立开发者。
4月8日·2 分钟