一款'会判断'的开源小模型登顶 HuggingFace — 但这股热度与你无关
本周早些时候,我们注意到一款名为 Gliner2.5-Decide 的小型开源模型在 HuggingFace 趋势榜上停留了约一周时间,才被人发到本地大模型社区。这个热度本身是值得记录的信号:开源小模型生态正在加速分化,而不是像去年那样靠一个"大一统"模型吸引所有目光。
相关推荐
基于 #开源模型 推荐
本地大模型Mac Studio
本地 AI 听起来自由 — 但 5 万元门槛正在把多数人挡在门外
本周 Reddit r/LocalLLaMA 讨论串抛出一个数字:5,000 到 15,000 美元的本地 AI 硬件套装全线断货。我们关注的问题是——当云端 AI 开始涨价,本地部署究竟是省钱方案还是发烧友的玩具?
9月26日·www.reddit.com
Ling-3.1MoE架构
Ling-3.1 大模型免费两周后开源:560B 参数只激活 25B
中国团队发布 Ling-3.1-flash:560B 总参数但每次只激活 25B,100 万 token 上下文,前两周免费、之后开源。这是中国大模型团队越来越熟练的一套发布节奏。
9月30日·www.reddit.com
5060tiNVIDIA
5060ti 显存超频跑到 1248GB/s — 本地跑大模型这事,比你想的便宜
Reddit 用户通过 mlock 工具超频 GDDR7 显存,让中端 5060ti 带宽达到 1248 GB/s,比常规超频再提升约 40%。我们关心的是:消费级硬件跑本地 AI 远没到天花板,花 3000 块跑大模型正在变得可行。
9月30日·www.reddit.com
NVIDIAA40
老显卡还在扛 AI 大模型 — 业余玩家用 2020 年企业级 GPU 跑 27B 模型
本周 Reddit 上一位本地 AI 玩家发帖求助:想让 2020 年发布的 NVIDIA A40 企业级显卡跑更新的量化模型,目前只能跑 27B 参数。这条不起眼的求助帖折射出一个事实 — 本地大模型的硬件门槛在快速下降,二手老卡正在被重新估价。
9月30日·www.reddit.com
LlamaQwen
后训练的隐性代价:让 AI 更好笑,也更爱说同一句话
一项覆盖 Llama、Qwen、OLMo 三大开源模型 11 个后训练阶段的研究发现:AI 越调越幽默,但回答越来越雷同。研究把这种交换叫做'幽默税'——也解释了为什么今天所有 AI 助手听起来都差不多。
9月29日·www.reddit.com
Kiminori生成式音频
AI 能按文字生成猫叫了 — 这是生成式音频走向细分的信号
本周独立研究者 Kiminori 公布了'文本生成猫叫'模型,把生成式音频从人声、音乐推到动物叫声。我们关心的是:这种看似玩笑的小项目,其实反映了大模型能力正在向极细分领域扩散。
9月29日·www.kmjn.org