这是什么
这周 LocalLLaMA(一个追踪开源大模型的 Reddit 社区)一个帖子被顶上热榜:用户 jazir55 注意到,过去两周开源界只见 Qwen、DeepSeek、GLM(智谱)这些 A 档大厂的旗舰模型更新,而 Nvidia Nemotron(黄仁勋家的开源线)、Allen AI Olmo、LongCat 等"B 档"玩家集体静默。
所谓"B 档",是开源社区的口语,指参数规模较小(通常 7B-32B)、专注特定场景或学术研究、不直接对标 GPT-4/Claude 的模型。它们更便宜、更易私有化部署,是大多数企业真正在用的层级。
行业怎么看
支持"分化说"的声音:我们注意到,2024 年下半年起,开源资源明显向头部集中。Qwen、DeepSeek、GLM 三家中国厂商每发一次新模型都在 GitHub 上引发刷屏级讨论,背后是阿里、深度求索、智谱有足够的算力和工程团队持续投入。Nemotron、Olmo 这些项目依赖学术机构或单点团队,更新节奏本来就不稳定。
反对意见也成立:也有从业者认为这只是发布周期问题,不是生态萎缩。开源模型历来是"憋大招"模式,半年不发、一发就追平闭源是常态。Nemotron 此前跳过多个版本直接放大,Olmo 团队也明确说过下一版本要重构数据管线。
我们的判断:两边都有道理,但趋势上分化是真的。对中文使用者尤其值得留意——中国大厂在开源前沿的密度已经超过美国同行。
对普通人的影响
对企业 IT:B 档模型缺席意味着私有化部署的选择面在变窄,要么用 Qwen、DeepSeek 这种"足够大但贵"的方案,要么继续守旧模型。
对个人职场:产品经理和开发者 2025 年要重新校准"开源能用"的预期,新模型季度内落地的概率不高。
对消费市场:开源进展放缓可能让 ChatGPT、文心一言这类闭源产品的定价更稳,企业降价空间收窄。