这是什么

上周有人发现 Ornith 1.5 35B 这款开源大模型被悄悄"换芯"了——权重变了,校准数据也换了,但官方一个字都没解释。

事情经过:Reddit 用户 miki4242 跑了几个月这个模型,最近发现 Hugging Face 上的 GGUF 文件(一种把大模型压缩到消费级显卡可跑的格式)多了一次"重传",commit 信息只有"Upload file with huggingface_hub"一句,像无意义操作。

但他用文件系统快照拉出旧版本做字节级 diff 发现:权重(模型学到的参数)真的不一样,校准数据(量化时衡量"哪些参数重要"的参考样本)也换了,size label 从"256x2.6B"改成"35B"。架构没变、专家数没变——但整个文件差了几百字节。

理论上,量化(压缩模型到本地可跑)是可复现操作:同一份模型同一份校准数据,跑出来的字节应一致。不一致,就该有说明。

行业怎么看

支持方的解读很轻巧:一次常规量化修正,校准基线(量化时的参考样本)调了顺手改对标签,推理结果应差别不大,没必要大惊小怪。

反对意见更值得听:开源不等于可复现。一次没有版本说明、没有 checksum(校验码,用于确认文件是否被改动)、没有 changelog(变更日志)的"更新",对企业部署是定时炸弹。今天跑出来合规,明天不合规,根因可能是上游没发通知的权重微调。这种事在传统软件供应链里会被当 CVE(安全漏洞)处理,AI 圈子却常当"日常维护"——而量化本应 100% 可复现。

对普通人的影响

对企业 IT:如果在生产环境跑开源模型,是时候把模型指纹(model fingerprint,模型唯一识别码)和版本校验纳入变更管理流程——别等出事后才发现"模型自己变了"。

对个人职场:暂时和你无关,除非你做开发或正在评估本地部署;但下次老板问"我们用的是哪个 AI","开源的那个"已经不够回答。

对消费市场:现在还早,主流消费产品还没到这一层。但 ChatGPT、文心一言哪天悄悄调一版权重,背后是同一本信任账。