这是什么

本周 Reddit r/LocalLLaMA 板块一位用户贴出截图:在一块 2020 年发布的 RTX 3090 显卡(现在二手约 1500 元)上,本地运行阿里 Qwen 3.8 27B 模型(Q4 量化版(把模型精度压缩以减小占用的技术),约 14GB 显存可跑),输出能正常渲染的 Three.js 网页代码。

先把概念摆出来——Three.js 是网页端最常用的 3D 渲染工具(让浏览器画 3D 图形的库),产品展示页、网页小游戏、户型可视化都靠它。过去这类代码要么靠人工写,要么得调 GPT-4、Claude 这类云端大模型,按 token(计费单位)付费。27B 在当前开源模型里属"中等偏小"——同类活过去常要 70B、100B+ 才稳。

行业怎么看

支持方把这事读成"开源小模型赶上闭源大模型"的又一个信号。算一笔账——云端 API 写一个 3D 交互页 demo,按 token 计费通常 0.2 到 0.5 美元;本地跑,功耗成本几乎可忽略。原型阶段不再被绑死在一家服务商身上。

但反对声音也有理由。一个截图说明不了稳定性——本地部署圈普遍反映,27B 模型在多次尝试中常出现"代码能跑但不可维护"的输出。当下的真实状态是「能搭原型、撑不住生产」,企业真要上线,还是得接云端或自建集群(自己买多张高端显卡搭的计算阵列)。另一点长期疑虑:阿里开源模型在跑分和宣传上一直好看,工程表现打折是行业里的共识,单一 demo 不足以做最终判断。

对普通人的影响

对企业 IT:内部工具、产品演示页这类一次性活,可以先拿本地模型试;正式生产仍按云端或自建预算估。

对个人职场:会基础前端的工程师会更吃香——稀缺的不是"写代码",是"让 AI 写出能用的代码"。

对消费市场:2-3 年内不会有直接影响,家用显卡跑 27B 已到上限,更复杂的活仍要靠云端。