这是什么

本周 Reddit LocalLLaMA 社区出现一条热帖:阿里旗下平头哥的 RISC-V 处理器玄铁 C950,在没有英伟达 GPU 的情况下,把通义千问一款 270 亿参数模型跑出了 30 tps(tokens/秒,即每秒生成的文字片段数)。RISC-V 是一种免授权费的开源芯片架构(不同于需要付费授权的 ARM 和 x86)。30 tps 是道坎:人正常阅读约 5-10 tps,意味着这台芯片可以做到流畅对话。

我们的判断:真正的信号不是 30 tps 这个数字,而是阿里把"自研推理芯片 + 自研大模型"这条链路打通——这正是美国出口管制试图堵住的那条路。

行业怎么看

乐观一方看到的是国产闭环:开源架构 + 国产模型 + 国产芯片三件套凑齐,金融、政务、医疗这类数据敏感行业尤其受益,企业部署 AI 不必再赌英伟达供应链。

三种质疑也值得听。第一,目前数据来自社区测试,没有第三方独立验证;第二,RISC-V 软件生态(编译器、推理框架)成熟度远不如 CUDA(英伟达主导的并行计算平台),开发者迁移成本高;第三,这次只解决"推理"端,"训练"仍严重依赖 GPU,被卡脖子的核心问题并未解决。

对普通人的影响

对企业 IT:评估本地化部署的 CIO 多了一个非英伟达的备选项,采购谈判桌上的筹码开始松动。

对个人职场:用消费级硬件跑大模型可能从极客玩具变成省钱工具,但短期内开发者仍主要跑在英伟达卡上。

对消费市场:手机、家电未来可能内置 RISC-V AI 芯片,云端调用 AI 的费用或被进一步压低。