Google 真推一款 120B 开源大模型,可能直接卡死 OAI 与 Anthropic 的 IPO 之路
本周 Reddit 上一则帖子抛出一个大胆假设,引发我们编辑部讨论:如果 Google 推出一款 1200 亿参数的开源多模态大模型,可能直接卡死 OpenAI 和 Anthropic 两家估值合计 5000 亿美元公司的 IPO(首次公开上市)之路。这不是技术问题,而是西方企业对中国开源模型的「信任赤字」问题。
相关推荐
基于 #Qwen 推荐
QwenApple Silicon
Qwen 3.8 实测:深度思考模式多烧 5.5 倍 token,本地部署账该重算
一位 Reddit 用户在 MacBook Pro M5 Max 上跑了 Qwen3.8-27B:开启「深度思考」模式后,token 消耗是普通模式的 5.5 倍、推理耗时 6 倍;关闭后质量又掉到其他 MoE 模型之后。开源模型「会思考」与「想得起」之间的成本裂缝正在浮出水面。
8月29日·www.reddit.com
QwenRTX 5080
RTX 5080 跑 Qwen 大模型只有 6 字/秒 — 本地部署 AI 的家用门槛还有多高
有人在 Reddit 用 RTX 5080 + 64GB 内存跑 Qwen 量化模型,每秒只生成约 6 个汉字。这件事值得关心:想「让 AI 跑在自己电脑上」,对硬件和调参能力的要求仍远超普通用户。
8月29日·www.reddit.com
Qwen阿里通义
社区版 Qwen3.8 量化模型省 30GB 空间 — 本地跑大模型的门槛又降了
社区开发者 agentionai 发布 Qwen3.8-Flash-Next 的定制量化版本,比主流版本小 20-30GB 而质量相当。本地运行大模型的硬件门槛进一步下移,但目前仍是极客圈的事。
8月29日·www.reddit.com
OrnithQwen
一款 35B 开源大模型被悄悄"换芯" — 这背后是整个 AI 行业的供应链信任账
一款 35B 开源大模型的本地压缩版被悄悄重传——权重变了,校准数据换了,官方没发任何说明。这不是产品新闻,是整个开源 AI 圈被忽视的供应链信任问题。
8月29日·www.reddit.com
Qwen通义千问
千问 27B 跑到 50 tok/s:16G 消费显卡也能本地跑大模型
本周一个 Reddit 用户把阿里通义千问 27B 模型塞进 16GB 消费显卡,跑出 50 token/秒生成速度 + 10 万字上下文。本地大模型正走出极客圈、逼近云端体验。
8月29日·www.reddit.com
PPT Masterfrontend-slides
做 PPT 这事,AI 给的解法完全相反 — 两个 67k 星 GitHub 项目替你选好了
PPT 该改还是发链接?GitHub 上两个加起来 67k 星的开源项目 PPT Master 和 frontend-slides 选了相反的路。前者死磕原生 Office,后者绕过 PowerPoint 直接给 HTML。这件事值得关心,因为它预示了 AI Agent(能自主完成任务的 AI 程序
8月29日·juejin.cn