返回首页
Apple Silicon
找到 6 篇关于此标签的文章
QwenApple Silicon
Qwen 3.8 实测:深度思考模式多烧 5.5 倍 token,本地部署账该重算
一位 Reddit 用户在 MacBook Pro M5 Max 上跑了 Qwen3.8-27B:开启「深度思考」模式后,token 消耗是普通模式的 5.5 倍、推理耗时 6 倍;关闭后质量又掉到其他 MoE 模型之后。开源模型「会思考」与「想得起」之间的成本裂缝正在浮出水面。
2h ago2 分钟
AppleMac mini
Mac mini 升级 M6 芯片 — 本地跑 AI 大模型的门槛又降了一档
苹果本周更新 Mac mini,主芯片跳到新一代 Apple Silicon。值得关心的是:这台小主机一直是'本地跑 AI 大模型'的代表机型,新芯片意味着更多普通人也能在家部署开源 AI;但距离真正进入办公室和家庭,还有一段路。
3d ago2 分钟
h3.cApple Silicon
33B 音视频模型跑上苹果芯片,开源社区开始记账'加速'的代价
本周开源项目 h3.c 把一个 330 亿参数的音视频生成模型塞进苹果芯片,没有用单一'加速'开关,而是把每一项加速手段拆开讲清楚代价。这意味着本地 AI 视频生成开始走出 demo 阶段,进入谈画质、速度、商业可用性的工程阶段。
Aug 222 分钟
QwenApple Silicon
苹果电脑跑 Qwen 27B 提速 3 倍 — 本地大模型进入可用区间
开源项目 mlx-dspark 把 DeepSeek 的"投机解码"移植到苹果芯片,让 Qwen 27B 模型在 M 系列 Mac 上提速至 3 倍且无质量损失。本地跑大模型第一次接近"可商用"水平,对中小企业和受监管行业的吸引力是真实的。
Aug 152 分钟
MetaMuse Glimmer
Meta 30B 模型在 Mac 上提速 3 倍 — 开源社区让本地大模型开始能用
开发者 A-Rahim 用推测解码让 Meta 新出的 Muse Glimmer 30B 在 M4 Pro 上提速最高 3.3 倍,输出与原版完全一致。这事为什么值得关心:本地跑大模型开始从极客玩具变成普通人也能上手的工具。
Aug 122 分钟
llama.cppQwen
37 个大语言模型在 MacBook Air M5 32GB 上完成基准测试:完整速度结果
社区使用 llama-bench 在 M5 Air 32GB 上对 37 个本地 LLM 进行基准测试,结果显示 MoE 模型在速度与质量比方面表现最佳。
Apr 62 分钟