返回首页

本地模型

找到 9 篇关于此标签的文章

Qwen通义千问

通义千问 27B 模型对标谷歌旗舰 — 本地 AI 第一次真正够用

阿里通义千问新发的 27B 参数模型在本地 AI 社区引发热议,被称作第二个 DeepSeek 时刻——意味着过去依赖云端的前沿智能,普通硬件也能跑起来了。

Aug 182 分钟
MetaMuse Glimmer

Meta 把 AI 模型压缩到能塞进手机 — 但本地跑大模型真的划算吗

Meta 开源了两款可在手机端运行的小模型 Muse Glimmer 与 Muse Spark 1.2。我们关心的是:本地推理比调用云端 API 更便宜吗?什么时候该选哪种?

Aug 102 分钟
Liquid AILFM 2.6B

Liquid 推出 2.6B 小模型 — 本地跑 AI 的门槛正在被踩平

Liquid AI 这周放出 2.6B 参数的小模型,普通显卡就能跑出每秒 260 token 的速度。它的能力有限,但足以应付日常琐碎任务——这意味着本地 AI 的实用门槛又往下走了一步。

Aug 92 分钟
Claude SonnetLocalLLaMA

两天跑掉 5000 万 token 省下 151 美元,本地模型开始适合重度开发者

一位开发者两天内用了约 5000 万输入 token、49 次编程会话,按 Claude Sonnet 的公开价格计算约值 151 美元。这件事值得关心,不是因为“本地部署”突然更强了,而是高频、长上下文场景已经开始逼近成本分界点。

Jun 122 分钟
QwenHermes Agent

本地小模型跑通初级IT运维 — 30年老兵判断:管理员人机比将改写

一位近30年经验IT老兵实测:Qwen3.6 27b本地模型配Agent框架,1.5小时完成初级管理员3小时的活。本地小模型干初级运维已跨过可用门槛,企业IT编制逻辑即将调整。

May 72 分钟
QwenAssistant_Pepe

Qwen 开源微调版学会拒绝 — AI 不再讨好你这件事有人当真了

开源社区基于 Qwen3-32B 微调出一个'不讨好'的 AI 助手,故意注入负面偏见减少谄媚。这不是玩票,而是对 AI 行业长期忽视的'讨好症'的一次认真回应。

May 32 分钟
MiniMaxM2.7

MiniMax 小模型本地跑出幻觉后自己圆场 — 开源模型的交互质感在变

Reddit 用户晒出 MiniMax M2.7 本地量化运行时编造 URL 后立刻自嘲圆场的截图。小模型能"认错"不是元认知,但训练数据中纠错模式的渗透正在改变用户对 AI 交互的体感。

Apr 302 分钟
QwenClaude

有人开始用国产开源模型替换 Claude 做日常编程助手 — 性能差距正在缩小到「够用」

Reddit 上一个有 184 个点赞、143 条讨论的帖子显示,已有开发者认真考虑用阿里的 Qwen-35B-A3B 替换 Anthrop ic 的 Claude Opus 4.7 作为日常编程工具。这件事值得关心,不是因为某个人换了个软件,而是它折射出一个趋势:AI 模型的「够用线」正在快速下移

Apr 202 分钟
本地模型AI成本

本地AI取代云端大模型:企业算力采购逻辑的根本性逆转

当一张RTX 4090显卡跑起27B参数模型即可完成网页研究,企业是否还需要每月向OpenAI或阿里云支付API调用费?这迫使老板重新计算AI的真实成本结构。

Apr 102 分钟