返回首页
token成本
找到 2 篇关于此标签的文章
QwenApple Silicon
Qwen 3.8 实测:深度思考模式多烧 5.5 倍 token,本地部署账该重算
一位 Reddit 用户在 MacBook Pro M5 Max 上跑了 Qwen3.8-27B:开启「深度思考」模式后,token 消耗是普通模式的 5.5 倍、推理耗时 6 倍;关闭后质量又掉到其他 MoE 模型之后。开源模型「会思考」与「想得起」之间的成本裂缝正在浮出水面。
2h ago2 分钟
GraphifyAI编程助手
程序员让 AI「只读索引不读全文」— 一个小工具把 token 消耗压低了 71 倍,但这个数字需要打问号
Graphify 是一个开源工具,能把代码库转成知识图谱(一种把概念和关系压缩成网络结构的数据格式),让 AI 编程助手查图回答而不是每次重读源代码。官方声称可节省 71 倍 token 消耗。这件事值得关心,不是因为工具本身多成熟,而是因为它折射出一个真实的行业痛点:AI 用得越多,费用越难控制
Apr 202 分钟