返回首页
Token
找到 7 篇关于此标签的文章
KV CacheLLM推理
Token 单价两年跌 90%:理解推理链路,才看懂大模型的成本逻辑
为什么同样一个 AI 助手,有的收费贵、有的能免费用?答案藏在每一次"你说一句话"背后的计算过程里。我们讲清楚 Token、Transformer、KV Cache 这些名词如何决定 AI 公司的成本结构。
Aug 182 分钟
AnthropicClaude Code
Claude Code 用法决定成本 — 同一任务差 1.9 倍 Token
Anthropic 这周详细解释了 Claude Code 的 Token 计费逻辑:同一项代码修复,会用的人 5 次请求搞定,笨办法要 18 次,账单差近 1.9 倍。AI 编程工具的成本变量不只是模型选择,更看你怎么用。
Aug 162 分钟
DeepSeek编程助手
DeepSeek 编程 Agent 源码曝光:核心是 while 循环
本周一篇源码解读在开发者社区流传。我们读完发现,DeepSeek 编程 Agent 的核心是个最多跑 500 轮的 while 循环 — 没有'自主意识',只有'一直问模型下一步干嘛'。理解这个,对评估 AI 工具和建立使用预期都有帮助。
Aug 142 分钟
TokenEmbedding
一篇技术科普讲清 Token 与 Embedding,但更重要的是别再把大模型当黑盒
这篇文章没有发布新产品,而是把大模型“如何读文字”拆成 Token(把文本切成模型可识别的片段)和 Embedding(把片段变成有语义的向量)两步。值得关心的是,企业和个人如果连这层基础都不懂,后续谈成本、效果和落地,判断很容易失真。
Jun 232 分钟
DeepSeekToken
1M token 不是“无限记忆”:大模型真正稀缺的是上下文预算
DeepSeek 这类模型已把上下文窗口做到 1M token,但这不等于 AI 真能“记住一切”。值得我们关心的是,token 不只是计费单位,它决定了模型能看多少、记多久、成本有多高,也决定了企业做 AI 应用时的真实边界。
Jun 212 分钟
LangChain上下文工程
LangChain 推上下文工程:给 AI 塞资料越多越笨,管好上下文成刚需
大模型并非记忆力越好越聪明。LangChain 提出的上下文工程,旨在系统性管理 AI 的“视野”,解决信息过载导致的准确率下降和安全隐患,这标志着 AI 应用从拼参数转向拼工程管控。
May 62 分钟
CursorToken
Cursor省Token实战火爆:8成账单花在无效上下文,AI编程的粗放期结束了
一篇Cursor省Token实战帖揭示,8成账单消耗在无效上下文而非模型思考。AI编程正从粗放调用转向精细算账,上下文管理能力正成为新的效率分水岭。
May 42 分钟