返回首页

Token

找到 7 篇关于此标签的文章

KV CacheLLM推理

Token 单价两年跌 90%:理解推理链路,才看懂大模型的成本逻辑

为什么同样一个 AI 助手,有的收费贵、有的能免费用?答案藏在每一次"你说一句话"背后的计算过程里。我们讲清楚 Token、Transformer、KV Cache 这些名词如何决定 AI 公司的成本结构。

Aug 182 分钟
AnthropicClaude Code

Claude Code 用法决定成本 — 同一任务差 1.9 倍 Token

Anthropic 这周详细解释了 Claude Code 的 Token 计费逻辑:同一项代码修复,会用的人 5 次请求搞定,笨办法要 18 次,账单差近 1.9 倍。AI 编程工具的成本变量不只是模型选择,更看你怎么用。

Aug 162 分钟
DeepSeek编程助手

DeepSeek 编程 Agent 源码曝光:核心是 while 循环

本周一篇源码解读在开发者社区流传。我们读完发现,DeepSeek 编程 Agent 的核心是个最多跑 500 轮的 while 循环 — 没有'自主意识',只有'一直问模型下一步干嘛'。理解这个,对评估 AI 工具和建立使用预期都有帮助。

Aug 142 分钟
TokenEmbedding

一篇技术科普讲清 Token 与 Embedding,但更重要的是别再把大模型当黑盒

这篇文章没有发布新产品,而是把大模型“如何读文字”拆成 Token(把文本切成模型可识别的片段)和 Embedding(把片段变成有语义的向量)两步。值得关心的是,企业和个人如果连这层基础都不懂,后续谈成本、效果和落地,判断很容易失真。

Jun 232 分钟
DeepSeekToken

1M token 不是“无限记忆”:大模型真正稀缺的是上下文预算

DeepSeek 这类模型已把上下文窗口做到 1M token,但这不等于 AI 真能“记住一切”。值得我们关心的是,token 不只是计费单位,它决定了模型能看多少、记多久、成本有多高,也决定了企业做 AI 应用时的真实边界。

Jun 212 分钟
LangChain上下文工程

LangChain 推上下文工程:给 AI 塞资料越多越笨,管好上下文成刚需

大模型并非记忆力越好越聪明。LangChain 提出的上下文工程,旨在系统性管理 AI 的“视野”,解决信息过载导致的准确率下降和安全隐患,这标志着 AI 应用从拼参数转向拼工程管控。

May 62 分钟
CursorToken

Cursor省Token实战火爆:8成账单花在无效上下文,AI编程的粗放期结束了

一篇Cursor省Token实战帖揭示,8成账单消耗在无效上下文而非模型思考。AI编程正从粗放调用转向精细算账,上下文管理能力正成为新的效率分水岭。

May 42 分钟