返回首页
大模型成本
找到 4 篇关于此标签的文章
KV CacheLLM推理
Token 单价两年跌 90%:理解推理链路,才看懂大模型的成本逻辑
为什么同样一个 AI 助手,有的收费贵、有的能免费用?答案藏在每一次"你说一句话"背后的计算过程里。我们讲清楚 Token、Transformer、KV Cache 这些名词如何决定 AI 公司的成本结构。
Aug 182 分钟
DeepSeekAPI 定价
DeepSeek 缓存命中最高涨 12 倍 — 还在靠 AI 抠成本的公司,账要重算了
8 月 17 日零时 DeepSeek 新定价生效,V4-Pro 高峰时段缓存命中从 0.025 涨到 0.30 元/百万 tokens,翻 12 倍。这不是普通调价,而是精准砍向 RAG、Agent 这类高频调用场景 — 过去靠缓存省钱的那批企业,账得重新算了。
Aug 172 分钟
Transformer自注意力机制
自注意力机制让AI看懂上下文 — 但理解它的企业仍然不多
自注意力机制是当前主流AI模型的核心,让AI能同时考虑一段话里所有词的关系。理解它,是判断AI应用成本与效果的关键起点,值得每位关注AI的决策者花十分钟搞懂。
May 62 分钟
ReWOOPlan-and-Execute
AI智能体开始先想后做:省下大笔Token,但开环执行易烂尾
Agent架构正从ReAct的步步观察转向先想后做。ReWOO省了Token却易烂尾,Plan-and-Execute能纠错却极耗成本,这标志着AI落地进入精算时代。
May 12 分钟