token-economics
找到 12 篇关于此标签的文章
DeepSeek 周末统一低谷价:这不是降价,是 GPU 闲置变现
DeepSeek 8 月 23 日起将周末全天按低谷时段计费。表面是"周末打折",实际是把 LLM inference 的 GPU 空闲时段做 demand shaping — 这是 AWS Spot Instance 思路的推理市场版本。对 AI builder 意味着周末批量任务的重排窗口,对
Nvidia 涨价 15% 背后: 推理成本曲线开始掉头
Bloomberg 报道 Nvidia 因 HBM 成本上涨向客户发出 15%+ 涨价通知, AI 推理成本长期下降的隐含假设第一次撞上 memory wall。GPU compute 不再是唯一瓶颈, HBM 供给曲线决定了 token 经济学未来 12-18 个月的走向。
NVIDIA 押注 25% 残值: AI 算力金融化的拐点
黄仁勋携六家华尔街资管巨头背书 AI 算力资产化, 并表态英伟达可能为单个投资项目提供最高 25% 残值支持。这不是简单的灭火动作 — 是把 GPU 从硬件产品重新定义为可融资的金融资产, 整个 AI 基建融资成本曲线将因此下移, token 边际成本可能比列表价更低。
AI 定价正在逃离 token
Bloomberg 8 月 13 日报道 OpenAI 与 Anthropic 同步推广新的 AI 成本衡量指标, 引导客户重新思考模型定价逻辑。这不是营销包装, 而是 token pricing 见顶后, lab 层争夺价值捕获定价权的结构性动作 — pricing unit 正从 per-tok
Google 改的不是配额,是定价
Google 调整 Gemini usage quota 的 tallying 方式,表面是计费与用量说明更新,实质是在把 AI 消费从“次数”改写成“资源强度”定价。这对 builder 的意义,是免费与订阅层的稳定性假设又少了一层。
电网开始给 Token 定价
7月17日上海 WAIC 上,国家能源局把 AI 讨论从训练容量转向推理负荷。这不是口号,而是电力系统开始承认 inference 会成为真实的资源约束。
阿里云先打响 Fast mode 价格战
阿里云宣布自 2026 年 7 月 15 日起下调百炼平台 GLM-5.2 Fast mode 价格。表面看只是一次调价,实际上更像 model access 市场把“快模型”进一步金融化:先被压缩的不是能力,而是每百万 token 的边际利润。
Agent loop 不是新物种
Lenny 这篇不是在教“新范式”,而是在把 agent loop 去神秘化:Claude Code 与 Codex 的竞争点,不是会不会 loop,而是谁更早把 loop 的成本约束、subagent 编排和验证机制产品化。
context-mode 不是插件,是 token 闸门
context-mode 的表面故事是“AI 编程省钱 98%”,真正的信号是:AI coding 正从拼模型能力,转向拼上下文编排、工具调用治理与本地执行路径设计。这会重定价 MCP 中间层。
真正短缺的不是 GPU
2026 年 5 月,Jensen Huang 公开称 memory demand 正在超过 capacity。表面看是供应链抱怨,实质是 AI 基建瓶颈从 FLOPS 转向 memory。接下来会被重新定价的,不是算力名义峰值,而是有效 token throughput。
阿里不是在卖 Accio Work
阿里财报里真正值得看,不是一个外贸 AI 工具上线,而是阿里把跨境贸易入口、商家 workflow 与 token 消耗绑在一起。日均 token 调用量翻倍,说明 AI 正开始吞掉交易前台。
AI 吃 SaaS,真正涨价的是组织
明略吴明辉不是在讲“AI 替代软件”的老故事,而是在给企业软件重新定价:软件壳趋近零,token 成本与组织编排能力开始成为新 billable unit。