Spring 把 AI 焊成 Java 底层 — 9 个破坏性变更
2026 年 6 月 12 日,Spring AI 2.0 正式发布,一次性放出 9 个破坏性变更——底层从 Spring Boot 3 跳到 Boot 4,JSON 库从 Jackson 2 换成 Jackson 3,官方唯一推荐的 API 入口从 ChatModel 换成 ChatClient。对所有正在用 Spring AI 的 Java 项目来说,这次升级不是平滑过渡,而是「换了一次底子」。
相关推荐
基于 #MCP 推荐
AgentAWS
Agent 也要'锁定文件'了 — AI助手上周能用这周就坏,问题不在模型
你的AI助手上周还能正常工作,这周就出错——原因可能不是模型变笨,而是它背后的技能、工具、权限各自在更新却没人统一记录。AWS和OpenAI正在给Agent加上'版本锁'。
8月29日·juejin.cn
DeepSeekGLM
GLM 两张显卡跑赢 DeepSeek — 国产开源不再「将就」
Reddit 用户用两台 NVIDIA DGX Spark(约六万元一台)对比智谱 GLM-5.3 Flash 与 DeepSeek V4 Flash:写代码测试 GLM 97%,DeepSeek 94.5%,但 GLM 慢三成、上下文也短。开源小模型开始有真正的取舍。
8月30日·www.reddit.com
腾讯Hy4
腾讯一个半月把模型从 295B 堆到 770B — 中国大厂用开源抢时间
腾讯发布 Hy4 开源预览版:770B 总参数、49B 激活、1M 上下文、只支持文本。一个半月内从 295B 做到 770B,中国大厂的开源节奏值得关注——但 49B 激活才决定真实算力成本。
8月30日·simonwillison.net
Qwen阿里
工程师把 Qwen 调到极限后发现:26 万 token 是本地 AI 的硬天花板
一位开发者把 Qwen 最新模型调到极致后发现:上下文一旦超过 10 万 token,生成速度暴跌 75%。这说明长上下文仍是本地 AI 的天花板,也是企业绕不开云端的关键证据。
8月30日·www.reddit.com
NInfervLLM
百万上下文跑在两张 5090 上 — 企业自建 AI 的硬件神话被业余玩家打破
一位 Reddit 开发者改造开源推理引擎 NInfer,让 27B 参数 Qwen 模型在两块消费级 5090 上跑出百万 token 上下文,速度比 vLLM 快近 3 倍。值得关心的是:企业自建大模型的硬件门槛正被业余项目瓦解。
8月30日·www.reddit.com
llama.cppMoE
llama.cpp 还有 50 个 PR — 本地跑 AI 不必靠显卡
开源项目 llama.cpp 攒 50+ 性能优化待合并,部分让 CPU 推理提速 3 倍。「本地跑大模型」正摆脱对高端显卡的依赖 — 敏感行业的私有部署和普通用户的离线 AI,都会因此更便宜。
8月29日·www.reddit.com