DeepSeek 上线识图能力,价格国产最低 — 但复刻页面实测不如 K3
DeepSeek 这周上线了多模态实验版 deepseek-v4-flash-vision-exp,每百万 token 输入最低 0.05 元 — 这个价格意味着图像理解和文本理解第一次同时进入国产最低档位。但我们更关心的是它能干什么、差在哪。
相关推荐
基于 #DeepSeek 推荐
DeepSeekNVIDIA
DeepSeek 在两台几万元小机器上跑出 67 token/s — 本地大模型门槛正在塌方
本周一位 Reddit 用户用两台 NVIDIA DGX Spark 工作站(约 6 万元)跑出 DeepSeek V4 Flash 67-84 token/s 的稳定输出,配 100 万 token 上下文。我们关心的是这份民间复刻印证了一个被低估的趋势:开源大模型本地部署的成本正在快速下沉,企业
8月29日·www.reddit.com
DeepSeek投机解码
开源大模型现在会'预判'下一句了 — 投机解码正在变成推理标配
最近有用户在本地显卡上跑开源大模型时,肉眼看到投机解码在工作——AI 提前猜出'美利坚合众国'这类高频短语,瞬间整句输出。背后是 MTP 多 token 预测技术。我们关心的是:本地推理的成本曲线正在被悄悄改写。
8月29日·www.reddit.com
NVIDIADGX Spark
把 AI 思考深度拉满反而更差 — DGX Spark 本地实测给企业的提醒
一位 Reddit 开发者用四台 NVIDIA DGX Spark 桌面工作站实测 DeepSeek、Qwen 多款模型,发现「深度思考」模式反而让得分下降、耗时翻倍。这对花钱买 AI 推理服务的企业是直接的成本提醒。
8月29日·www.reddit.com
DeepSeekCordis
DeepSeek 把 Agent 的五把钥匙交出来 — 中文社区开始啃源码
DeepSeek 开源的 Agent 框架里有一套事件分发机制,最近被开发者「怕浪猫」用「五把钥匙」做类比写成 8000 字源码教程。它说明中文 AI 开源生态正在从「调 API」走向「读源码」。
8月29日·juejin.cn
Agent上下文工程
对话越长,AI 越笨:Agent 的真正瓶颈不在记忆,而在读不懂 PPT
一位工程师提出,Agent 卡在落地的根源不是上下文太短,而是它仍在用聊天记录当工作记忆。当 PPT、表格、文档这些"产物"能被 AI 直接读、改、验证时,Agent 才真正进入工作场景。
8月29日·juejin.cn
阿里Pixelle-Video
阿里开源 Pixelle-Video:5 分钟出片不稀奇,调度逻辑才值得抄
阿里 AIDC 团队开源短视频自动化引擎 Pixelle-Video,把一条视频的人工时间压到 5 分钟以内。值得关心的是它背后的「流水线+可插拔工人」架构——工具会过时,调度思路不会。
8月29日·juejin.cn