找到 1 篇关于此标签的文章
DeepSeek-V4.1-Flash 在社区被切成两半部署:前层跑 Apple M5 Ultra,后层跑两张 RTX PRO 6000。关键数字是 prompt state 仅 0.9 KB/token。我们认为这意味着 AI 竞争正从堆参数转向比部署成本。