OPC
New
最新
OPC 社区
AI 模型榜单
OPCClub
JoinOPC
OPCBot
OPCHome
EN
返回首页
部署成本
找到 1 篇关于此标签的文章
Qwen
DeepSeek
Qwen 用户吐槽推理模型 50% 在说'等一下'——显存被思考烧光
Reddit 上一则玩笑戳中真实痛点:推理模型的思考链充斥填充词,KV cache(推理时的工作记忆)越吃越多,单卡能跑的请求数变少,部署成本正在失控。
Aug 18
·
2 分钟