找到 1 篇关于此标签的文章
有开发者把 DeepSeek V4 这类超大 MoE 模型硬塞进 32GB 内存笔记本,靠重排权重和投机预取专家层,跑出 70 tok/s 的输入速度。虽然输出还慢,但证明消费级硬件跑顶级模型正在变成现实。