找到 1 篇关于此标签的文章
一位开发者用自改的开源推理框架,在 M2 Ultra Mac 工作站上以 25.8 token/s 的速度本地跑通 DeepSeek 最新大模型,且模型体积比官方量化版还小。这意味着开源中国大模型在专业硬件上已达到「可对话」水平。