找到 1 篇关于此标签的文章
一则来自 Reddit 社区的技术更新称,针对 B300 的新 FP4 注意力内核可比 FA4 最高快 1.69 倍。值得关心的不是单次跑分,而是大模型竞争正在从“谁参数更多”转向“谁把底层算子磨得更好”。