找到 1 篇关于此标签的文章
本周 Reddit 上一个 AI 极客发现,给模型'惩罚'犹豫词汇能让 Qwen 多答对几道数学题,但在另一个开源模型上却失效。我们关心的是:AI 调优这件事,远没有'一招鲜'那么简单。