返回首页

代码生成

找到 7 篇关于此标签的文章

掘金AI编程

两年过去 AI 写代码还是这 4 个坑真正的瓶颈从来不在模型

掘金一篇 AI 编程常见问题梳理,把 4 类高频痛点摆到台面。清单不新,但指向很清楚:两年过去,写代码变快了,但判断「写得对不对」没有捷径。

2d ago2 分钟
Forge AdminLLM

AI 写代码提效 10 倍是真的,但前提是规矩得先定死

一个开源企业级框架作者把 LLM 接入后台代码生成,把样板流程效率做到 10 倍 — 但他自己说,真正干活的是模板不是 AI。这个边界判断,对所有想用 AI 提效的业务团队都值得读。

Aug 172 分钟
QwenGemma

Qwen 写代码强、Gemma 聊文本好 — 分词器差异比想象中更致命

一份 Reddit 用户的实测发现:同样 330 行代码,Qwen 切成 1609 个 token,Gemma 切成 4258 个。这个 2.6 倍的差距,可能就是两款开源模型表现风格迥异的隐藏原因。

Aug 92 分钟
小米MiMo

小米 MiMo 耗六倍算力仍出废代码,大模型竞争正从跑分转向交付效率

近日一项复杂编程测试显示,小米 MiMo 2.5 Pro 耗费 6 倍算力仍未交付可用代码,而 DeepSeek 等模型高效完成。这表明大模型跑分已无法反映真实开发水平,企业选型应更关注实际交付率与成本。

May 62 分钟
MistralDevstral

Devstral Small 2 代码跑分首破 80% — Mistral 可能被严重低估

一位开发者自建基准测试显示,Mistral 的 Devstral Small 2 在 8 项代码工程任务中得分超 80%,首次有本地模型跑赢多个闭源对手。开源代码模型的真实能力,可能被标准测试掩盖了。

Apr 302 分钟
GLM开源模型

GLM 5.1代码能力登顶:中国开源模型的商业拐点来了

GLM 5.1在代码竞技场排名中位列开源模型前三,据社区反馈甚至超越ChatGPT与Gemini,这迫使每一家依赖外包软件开发的中小企业重新估算IT预算。

Apr 102 分钟
Qwen3.5Gemma4

Qwen3.5 与 Gemma4 及云端大模型对比:Python Turtle 绘图基准测试

Reddit 用户对本地与云端大模型进行 Python Turtle 绘图基准测试,发现 Gemma4 与 Gemini 在视觉风格上高度相似,本地量化模型表现强劲。

Apr 62 分钟