返回首页

GPT

找到 10 篇关于此标签的文章

Claude OpusGPT

Claude Opus 又一次赢了 GPT:联网查资料反而成了 AI 扣分项

开发者拿同一道 OpenCode 卡死问题考 Opus 5 与 GPT 5.6。Opus 一次答对,GPT 三次才摸到真相。编辑部更关心的是:联网查资料的 AI 全部答错,自己推理的全部答对。

4d ago2 分钟
RedditClaude

Reddit '猜模型'游戏火了:5 个 AI 画动漫女孩,开源没掉队

Reddit r/LocalLLaMA 板块一个'猜模型'游戏被热转:用同一句话让 5 个大模型画 3D 动漫少女,不能迭代,一次出图。结果显示,闭源(Claude、GPT)和开源(Qwen)的差距正在缩小,国内开源生态值得关注。

Aug 162 分钟
Kimi K3Claude

Kimi K3 在 Arena 跑赢 Claude 和 GPT,但榜单胜利还不是商业胜利

一则 Reddit 帖子称,Kimi K3 在 arena.ai 的对战中超过 Claude Fable 与 GPT 5.6 sol。值得关心的,不是一次榜单起伏本身,而是中国大模型在“主观体验”上正逼近全球头部;但排行榜成绩离企业可用、商业可赚,还隔着稳定性与交付能力。

Jul 162 分钟
智谱GLM-5.2

GLM-5.2 已进国产第一梯队,但离替代 GPT 还差落地能力

1M 上下文和长任务表现,让 GLM-5.2 第一次有资格和 GPT、Claude 放进同一张选型表。但我们判断,它更适合做“第二主力”而非全面替代:限流、计费倍率和工具链接入,决定了它离企业默认方案还有距离。

Jun 222 分钟
DeepSeek豆包

7家大模型都答错一道《坦克大战》题,问题不在识图而在规则推理

一次《坦克大战》图片测试里,豆包、DeepSeek、Qwen、GPT、Claude 等 7 家模型全部答错。值得我们关心的,不是哪家“翻车”,而是主流模型在视觉识别之外,仍明显依赖旧规则和模板化知识,遇到“如果”这类条件改写时,推理稳定性不足。

Jun 222 分钟
GPT深度使用

你用 AI 写邮件觉得一般?因为你还没摸到它真正猛的地方

用 AI 做简单活感觉提升有限,是因为你停在浅水区。把 AI 推到你专业里最难的环节,它能替你省掉几天的脑力活,十几分钟出结果。

May 52 分钟
GPTClaude

你不敢问出口的问题,暴露你选错了 AI — 两个工具各管各的

搞明白 GPT 和 Claude 的心理分工:纯执行、怕丢脸的问题丢给 GPT,需要方向感和深度追问的事找 Claude,省下反复纠结选工具的内耗

May 52 分钟
GoogleTransformer

Google 提出的 Transformer 统治 AI 七年 — 大模型底层架构正等待下一次洗牌

Transformer 是当今所有主流大模型的底层架构,它用自注意力机制解决了老算法无法并行和读长文的问题。理解它,才能看懂大模型的能力边界与未来瓶颈。

May 42 分钟
GoogleSeq2Seq

Seq2Seq 架构十年演进 — 理解它才算真正看懂大模型的技术起点

2014 年 Google 提出的 Seq2Seq 架构,是 GPT、BERT 等大模型共同的技术底座。理解它的编码器-解码器分工与信息瓶颈,才能判断 AI 能力边界。

May 12 分钟
Futharkmicrogpt

用冷门语言重写微型 GPT — AI 学习正从调 API 回到造轮子

开发者用冷门函数式语言 Futhark 重写极简 GPT 实现,项目本身是个人实践,但反映一个值得关心的趋势:AI 圈出现从'调 API'回到'从零造轮子'的路径转向,理解原理正重新变得值钱。

May 12 分钟