返回首页

智谱

找到 25 篇关于此标签的文章

智谱GLM-5.3

智谱 GLM-5.3 架构未动训练刷分 — 中国大模型公司开始卷'内功'

智谱 GLM-5.3 在架构与 5.2 完全一致的情况下,仅靠训练方法刷出性能新高。当同行还在堆参数换架构,这条'安静路线'值得关心。

1d ago2 分钟
智谱GLM

中国大模型装进了 Mac 本地 — 智谱 GLM 被主流工具接纳,这事比看起来重要

一款名为 ds4 的本地推理工具(由 Redis 创始人 antirez 参与维护)本周新增对智谱 GLM Flash 版本的支持,在 128GB M4 Max 上跑通。这意味着中文大模型有了更多本地化运行选项。对关心数据合规的企业 IT 来说,这是值得追踪的具体进展。

1d ago2 分钟
智谱TensorSharp

AI 解码快一倍:TensorSharp 把 llama.cpp 拉下马,部署成本或砍半

智谱 GLM-5.3-Flash 在新框架 TensorSharp 上跑出比 llama.cpp 快一倍的解码速度,本地部署成本可能显著下降,但生态成熟度仍是未知数。

1d ago2 分钟
智谱GLM-5.3-Flash

智谱把 AI 写代码打到 4 分钱一次:价格不是新闻,门槛转移才是

智谱 GLM-5.3 Flash 本周上线开源——就是上周刷榜的匿名模型「牛来」Ox-Alpha。一位前端用 4 个真实任务实测总账单 4 分钱,同样的输出量喂 Claude Opus 要 11 块多。差距近 300 倍,但真正的变化是门槛本身的转移。

2d ago2 分钟
智谱GLM-5.3

智谱明天放 GLM-5.3 权重 — 中国大模型公司已把开源当默认动作

智谱 AI 明天放出 GLM-5.3 模型权重,延续 GLM-4 以来的开源承诺。中国大模型公司正把开源当成默认动作,对企业部署成本和开发者生态都有真实影响。

2d ago2 分钟
智谱通义千问

智谱 GLM Flash 跑赢通义千问 — 大模型没大在刀刃上

智谱和阿里这周各自放出轻量版大模型,Reddit 用户拿官方跑分做了直接对比。GLM 在三项基准领先,通义千问只在研究生级科学问答上反超半个百分点。值得关心的是,GLM 模型体积更大,但性能优势并不悬殊。

3d ago2 分钟
智谱GLM-5.3-Flash

智谱旗舰模型定价是 Opus 4.8 的四十分之一 — 中国 AI 改写行业默认

智谱 GLM-5.3-Flash 在 Artificial Analysis 综合智能指数拿到 57 分,与 Claude Opus 4.8 持平,限时价仅为后者的四十分之一。这是中国大模型公司第一次同时拿到前沿性能、低廉价格与最宽松开源协议三张牌。

3d ago2 分钟
智谱GLM

智谱把 GLM-5.3 轻量版搬上 Hugging Face — 中国大模型公司继续靠开源抢开发者

智谱把 GLM 系列最新轻量版 GLM-5.3-Flash 上传 Hugging Face,主打速度和成本。这是中国大模型公司在开源潮里的又一次出手。值得关心的是:开源模型越轻越多,按调用付费的 API 生意还能撑多久。

3d ago2 分钟
智谱Z.ai

智谱开源 GLM-5.3-Flash:性能追 Claude Opus,价格只收上代十分之一

智谱本周开源 GLM-5.3-Flash 模型权重,3200 亿参数只激活 180 亿,号称在编程和 Agent 基准上接近 Claude Opus 4.8,价格只有上代的十分之一。我们关心的是:开源大模型第一次有底气跟闭源顶级模型摆在一起比,但这个底气在实际落地时还剩多少。

3d ago2 分钟
Z.AI智谱

智谱开源 Ox Alpha 对标 DeepSeek — 中国大模型把开源做成标准动作

本周 Z.AI(智谱)确认:神秘冲榜的 Ox Alpha 是 GLM 新一代,今晚开源权重。这不只是技术新闻——继 DeepSeek 之后,第二家中国大模型公司主动押注开源换生态。

3d ago2 分钟
智谱GLM

GLM 5.3 Flash 仍停留在传闻,智谱新模型路线尚无定论

社区正围绕智谱 GLM 5.3 和“Flash”版本展开猜测,但权重尚未发布,消息源也缺少官方信息。传闻或许能反映开源模型的竞争方向,却不能当作产品发布事实。

4d ago2 分钟
Hugging FaceGLM-5.2

1.7 万条攻击日志交给中国模型,开源 AI 防守有了现实样本

Hugging Face 据称让 GLM 5.2 分析 1.7 万多条攻击日志,并用中国模型完成部分防御。它值得关注,因为开源平台已同时连接论文、模型与可执行基础设施,安全边界正在改变。

5d ago2 分钟
智谱GLM

智谱 GLM 思考模式"太好笑"被外网截图 — 中国开源大模型开始卷内心戏

智谱 GLM 5.3 的思考模式本周在 r/LocalLLaMA 被用户评价"读着像段子"。表面是社区玩梗,背后是中国开源大模型在 DeepSeek R1 之后,把"思考过程透明化"做成新一轮差异化卖点。

Aug 222 分钟
llama.cppAMD

用退役服务器跑大模型 — 有人让老 AMD 显卡变成 AI 推理机

Reddit 用户 milpster 联合 GLM 发布了一个针对 AMD GFX906 老架构显卡优化的 llama.cpp 推理分支,Mi50、Mi60、Radeon VII 这些早退役的数据中心 GPU 因此可以本地跑大模型。AI 推理的硬件门槛正在被开源社区悄悄砸到二手市场级别。

Aug 222 分钟
TRAE Workvue3-element-admin

开源维护者用 AI 写了个小工具,挖出埋了 281 天的崩溃 Bug

一位维护 vue3-element-admin 生态的开发者,用 AI 编程工具 TRAE Work 写了一个单文件 HTML 工具,把散在 Gitee、GitHub、AtomGit 三平台的 Issue 自动分诊、聚成 FAQ。意外收获:一条冷冻 281 天、零回复的崩溃级 Bug 被挖了出来。

Aug 222 分钟
智谱Z.ai

代号 Ox Alpha 现身 Reddit — 智谱下一代大模型疑提前曝光

Reddit 本地模型圈出现一个匿名模型 Ox Alpha,自称「我是智谱 GLM」,号称支持 100 万 token 上下文和图像视频输入。如果属实,意味着国内大模型公司在长上下文这条战线开始拿出产品级数字。

Aug 212 分钟
智谱GLM-5.3

智谱同周把模型和 Coding Agent 一起发 — 大模型公司从'卖 Token'转向'卖生态'

智谱同周发布 GLM-5.3 模型和 ZCode Coding Agent,官方数据自家组合比搭配 Claude Code 通过率高 2.39%。这反映大模型公司正从'卖模型能力'走向'模型 + 工具整套交付'。

Aug 202 分钟
智谱GLM-5

智谱 GLM-5.3 跑分进海外榜 — 中国开源旗舰第一次被独立测评认真打分

智谱开源旗舰 GLM-5.3 本周完成 Artificial Analysis 全套基准测试,跻身综合榜前列,是首个进入该海外第三方榜单前列的中国开源模型。值得关心的是:开源阵营现在到底追到前沿的哪一步了。

Aug 192 分钟
Z.aiGLM-5.3

GLM-5.3 用三分之一参数追平 GPT-5 — 后训练这条路被中国走通了

Z.ai(智谱旗下)发布 GLM-5.3,仅 750B 参数就在 Agent 编程基准上追平 GPT-5.6-Sol 与 Claude Fable 5。我们关心的是:中国大模型靠'后训练'的打法,红利期是不是真的开始了。

Aug 142 分钟
Tim Dettmersbitsandbytes

量化大神 Tim Dettmers 预告新招:单机 7t/s 跑大模型 — 业内谨慎观望

bitsandbytes 库创始人 Tim Dettmers 公开一种新模型量化方法,号称让智谱 GLM 5.3 在单台 DGX Spark 工作站跑到 7 token/s。若属实,大模型部署硬件门槛将被大幅压低;但 Reddit 社区明确提醒:量化领域'画大饼'的传统深厚,需要等实测。

Aug 142 分钟
GLM-5.2GB10

GLM-5.2跑出每秒1200词元,本地部署开始从能不能用转向值不值得用

8张GB10卡跑出GLM-5.2约每秒1200词元预填充、33到54词元解码,还能并行挂一套多模态模型。值得关心的不只是速度,而是本地大模型部署正开始讨论投入产出比。

Jul 142 分钟
智谱GLM-5.2

GLM-5.2 已进国产第一梯队,但离替代 GPT 还差落地能力

1M 上下文和长任务表现,让 GLM-5.2 第一次有资格和 GPT、Claude 放进同一张选型表。但我们判断,它更适合做“第二主力”而非全面替代:限流、计费倍率和工具链接入,决定了它离企业默认方案还有距离。

Jun 222 分钟
智谱GLM-5.2

智谱把 GLM-5.2 重点押注长流程任务,大模型竞争开始从会答题转向会干活

智谱放出一个明确信号:GLM-5.2 不再主打“答得更像人”,而是强调长流程任务能力,也就是让模型连续完成多步工作。值得关心的是,这意味着国内大模型竞争点,正从参数和榜单,转向真实业务里的执行稳定性。

Jun 172 分钟
GLM-5.2WebDev Arena

GLM-5.2冲到网页开发榜第二,但国产模型离真正商用还差一段路

GLM-5.2在面向网页开发能力的公开榜单冲到第二,说明国产大模型在代码生成这条最容易变现的赛道上继续逼近头部。但榜单成绩不等于企业可用,稳定性、集成成本和真实业务流程适配,才是更值得关心的下一关。

Jun 162 分钟
GLM-5.2MIT

GLM-5.2 下周开源且可商用,中国大模型开始把牌打到生态位

r/LocalLLaMA 上流出的信息只有一句:GLM-5.2 将在下周发布,开放权重并采用 MIT 许可。消息虽短,但判断并不难:这不是一次普通发版,而是中国大模型公司把竞争重点从“谁更强”转向“谁更容易被用起来”。

Jun 132 分钟