返回首页

GLM

找到 14 篇关于此标签的文章

QwenGLM

阿里和智谱同时押注小模型 — 本地 AI 圈开始陷入选择困难

阿里 Qwen Flash 和智谱 GLM Flash 几乎同时推出,让本地部署用户陷入"留一个还是都要"的纠结。这背后是中国开源大模型从"卷参数"转向"卷同档位"的信号。

16h ago2 分钟
智谱GLM

中国大模型装进了 Mac 本地 — 智谱 GLM 被主流工具接纳,这事比看起来重要

一款名为 ds4 的本地推理工具(由 Redis 创始人 antirez 参与维护)本周新增对智谱 GLM Flash 版本的支持,在 128GB M4 Max 上跑通。这意味着中文大模型有了更多本地化运行选项。对关心数据合规的企业 IT 来说,这是值得追踪的具体进展。

1d ago2 分钟
DeepSeekQwen

DeepSeek 当主脑、Qwen 做副手 — 中国开源大模型开始被分工使用

一名开发者把 DeepSeek V4、Qwen 3.8 Flash、GLM 5.3 Flash 三款中国开源大模型塞进 4 张 DGX Spark 本地推理卡跑实测,GLM 5.3 Flash 因太啰嗦、速度仅 22 tok/s 被淘汰,最终让 DeepSeek 扛主力、Qwen 当副手。这反映中国

2d ago2 分钟
智谱通义千问

智谱 GLM Flash 跑赢通义千问 — 大模型没大在刀刃上

智谱和阿里这周各自放出轻量版大模型,Reddit 用户拿官方跑分做了直接对比。GLM 在三项基准领先,通义千问只在研究生级科学问答上反超半个百分点。值得关心的是,GLM 模型体积更大,但性能优势并不悬殊。

3d ago2 分钟
智谱GLM

智谱把 GLM-5.3 轻量版搬上 Hugging Face — 中国大模型公司继续靠开源抢开发者

智谱把 GLM 系列最新轻量版 GLM-5.3-Flash 上传 Hugging Face,主打速度和成本。这是中国大模型公司在开源潮里的又一次出手。值得关心的是:开源模型越轻越多,按调用付费的 API 生意还能撑多久。

3d ago2 分钟
智谱GLM

GLM 5.3 Flash 仍停留在传闻,智谱新模型路线尚无定论

社区正围绕智谱 GLM 5.3 和“Flash”版本展开猜测,但权重尚未发布,消息源也缺少官方信息。传闻或许能反映开源模型的竞争方向,却不能当作产品发布事实。

4d ago2 分钟
EvoXEvoMap

EvoX 测试中把准确率从 26% 提到 71%,组织效率正变得重要

EvoX 是 EvoMap 推出的桌面 Agent(能自主拆解并执行任务的 AI)产品,尝试用任务拆分、上下文隔离和程序汇合改善复杂任务交付。它值得关心,因为模型能力之外,协作架构可能同时影响准确率与成本。

5d ago2 分钟
智谱GLM

智谱 GLM 思考模式"太好笑"被外网截图 — 中国开源大模型开始卷内心戏

智谱 GLM 5.3 的思考模式本周在 r/LocalLLaMA 被用户评价"读着像段子"。表面是社区玩梗,背后是中国开源大模型在 DeepSeek R1 之后,把"思考过程透明化"做成新一轮差异化卖点。

Aug 222 分钟
llama.cppAMD

用退役服务器跑大模型 — 有人让老 AMD 显卡变成 AI 推理机

Reddit 用户 milpster 联合 GLM 发布了一个针对 AMD GFX906 老架构显卡优化的 llama.cpp 推理分支,Mi50、Mi60、Radeon VII 这些早退役的数据中心 GPU 因此可以本地跑大模型。AI 推理的硬件门槛正在被开源社区悄悄砸到二手市场级别。

Aug 222 分钟
智谱Z.ai

代号 Ox Alpha 现身 Reddit — 智谱下一代大模型疑提前曝光

Reddit 本地模型圈出现一个匿名模型 Ox Alpha,自称「我是智谱 GLM」,号称支持 100 万 token 上下文和图像视频输入。如果属实,意味着国内大模型公司在长上下文这条战线开始拿出产品级数字。

Aug 212 分钟
DeepSeekQwen

单次调用贵出预期6倍后,大模型成本控制开始进入工程时代

大模型上线后,成本不只由调用次数决定,也由单次输出、内部推理和多轮工具调用决定。给每次请求和整项任务设上限,正在从省钱技巧变成生产系统的可靠性工程。

Aug 202 分钟
OpenAIGemini

AI 圈一天连发 5 件大事 — 对咱们做副业的到底有啥影响?

上周五 AI 圈 5 件大事挤在一起:OpenAI 营收破 400 亿、苹果联手阿里、国产 GLM-5.3 发布、Cursor 联姻 SpaceX、谷歌 Gemini 3.7 Flash 上线。帮非码农创业者筛出和自己有关的 1 件事。

Aug 152 分钟
Tim Dettmersbitsandbytes

量化大神 Tim Dettmers 预告新招:单机 7t/s 跑大模型 — 业内谨慎观望

bitsandbytes 库创始人 Tim Dettmers 公开一种新模型量化方法,号称让智谱 GLM 5.3 在单台 DGX Spark 工作站跑到 7 token/s。若属实,大模型部署硬件门槛将被大幅压低;但 Reddit 社区明确提醒:量化领域'画大饼'的传统深厚,需要等实测。

Aug 142 分钟
GLM开源模型

GLM 5.1代码能力登顶:中国开源模型的商业拐点来了

GLM 5.1在代码竞技场排名中位列开源模型前三,据社区反馈甚至超越ChatGPT与Gemini,这迫使每一家依赖外包软件开发的中小企业重新估算IT预算。

Apr 102 分钟