开源
找到 30 篇关于此标签的文章
llama.cpp 还有 50 个 PR — 本地跑 AI 不必靠显卡
开源项目 llama.cpp 攒 50+ 性能优化待合并,部分让 CPU 推理提速 3 倍。「本地跑大模型」正摆脱对高端显卡的依赖 — 敏感行业的私有部署和普通用户的离线 AI,都会因此更便宜。
阿里把内部用两年的代码审查工具开源了 — 真正的卖点不是 AI,是工程
阿里开源 OpenCodeReview,GitHub 21k Star。它用「确定性工程 + LLM Agent」的混合架构解决通用 Agent 做代码审查的三大问题。值得关心的是:大厂开始把内部 AI 工具外放,中国 AI 工程化能力被拉到台面上。
HF 收购疑云下,Unsloth 让普通显卡跑得动大模型 — 开源生态的真正护城河
Unsloth 是一个让消费级显卡也能跑大模型的开源工具,最近因 HuggingFace 收购传闻被社区集体点赞。真正值得关心的是:当头部平台开始整合,开源生态里那些埋头写代码的团队,决定了普通人未来能不能便宜地用上 AI。
本地 AI 语音模型库膨胀到 62 套,有人做了个'擂台'帮你挑选
audio.cpp 0.7 把本地能跑的音频 AI 模型扩到 62 个家族、85 个变体,并上线 Arena 对比界面。这说明开源语音 AI 在快速成熟,但模型越多,挑选越难 —— 选型工具本身就是这个阶段的标志。
Lemonade SDK 让本地跑大模型像装 App — 15 种 AI 引擎已统一调度
由 AMD 员工牵头的开源项目 Lemonade 把 15 种 AI 模型引擎藏到同一入口背后,覆盖英伟达/AMD/苹果/高通四类硬件。本地部署大模型正从极客玩具走向可用工具,对数据敏感型中国企业尤其值得关注。
ZeroClaw 让 AI 长出'手脚' — 大模型走出聊天框的硬件信号
一个用 Rust 写的开源项目,能让大模型直接控制机械臂、传感器和灯光——AI 不再只聊文字,开始动手碰物理世界。这事离消费市场还远,但开源社区发出的信号值得企业 IT 提前看懂。
DeepSeek 把自家智能体的「操作系统」开源了 — 这件事比技术细节更重要
DeepSeek 内部用了多年的 AI 智能体编排框架 Cordis,最近被开发者做成 9 章源码剖析系列公开。我们认为,这是中国头部 AI 公司首次把生产环境的 Agent 底层架构以这种颗粒度开放。
DeepSeek Agent 框架被开发者拆到源码层 — 大模型竞争延伸到应用底座
DeepSeek 旗下的 dsh 框架支持 Web、命令行、桌面等六种入口,整套源码最近被开发者完整拆解。我们关心的是:中国大模型公司正在把战场从模型本身扩展到应用底座,这对开发者和企业 IT 选型有实质影响。
Meta 把 5.3B 参数大模型塞进 3GB 手机内存 — 但只能研究用
Meta 放出 MobileMoE:5.3B 总参数、激活不到 1B,INT4 压缩后 <3GB,手机内存就能装下。但 FAIR NC 协议禁止商用——这是学术礼物,不是产品武器。
DeepSeek 开源 Agent 框架一周实测:不是 Claude Code 平替,是可控的开源底座
DeepSeek 开源的 Agent 编程框架 Harness 一周拿下 9.5 万 Star,但实测开发者指出多数人卡在环境配置、任务拆解、插件选型与预期管理四个环节。它不是 Claude Code 的免费替代品,而是一块需要自己组装的开源底座。
MiniMax 的 Agent 框架源码被拆中央调度模式被标不推荐
MiniMax 的开源框架 Eino 提供了三种 Agent 协作预制模式,其中一种被自家源码标注为不推荐——这不是某个开发者的个人意见,而是来自大模型公司内部的工程判断。对正在选型的企业 IT 来说是个信号:Agent 框架开始有立场。
Linux 之父给 AI debug 助手打了分:能扛苦活,遇难题就喊'不可能'
Linux 内核最新一个 commit 的提交说明是 AI 写的,Torvalds 自己确认。这件事之外,更值得企业 IT 关心的是他对这个 AI 助手的真实评价:能扛苦活,但一遇难题就喊'不可能'、劝他写报告交差——这是当前大模型一个绕不开的结构性特征。
开源维护者用 AI 写了个小工具,挖出埋了 281 天的崩溃 Bug
一位维护 vue3-element-admin 生态的开发者,用 AI 编程工具 TRAE Work 写了一个单文件 HTML 工具,把散在 Gitee、GitHub、AtomGit 三平台的 Issue 自动分诊、聚成 FAQ。意外收获:一条冷冻 281 天、零回复的崩溃级 Bug 被挖了出来。
AI Agent 用着用着就断片?一个开源项目的源码暴露了产品真相
Pi 是一款开源代码 Agent。这篇深度解读掀开它的会话持久化机制 — 五状态机、只追加的状态树、半持久化的工程妥协。值得关心的是:AI 产品真正难的不是模型,是让模型别"断片"的工程。
商汤开源图像模型 U1.5-Lite:训练时各管一摊,用时只需一个
商汤发布开源图像生成模型 U1.5-Lite:训练阶段先用多个「专家模型」分头提升不同能力(文字、信息图、审美、编辑),再通过蒸馏技术合并为一个统一模型。推理时无需路由切换,GitHub 与 HuggingFace 可直接下载。
8 万参数的 AI 模型出现 — 它不是 ChatGPT 的对手,但说明了另一件事
独立开发者最近放出了仅 8 万参数的微型语言模型 Aurora-80K,性能远不及主流大模型,但作为开源项目展示了极简架构的可能。它不会装进你的手机,但让我们看到 AI 模型能小到什么程度。
Unsloth 把 Qwen 压到 8GB 内存可跑,本地大模型真不挑机器了
开源部署工具 Unsloth 这周更新「Dynamic v3.0」量化方案,让 Qwen 系列模型在 8GB 内存的普通笔记本上就能跑,最极端的 1-bit 版本仍保留 77% 准确率。这直接降低了企业本地跑大模型的硬件门槛和数据外传顾虑,值得决策者看一眼。
DeepSeek 让开发者逐行拆解 Agent 框架内核 — 中国 AI 工程化开始敢亮源代码了
DeepSeek 的 Agent 开发框架 dsh 被开发者逐行拆解,9 个文件 2693 行 TypeScript 全公开。中国头部大模型公司愿意把工程化底牌摆出来,这本身是个值得关注的信号。
Ragent 1.1.0 上线:中国开发者的 RAG 框架,做起了「企业级」的活
GitHub 上 3.5k Star 的中国开源 RAG 框架 Ragent 发布 1.1.0。一个独立开发者把「能跑」做成了「可审计」——四通道混合检索、来源溯源、模型分级路由、审计追溯,是国内 RAG 工具开始向企业级靠拢的信号。
24000 本电子书被打包开源到 GitHub — 知识共享撞上了版权墙
GitHub 上一个仓库用脚本抓取了 24000 本中文电子书的下载链接,免费开源共享。它不炫技但规模惊人,更重要的是它撞上了付费平台与版权方的边界——这件事和 AI 训练数据之争是同一类问题。
DeepSeek 把 Harness 也开源了 — 中国大模型开始卷 Agent 全栈
DeepSeek 把 Agent 运行环境 Harness 完整开源,GitHub 不到 48 小时突破 11.5 万 Star。它用「一切皆插件」的微内核架构对标 Claude Code。值得关心的是:中国大模型公司不再只卖模型,开始卷整套 Agent 工具链,竞争从模型层烧到了落地层。
DeepMind 世界模型 Genie 被开源者复刻到单张 5090 — 造游戏世界的算力门槛被打下来
本周我们在 Reddit 论坛注意到,一位开发者用一张 RTX 5090 复刻出 DeepMind 的 Genie 世界模型,第一次跑出数据中心。AI 生成可交互虚拟场景的算力门槛,正在从实验室下放到本地 PC。
六款开源 AI 写作工具摆上擂台:质量门比生成器本身更值钱
一个开发者把 GitHub 上六款开源 AI 写作工具全部跑过一遍,发现市场正在分裂——工程派把质量门禁做厚,社区派把用户体验做轻。值得关心的是:内容工具的下一站,到底是工业流水线还是社区共创?
DeepSeek 发布 Harness 开源框架 — 中国大模型公司开始卷工具链
DeepSeek 在 GitHub 开源了 Agent 编排框架 Harness(dsh),核心设计是「一切皆插件」。我们判断这是中国大模型公司从「拼模型」切到「拼工具链」的信号。
本地 AI 较真:27B 大模型在 RTX 5060 Ti 上跑通 13 万字上下文
本周 LocalLLaMA 社区更新 RTX 5060 Ti 本地大模型项目,把'能加载 13 万字'和'能稳定回答 13 万字问题'分开测试。这件事比单一 benchmark 更有信号意义:开源本地大模型正从'跑得动'进入'真能用'阶段。
DeepSeek 把 AI Agent 运行时拆成三层乐高 — 中国大模型公司开始卖地基
DeepSeek 开源 Harness 命令行工具,把 Agent 的运行时拆成三层可拼装结构。我们关心的是:中国大模型公司开始从卖模型转向卖基础设施,但官方明示还在开发者预览版,接口随时会变。
DeepSeek 开源 Agent 框架 24 小时拿下 4.5 万 Star — 半成品也能引爆,靠的是品牌势能
DeepSeek 把自家 Agent 框架 Harness 开源,不到 24 小时冲上 4.5 万 Star。功能粗糙、面向开发者,但 DeepSeek 的品牌势能依然能让一个"半成品"瞬间成为行业事件。值得关心的是:中国 Agent 框架之争,正式从闭门自研走向开源抢人。
DeepSeek 首款 Agent 开源,但体验太糙——社区三天自己包了个桌面版
DeepSeek 开源了第一个 Agent 产品 Harness,官方形态是命令行 + 浏览器标签。有开发者用 Tauri(一种轻量桌面应用框架)直接把它包成桌面应用。这暴露的是:中国大模型公司能力到了,但'最后一公里'还在靠社区补。
DeepSeek 开源 dsh — 一天 5 万 star,但 README 只一句话
DeepSeek 8 月 13 日开源编码 Agent「dsh」,主打「一切皆插件」,一天冲上 5 万 star。值得我们关心的是:国产 AI 的竞争,正从「比模型」升级到「比工具链与生态」。
DeepSeek 推出开源 Agent 框架 Harness — 从卖模型升级为卖工具链
DeepSeek 这周悄悄上线了一款叫 Harness 的开源 Agent 框架——让 AI 不光会回答、还能自己动手干活的「调度系统」,目前还在开发者预览阶段。值得关心的是:这家公司从卖模型转向卖工具链,开始抢占 Agent 中间层。模型价格战打完之后,下一轮国产 AI 的赛点,可能就在这里。