返回首页

开源

找到 30 篇关于此标签的文章

llama.cppMoE

llama.cpp 还有 50 个 PR — 本地跑 AI 不必靠显卡

开源项目 llama.cpp 攒 50+ 性能优化待合并,部分让 CPU 推理提速 3 倍。「本地跑大模型」正摆脱对高端显卡的依赖 — 敏感行业的私有部署和普通用户的离线 AI,都会因此更便宜。

2h ago2 分钟
阿里巴巴OpenCodeReview

阿里把内部用两年的代码审查工具开源了 — 真正的卖点不是 AI,是工程

阿里开源 OpenCodeReview,GitHub 21k Star。它用「确定性工程 + LLM Agent」的混合架构解决通用 Agent 做代码审查的三大问题。值得关心的是:大厂开始把内部 AI 工具外放,中国 AI 工程化能力被拉到台面上。

14h ago2 分钟
UnslothHuggingFace

HF 收购疑云下,Unsloth 让普通显卡跑得动大模型 — 开源生态的真正护城河

Unsloth 是一个让消费级显卡也能跑大模型的开源工具,最近因 HuggingFace 收购传闻被社区集体点赞。真正值得关心的是:当头部平台开始整合,开源生态里那些埋头写代码的团队,决定了普通人未来能不能便宜地用上 AI。

2d ago2 分钟
audio.cpp开源

本地 AI 语音模型库膨胀到 62 套,有人做了个'擂台'帮你挑选

audio.cpp 0.7 把本地能跑的音频 AI 模型扩到 62 个家族、85 个变体,并上线 Arena 对比界面。这说明开源语音 AI 在快速成熟,但模型越多,挑选越难 —— 选型工具本身就是这个阶段的标志。

2d ago2 分钟
LemonadeAMD

Lemonade SDK 让本地跑大模型像装 App — 15 种 AI 引擎已统一调度

由 AMD 员工牵头的开源项目 Lemonade 把 15 种 AI 模型引擎藏到同一入口背后,覆盖英伟达/AMD/苹果/高通四类硬件。本地部署大模型正从极客玩具走向可用工具,对数据敏感型中国企业尤其值得关注。

3d ago2 分钟
ZeroClaw开源

ZeroClaw 让 AI 长出'手脚' — 大模型走出聊天框的硬件信号

一个用 Rust 写的开源项目,能让大模型直接控制机械臂、传感器和灯光——AI 不再只聊文字,开始动手碰物理世界。这事离消费市场还远,但开源社区发出的信号值得企业 IT 提前看懂。

3d ago2 分钟
DeepSeekCordis

DeepSeek 把自家智能体的「操作系统」开源了 — 这件事比技术细节更重要

DeepSeek 内部用了多年的 AI 智能体编排框架 Cordis,最近被开发者做成 9 章源码剖析系列公开。我们认为,这是中国头部 AI 公司首次把生产环境的 Agent 底层架构以这种颗粒度开放。

3d ago2 分钟
DeepSeekdsh

DeepSeek Agent 框架被开发者拆到源码层 — 大模型竞争延伸到应用底座

DeepSeek 旗下的 dsh 框架支持 Web、命令行、桌面等六种入口,整套源码最近被开发者完整拆解。我们关心的是:中国大模型公司正在把战场从模型本身扩展到应用底座,这对开发者和企业 IT 选型有实质影响。

4d ago2 分钟
MetaMobileMoE

Meta 把 5.3B 参数大模型塞进 3GB 手机内存 — 但只能研究用

Meta 放出 MobileMoE:5.3B 总参数、激活不到 1B,INT4 压缩后 <3GB,手机内存就能装下。但 FAIR NC 协议禁止商用——这是学术礼物,不是产品武器。

5d ago2 分钟
DeepSeekHarness

DeepSeek 开源 Agent 框架一周实测:不是 Claude Code 平替,是可控的开源底座

DeepSeek 开源的 Agent 编程框架 Harness 一周拿下 9.5 万 Star,但实测开发者指出多数人卡在环境配置、任务拆解、插件选型与预期管理四个环节。它不是 Claude Code 的免费替代品,而是一块需要自己组装的开源底座。

5d ago2 分钟
MiniMaxEino

MiniMax 的 Agent 框架源码被拆中央调度模式被标不推荐

MiniMax 的开源框架 Eino 提供了三种 Agent 协作预制模式,其中一种被自家源码标注为不推荐——这不是某个开发者的个人意见,而是来自大模型公司内部的工程判断。对正在选型的企业 IT 来说是个信号:Agent 框架开始有立场。

6d ago2 分钟
Linus TorvaldsLinux 内核

Linux 之父给 AI debug 助手打了分:能扛苦活,遇难题就喊'不可能'

Linux 内核最新一个 commit 的提交说明是 AI 写的,Torvalds 自己确认。这件事之外,更值得企业 IT 关心的是他对这个 AI 助手的真实评价:能扛苦活,但一遇难题就喊'不可能'、劝他写报告交差——这是当前大模型一个绕不开的结构性特征。

Aug 232 分钟
TRAE Workvue3-element-admin

开源维护者用 AI 写了个小工具,挖出埋了 281 天的崩溃 Bug

一位维护 vue3-element-admin 生态的开发者,用 AI 编程工具 TRAE Work 写了一个单文件 HTML 工具,把散在 Gitee、GitHub、AtomGit 三平台的 Issue 自动分诊、聚成 FAQ。意外收获:一条冷冻 281 天、零回复的崩溃级 Bug 被挖了出来。

Aug 222 分钟
PiHarness

AI Agent 用着用着就断片?一个开源项目的源码暴露了产品真相

Pi 是一款开源代码 Agent。这篇深度解读掀开它的会话持久化机制 — 五状态机、只追加的状态树、半持久化的工程妥协。值得关心的是:AI 产品真正难的不是模型,是让模型别"断片"的工程。

Aug 212 分钟
商汤SenseTime

商汤开源图像模型 U1.5-Lite:训练时各管一摊,用时只需一个

商汤发布开源图像生成模型 U1.5-Lite:训练阶段先用多个「专家模型」分头提升不同能力(文字、信息图、审美、编辑),再通过蒸馏技术合并为一个统一模型。推理时无需路由切换,GitHub 与 HuggingFace 可直接下载。

Aug 212 分钟
Aurora-80KLocalLLaMA

8 万参数的 AI 模型出现 — 它不是 ChatGPT 的对手,但说明了另一件事

独立开发者最近放出了仅 8 万参数的微型语言模型 Aurora-80K,性能远不及主流大模型,但作为开源项目展示了极简架构的可能。它不会装进你的手机,但让我们看到 AI 模型能小到什么程度。

Aug 202 分钟
UnslothQwen

Unsloth 把 Qwen 压到 8GB 内存可跑,本地大模型真不挑机器了

开源部署工具 Unsloth 这周更新「Dynamic v3.0」量化方案,让 Qwen 系列模型在 8GB 内存的普通笔记本上就能跑,最极端的 1-bit 版本仍保留 77% 准确率。这直接降低了企业本地跑大模型的硬件门槛和数据外传顾虑,值得决策者看一眼。

Aug 192 分钟
DeepSeekdsh

DeepSeek 让开发者逐行拆解 Agent 框架内核 — 中国 AI 工程化开始敢亮源代码了

DeepSeek 的 Agent 开发框架 dsh 被开发者逐行拆解,9 个文件 2693 行 TypeScript 全公开。中国头部大模型公司愿意把工程化底牌摆出来,这本身是个值得关注的信号。

Aug 192 分钟
Ragentnageoffer

Ragent 1.1.0 上线:中国开发者的 RAG 框架,做起了「企业级」的活

GitHub 上 3.5k Star 的中国开源 RAG 框架 Ragent 发布 1.1.0。一个独立开发者把「能跑」做成了「可审计」——四通道混合检索、来源溯源、模型分级路由、审计追溯,是国内 RAG 工具开始向企业级靠拢的信号。

Aug 192 分钟
GitHub开源

24000 本电子书被打包开源到 GitHub — 知识共享撞上了版权墙

GitHub 上一个仓库用脚本抓取了 24000 本中文电子书的下载链接,免费开源共享。它不炫技但规模惊人,更重要的是它撞上了付费平台与版权方的边界——这件事和 AI 训练数据之争是同一类问题。

Aug 182 分钟
DeepSeekHarness

DeepSeek 把 Harness 也开源了 — 中国大模型开始卷 Agent 全栈

DeepSeek 把 Agent 运行环境 Harness 完整开源,GitHub 不到 48 小时突破 11.5 万 Star。它用「一切皆插件」的微内核架构对标 Claude Code。值得关心的是:中国大模型公司不再只卖模型,开始卷整套 Agent 工具链,竞争从模型层烧到了落地层。

Aug 172 分钟
DeepMindGenie

DeepMind 世界模型 Genie 被开源者复刻到单张 5090 — 造游戏世界的算力门槛被打下来

本周我们在 Reddit 论坛注意到,一位开发者用一张 RTX 5090 复刻出 DeepMind 的 Genie 世界模型,第一次跑出数据中心。AI 生成可交互虚拟场景的算力门槛,正在从实验室下放到本地 PC。

Aug 162 分钟
NovelOpsLong-Novel-GPT

六款开源 AI 写作工具摆上擂台:质量门比生成器本身更值钱

一个开发者把 GitHub 上六款开源 AI 写作工具全部跑过一遍,发现市场正在分裂——工程派把质量门禁做厚,社区派把用户体验做轻。值得关心的是:内容工具的下一站,到底是工业流水线还是社区共创?

Aug 162 分钟
DeepSeekHarness

DeepSeek 发布 Harness 开源框架 — 中国大模型公司开始卷工具链

DeepSeek 在 GitHub 开源了 Agent 编排框架 Harness(dsh),核心设计是「一切皆插件」。我们判断这是中国大模型公司从「拼模型」切到「拼工具链」的信号。

Aug 162 分钟
LocalLLaMARTX 5060 Ti

本地 AI 较真:27B 大模型在 RTX 5060 Ti 上跑通 13 万字上下文

本周 LocalLLaMA 社区更新 RTX 5060 Ti 本地大模型项目,把'能加载 13 万字'和'能稳定回答 13 万字问题'分开测试。这件事比单一 benchmark 更有信号意义:开源本地大模型正从'跑得动'进入'真能用'阶段。

Aug 162 分钟
DeepSeekHarness

DeepSeek 把 AI Agent 运行时拆成三层乐高 — 中国大模型公司开始卖地基

DeepSeek 开源 Harness 命令行工具,把 Agent 的运行时拆成三层可拼装结构。我们关心的是:中国大模型公司开始从卖模型转向卖基础设施,但官方明示还在开发者预览版,接口随时会变。

Aug 152 分钟
DeepSeekHarness

DeepSeek 开源 Agent 框架 24 小时拿下 4.5 万 Star — 半成品也能引爆,靠的是品牌势能

DeepSeek 把自家 Agent 框架 Harness 开源,不到 24 小时冲上 4.5 万 Star。功能粗糙、面向开发者,但 DeepSeek 的品牌势能依然能让一个"半成品"瞬间成为行业事件。值得关心的是:中国 Agent 框架之争,正式从闭门自研走向开源抢人。

Aug 142 分钟
DeepSeekDeepSeek Harness

DeepSeek 首款 Agent 开源,但体验太糙——社区三天自己包了个桌面版

DeepSeek 开源了第一个 Agent 产品 Harness,官方形态是命令行 + 浏览器标签。有开发者用 Tauri(一种轻量桌面应用框架)直接把它包成桌面应用。这暴露的是:中国大模型公司能力到了,但'最后一公里'还在靠社区补。

Aug 142 分钟
DeepSeekdsh

DeepSeek 开源 dsh — 一天 5 万 star,但 README 只一句话

DeepSeek 8 月 13 日开源编码 Agent「dsh」,主打「一切皆插件」,一天冲上 5 万 star。值得我们关心的是:国产 AI 的竞争,正从「比模型」升级到「比工具链与生态」。

Aug 142 分钟
DeepSeekAgent框架

DeepSeek 推出开源 Agent 框架 Harness — 从卖模型升级为卖工具链

DeepSeek 这周悄悄上线了一款叫 Harness 的开源 Agent 框架——让 AI 不光会回答、还能自己动手干活的「调度系统」,目前还在开发者预览阶段。值得关心的是:这家公司从卖模型转向卖工具链,开始抢占 Agent 中间层。模型价格战打完之后,下一轮国产 AI 的赛点,可能就在这里。

Aug 132 分钟