返回首页

HuggingFace

找到 14 篇关于此标签的文章

UnslothHuggingFace

HF 收购疑云下,Unsloth 让普通显卡跑得动大模型 — 开源生态的真正护城河

Unsloth 是一个让消费级显卡也能跑大模型的开源工具,最近因 HuggingFace 收购传闻被社区集体点赞。真正值得关心的是:当头部平台开始整合,开源生态里那些埋头写代码的团队,决定了普通人未来能不能便宜地用上 AI。

2d ago2 分钟
NvidiaHuggingFace

Nvidia 吞下 HuggingFace,本地跑 AI 的核心工具被收编 — 开源社区最怕的事正在发生

Nvidia 收购 HuggingFace 的交易里,藏着一根容易被忽略的暗线:llama.cpp——让普通电脑本地跑大模型的事实标准工具——团队和版权一并进入 Nvidia 囊中。社区担忧许可证变更,开发者已开始讨论应对。本地 AI 的开源根基正被芯片巨头悄悄整合。

2d ago2 分钟
HuggingFaceNvidia

Reddit 用户提议 BT 替代 HuggingFace 分发大模型 — 没那么简单

开源大模型动辄几十 GB,HuggingFace 的分发带宽成本是天文数字。Reddit 用户提议用 BT 种子让社区分担——听上去双赢,但安全审核、冷门模型死链、商业可持续性三道坎,哪个都不好过。

2d ago2 分钟
benchmark大模型评测

AI 跑分没人信了 — Reddit 开发者集体吐槽 benchmark 注水

r/LocalLLaMA 上一条『你信哪个 benchmark』的提问,评论区『我也不信』刷成主旋律。我们的判断是:这不是个别吐槽,而是 AI benchmark 整体失灵的信号。

Aug 222 分钟
OrnithMTP

Ornith 1.5 出厂带了个没训练的部件 — 开源 AI 品控问题被低估了

Ornith 1.5 大模型被扒出发版时附带一个未经训练的 MTP 模块。这不是简单 bug,而是开源 AI 生态品控机制的缩影,值得每一个想用它降本的企业重新审视。

Aug 202 分钟
Aurora-80KLocalLLaMA

8 万参数的 AI 模型出现 — 它不是 ChatGPT 的对手,但说明了另一件事

独立开发者最近放出了仅 8 万参数的微型语言模型 Aurora-80K,性能远不及主流大模型,但作为开源项目展示了极简架构的可能。它不会装进你的手机,但让我们看到 AI 模型能小到什么程度。

Aug 202 分钟
DeepSeekV4-Pro

DeepSeek 新模型引发讨论 — 中国公司用开源继续撬动闭源阵营

DeepSeek 在 HuggingFace 上线了 V4 Pro 0813 开源大模型。海外科普频道 Two Minute Papers 以「让闭源 AI 看起来可笑」为题做了一期视频,把它放进与 OpenAI 等闭源公司的对比里。背后是开源能否追上闭源这条长期暗线。

Aug 192 分钟
通义千问Qwen

通义千问下载百万次,真正能跑起来的人不到一千 — 本地大模型仍是极客玩具

一位 Reddit 用户算了一笔账:Qwen 3 27B 全球下载约 100 万次,但拥有 24GB 以上显卡的用户可能不足千人。本地大模型的「繁荣」与真实可用人数之间,存在着巨大鸿沟。

Aug 162 分钟
MiniMaxH3

开源视频模型 MiniMax H3 跑出 2K 画质 — 本地部署视频生成的门槛被踩低了一档

MiniMax 八月初放出 H3 全模态视频模型权重,2K、24 帧、带原生立体声,开源可本地跑。同一周字节 Seedance 2.5 走闭源 API 高码率路线。我们关心的是:视频生成的「开源 vs 闭源」分叉,正在 AI 图像领域走过的剧本上重演一遍。

Aug 92 分钟
AI政策开源AI

你的AI工具可能要等政府审批才能用 — 小团队怎么提前准备

美国政府正在讨论对AI模型加审查流程,可能让小团队和开源社区最后才用上最强工具。了解这个趋势,提前分散依赖,别让自己被卡住。

May 62 分钟
RedditMeta

Reddit 社区盘点开源 AI 名人堂:巨头定基调,社区干脏活

Reddit 社区梳理开源 AI 模型名人堂,涵盖 Meta、DeepSeek 等巨头与 llama.cpp 等独立项目。这表明大模型繁荣并非巨头独角戏,而是依赖社区生态的严密分工。

May 32 分钟
QwenSAE

Qwen 开源稀疏自编码器,大模型内部可读可调 — 可解释性赛道中国玩家入场

Qwen 在 HuggingFace 开源了基于 Qwen3.5-27B 的稀疏自编码器,含 80K 特征维度。这让大模型内部逻辑首次可被中国团队拆解、操控,是可解释性方向的重要跟进。

May 32 分钟
GemmaGoogle

Gemma 4 模型文件现身 HuggingFace — 开源社区跑在了官方工具链前面

有人将 gemma-4-31B-it-DFlash 上传至 HuggingFace,但 llama.cpp 尚不支持运行。开源模型迭代速度正把部署工具链甩在身后,拿到模型却用不起来,成了新尴尬。

May 22 分钟
QwenQwen3.6- 35B-A3B

Qwen3.6-35B-A3B released!

Alibaba's Qwen team releases a 35B sparse MoE model with only 3B active params under Apache 2.0.

Apr 162 分钟