返回首页
Muse-Glimmer
找到 3 篇关于此标签的文章
Qwen3.8Muse-Glimmer
Qwen3.8 跑 30 小时还翻车,小模型三小时搞定 — 架构巧比参数大更重要
一名 r/LocalLLaMA 用户测试发现,Qwen3.8 高投入模式跑完一套基准要 30 小时、还挂了 16 题;Muse Glimmer 三小时搞定,隐式知识得分反而更高。架构巧思开始比参数堆叠更重要,做本地部署和 AI 选型的人值得记一笔。
3d ago2 分钟
DeepSeekMuse-Glimmer
Reddit 用户拿 DeepSeek 加视觉模型搭出'自审代码'工作流 — 中国开源社区比公司跑得快
一位 Reddit 用户用未发布的 DeepSeek-V4-Flash 配合本地视觉模型,让 AI 自己写代码、自己截图、自己挑刺修改,跑出一段动画。背后是开源社区正在试出大公司还没敢发的玩法。
Aug 132 分钟
UnslothMuse-Glimmer
Unsloth 推 30B 参数开源模型 — 本地跑大模型开始走出极客圈
Unsloth 上线 Muse-Glimmer-30B 的 GGUF 量化版本,意味着普通用户的笔记本也能跑 300 亿参数的大模型。我们关心的是:本地化部署正在从极客玩具变成企业 IT 的备选项。
Aug 102 分钟