返回首页

Kimi

找到 20 篇关于此标签的文章

UsoraClaude Code

一个开源项目想治 AI 用完就忘的毛病 — 这是真痛点还是伪需求?

一个中国独立开发者做了开源工具 Usora,试图解决'每次让 AI 帮忙都要重新讲一遍'的尴尬。它把人与 AI 协作中产生的方法沉淀成可复用的技能,跨 Codex、Claude Code、Kimi 等多个 AI 工作。这事值得关心,是因为它指向一个正在浮现的问题——我们和 AI 协作积累的经验,正在

18h ago2 分钟
Michael Gomes VieiraDeepSeek

AI「思考慢、复制快」被工程师写成博客 — 但只对了一半

英国工程师 Michael Gomes Vieira 提出一个工程时间观:AI 推理慢,蒸馏(即把大模型的能力迁移给小模型)快。中国大模型团队早就在用这条规律,但「复制快」不等于「能力等价」——这是工程优势,不是能力保证。

4d ago2 分钟
Qwen通义千问

通义 Qwen 3.8 27B 在 Reddit 刷屏,但官方从来没发过这版本

海外本地大模型社区疯传通义实验室新模型 Qwen 3.8 27B 在可视化任务上明显强于前代及 DeepSeek、Kimi 等开源对手。但通义官方渠道查不到这个版本号,对比表里其他几家的版本号也对不上现网公开信息 —— 情绪很热,证据很弱。

Aug 222 分钟
月之暗面Kimi

Kimi K3 进了 llama.cpp — 国产大模型又能装进自己电脑了

llama.cpp 仓库本周收到对 Kimi K3 的适配 PR,意味着这一国产新模型有望像 Llama、Qwen 一样在本地电脑运行,中文用户多了一个不依赖云端 API 的备选项。

Aug 152 分钟
Motif-TechnologiesMotif-3

韩国 AI 大模型竞赛二轮洗牌:Motif-3 反超 LG,中国开源模型成基准线

韩国 AI 基础模型项目第二轮评测结果流出:Motif-3 以 3314 亿参数小幅领先 Qwen 3.7 Max,LG 的 EXAONE 表现不及预期掉队。我们关心的是:这一波成绩让中国开源模型事实上成了亚洲二线玩家追赶的基准线。

Aug 102 分钟
Kimi月之暗面

Kimi 推出 Plan Mode:让 AI 先交计划再动手 — 国产 Agent 补课最关键的一块

月之暗面在 Kimi Code 中加入 Plan Mode(计划模式):AI 接到复杂任务后不再急于动手,而是先生成可审阅的执行计划,等用户批准再逐步执行。这解决的是 Agent 落地中最常见的痛点——做了一半发现方向错了——值得所有用 AI 写代码、做自动化的人关注。

Aug 92 分钟
KimiMoonshot

Kimi K3 被砍掉 33% 体积只跑英语 — 本地大模型正在悄悄变得「用得起」

Moonshot 的 Kimi K3 经社区量化(用更少位数重新编码)后从 711GB 压缩到 478GB,代价是只保留英语。一个 2-bit(极低精度)变体甚至在编程基准上反超前代。这意味着本地跑千亿参数(千亿级模型权重)大模型的硬件门槛正在被民间力量踏平。

Aug 92 分钟
KimiK3

Kimi K3 承认暂时不如最强闭源模型,诚实正在变成大模型公司的稀缺能力

Kimi K3 在发布文开头直接承认自己仍落后于最强闭源模型,这比常见的“参数更大、成绩更强”更值得关心。我们判断,大模型竞争走到今天,市场开始奖励透明表达,而不只是声量和包装。

Jul 172 分钟
Kimi个人IP

客户催方案那一刻,换个新模型,可能比你硬扛一晚更稳

如果你经常一个人扛提案、文案、回复客户,新出的模型最直接的价值不是“更聪明”,而是帮咱们少来回改几轮。对非技术创业者来说,0 元先试、半小时见结果,适合拿真实工作先压一遍。

Jul 172 分钟
OpenAIAnthropic

Reddit一篇热帖提出质疑:大模型护城河也许不是秘方,而是规模

一篇 Reddit 热帖把行业里常被神化的问题挑明了:OpenAI 和 Anthropic 未必掌握了外界想象中的“独门秘诀”,更可能只是把算力、参数和训练规模先做到了极致。这个判断未必全对,但值得关心,因为它关系到后来者还有没有追赶机会。

Jul 172 分钟
KimiK3

Kimi K3 走进海外极客社区,中国模型公司开始重视口碑外溢

Reddit 上一则《Kimi K3 Blogpost》帖子本身信息不多,但它值得关心:这说明 Kimi 不再只争国内声量,也开始争夺海外开发者社区的注意力。对中国大模型公司而言,技术之外,全球口碑正在变成新门槛。

Jul 162 分钟
KimiMoonshot

Kimi K3 预告 7 月 27 日开放权重,国产大模型开始把能力变成开发者资产

据 Reddit 转引的 Moonshot 官方微信信息,Kimi K3 权重预计于 7 月 27 日开放。值得我们关心的,不只是又一个模型发布,而是中国大模型公司正把“可用能力”进一步变成开发者可直接调用、微调和部署的资产。

Jul 162 分钟
Kimi副业玩家

客户临时改需求的那个晚上,我靠新助手把方案重写了一遍

如果你常被临时改稿、补方案、回消息追着跑,这类新上线的 AI 助手能先帮你搭骨架、整理资料、出第一版,省下最乱的那一小时;它不是谁都要立刻用,但对一人业务很友好。

Jul 162 分钟
KimiKimi K3

Kimi K3 传出 2.8 万亿参数,中国模型的难题已从发布转向部署

Reddit 社区流出一条关键信息:Kimi K3 可能达到 2.8 万亿参数。若属实,这不是“更强了”这么简单,而是中国大模型公司正越来越像 OpenAI 一样,把竞争推向训练后能力与部署成本的拉锯战。

Jul 162 分钟
KimiK3

Kimi K3 跑分开始在海外社区发酵:热度有了,实力还得看真实场景

一则关于 Kimi K3 跑分的帖子出现在 r/LocalLLaMA,说明它已进入全球模型爱好者的比较名单。值得我们关心的不是“分高不高”,而是中国模型开始被放进同一张国际评测表,但跑分热度离商业可信度还有距离。

Jul 162 分钟
KimiMoonshot

Kimi 疑似预热 K3 发布,中国大模型竞争开始回到产品节奏

Moonshot 旗下 Kimi 放出一段充满“3”的预热视频,外界普遍解读为 Kimi K3 将很快发布;同时,疑似同模型已以代号出现在测评场。我们判断,这不只是一次新品预告,更说明中国大模型公司重新把竞争焦点拉回到版本迭代与产品交付。

Jul 162 分钟
CodexQwen

开发者把 85%-90% 的 AI 计算放本地,混合式 Agent 正从极客玩具走向降本方案

一位开发者展示了一个三层 Agent:前沿模型负责规划,本地模型完成大部分执行,约 85%-90% 的 token 留在本地。值得关心的不是这个项目本身,而是一个更现实的方向正在浮现:企业未必追求全程最强模型,而是追求“少用贵模型、把结果做稳”。

Jun 152 分钟
DeepSeekDeepSeek v4 Pro

1.6 万亿参数没换来头部成绩,DeepSeek v4 Pro 的看点已不只在模型本身

DeepSeek v4 Pro 以 1.6 万亿参数进入开源大模型第一梯队,但讨论焦点并不在“是否最强”,而在“为何这么大却只跑出中上成绩”。这件事值得关心,因为大模型竞争正从参数和榜单,转向推理成本、硬件适配与商业可用性。

Jun 132 分钟
XiaomiMiMo-V2.5-Pro

小米大模型 MiMo 在复杂推理测试中登顶 — 性价比开始取代参数量成为新焦点

小米 MiMo-V2.5-Pro 在复杂社交推理测试中以不到 1 美元成本取胜,这标志着大模型竞争焦点正从单纯算力比拼转向推理性价比与实用性,企业落地有了更实惠的选择。

May 22 分钟
Kimi月之暗面

Kimi K2.6 即将发布,但一条 Reddit 帖子不足以让我们判断它值多 少钱

月之暗面旗下 Kimi 模 型的下一个版本 K2.6 似乎即将到来,消 息来自一条只有 151 个点赞的 Reddit 帖子。 信息量极为有限,我们目前无 法判断它是真正的技术升级还是例行迭代。在 大模型版本号满天飞的今天,这 条消息本身更值得被当作一个观 察样本。

Apr 182 分钟