返回首页
Gemini Flash
找到 2 篇关于此标签的文章
QwenUkisAI
开源27B模型6分钟搞定Gemini烧额度的活 — AI预算该重算了
一位Reddit玩家用一块开源27B模型在自家RTX 3090上6分钟解决了一个Google Gemini Flash烧光当周配额、折腾40分钟都没解开的脚本问题。这是单次测试,但印证了开源微调正在逼近甚至部分超越闭源云端API的能力,企业的AI预算结构正在被重新洗牌。
9月28日2 分钟
Gemini FlashRTX A6000
15 分钟微调,把响应从 0.9 秒压到 0.06 秒 — 小模型开始替代大模型
一位开发者用 2500 条样本和 15 分钟微调出 50MB 小模型替代 Gemini Flash:响应从 0.9 秒降到 0.06 秒,准确率只掉 2 个百分点。「蒸馏」(用大模型造数据训小模型)正从研究走向工程。
9月25日2 分钟