Gemini 3.5 Flash Lite
google · google/gemini-3.5-flash-lite
Fast Gemini model balancing multimodal reasoning, tool use, and cost
约 70 万汉字上下文 · 能看图 · 会分步推理 · 能调用工具 / 接 Agent · 能输出结构化 JSON
读完一本 20 万字的书,写一份 2000 字摘要,大约 $0.10
按一个汉字 1.5 个 token、厂商官方价折算的量级估算,不是报价。完整口径见 「AI 模型榜单」页尾的名词解释。
规格
| 上下文 | 1,048,576≈ 约 70 万汉字 |
|---|---|
| 最大输出 | 65,536 |
| 结构化输出 | 支持 |
| 开源权重 | 否 |
| 发布日期 | 2026-07-21 |
来源:models.dev 快照 2026-08-29
谁在提供、各家什么价
| Provider | 输入 /M | 输出 /M | 缓存读 /M |
|---|---|---|---|
| Google一方 | $0.3 | $2.5 | $0.03 |
| Abacus | $0.3 | $2.5 | $0.03 |
| Cortecs | $0.33 | $2.749 | $0.033 |
| Vertex | $0.3 | $2.5 | $0.03 |
| DevPass (LLM Gateway) | $0.3 | $2.5 | $0.03 |
| OpenCode Zen | $0.3 | $2.5 | $0.03 |
| Pioneer | $0.3 | $2.5 | $0.03 |
| Requesty | $0.3 | $2.5 | $0.03 |
带「一方」标签的是模型厂商自己的价格;没有标签的行来自转售渠道,价格可能与一方不同。
什么时候选它
- $0.3/$2.5 每百万 token 带 104 万上下文与图片输入 —— 要「便宜且能看图」时的少数选项
坑
- 输出单价($2.5)是输入的 8 倍多。任务如果是「短输入、长输出」(写长文、生成代码),实际账单会比按输入价估的高不少
依据:官方定价页 · 复核于 2026-08-09
榜单位置
暂无榜单收录。这不代表模型表现不好 —— 只代表我们还没为它做这一层快照,没测过就不写分数。