返回首页
视觉语言模型
找到 2 篇关于此标签的文章
LocalLLaMA视觉语言模型
本地视觉语言模型进入实用期 — 128GB 显存门槛把多数企业挡在门外
Reddit LocalLLaMA 社区本周盘点 2026 年 8 月可用的本地视觉语言模型(VLM,能看图说话的 AI)。按显存从 8GB 到 128GB 分五档讨论,结论务实:评测不可靠,没有模型能通吃。这是观察 AI 本地化趋势的一个切口。
5d ago2 分钟
Gemma-4Qwen3.5
Gemma-4 E4B 视觉基准测试:得分 0.27 远低于 Qwen3.5-4B 的 0.5
社区测试显示,Gemma-4 E4B 在 100 项视觉任务中仅得 0.27 分,远低于 Qwen3.5-4B 的 0.5 基准分,引发对多模态应用的担忧。
Apr 72 分钟