返回首页
开源视觉模型
找到 3 篇关于此标签的文章
LocalLLaMA开源视觉模型
本地 AI 视觉模型能读电表了:社区土办法测试比厂商刷榜更说明问题
本地部署的开源视觉模型开始能识别电表读数这类真实场景。一位开发者把电表照片发到 AI 社区,让网友用自己电脑上的模型测试。社区这种「随手测试」正在变成检验 AI 落地能力的另一种方式。
Aug 152 分钟
CohereNorth-Micro-Vision-Instruct
Cohere 推出 24 亿参数开源视觉模型 — 小而精路线开始认真抢市场
Cohere Labs 开源了一个 24 亿参数的视觉语言模型,支持原生分辨率图像处理和多语言(含中文),按 Apache 2.0 协议发布,商用免费。在大厂拼参数规模的当口,有玩家开始认真押注“小而精 + 专门任务”路线,这个信号值得关心。
Aug 122 分钟
VLX-Seekomlab
韩国团队把视觉定位改成"选区域"而非"画框" — 机器人本地视觉模型又轻了一档
一家韩国开源团队发布 10B 参数视觉模型 VLX-Seek 1.5,核心思路是把物体定位从"输出坐标数字"改为"选择候选区域"。对机器人、无人机等边缘端(本地、离线)视觉场景,这等于换了一条更稳的技术路线。值得关心的是,开源小模型正在把以前只能跑在云上的视觉能力,压进本地设备。
Aug 102 分钟