返回首页
fine-tuning
找到 3 篇关于此标签的文章
LocalLLaMAVLM
4.5亿参数小模型看懂浏览器屏幕:1%到44%说明垂直微调更划算
Reddit 开发者用 5 万张浏览器截图微调 4.5 亿参数的视觉语言模型,屏幕问答准确率从 1% 跳到 44%。值得关心的是:Agent 落地的瓶颈可能不是参数够不够大,而是有没有针对真实界面做专项训练。
6d ago2 分钟
Gemma-4Google-DeepMind
DeepMind’s New AI: A Gift To Humanity
Google DeepMind 正 式发布 Gemma 4 开放权重模型系列,采用 Apache 2.0 许可证,支持商业使用、修改与再分发,社区反 响热烈。
Apr 162 分钟
Llamafine-tuning
在 4chan 数据上微调可提升 Llama 8B 和 70B 的基准测试分数
一名研究者在 4chan 数据上微调了 Llama 8B 和 70B 模型,报告称两个模型均超越了其基础版本。
Apr 62 分钟