Jev 把自己包装成 AI 新范式,老玩家却说:这不就是分类器吗
93.3% 对 83.2%,这两个数字是本周 Reddit 技术社区把一家 AI 新公司放在尴尬位置的依据。一个叫 BGE-small 的小模型配经典统计方法,在金融意图公开数据集 Banking77 上达到 93.3%,而号称'系统一模型'的 Jev 是 83.2%,本地时延约 9 毫秒。我们注意到了:不是每个 AI 新物种都真的新,营销正在利用大众对'LLM 之前的 AI'的认知盲区。
相关推荐
基于 #Jev 推荐
LocalLLaMAPython
25 行 Python 就能搭 LLM 工具 — 个人开发者的 AI 红利窗口正在打开
LocalLLaMA 社区最近冒出 25 行 Python 写成的 AI 工具 Jev。背后是 LLM 框架成熟、调用门槛暴跌的事实 — 对企业 IT 采购和个人职场都有直接含义。
9月23日·www.reddit.com
Redditopen-webui
Reddit 用户把 AI Agent 装进家庭书房 — 本地大模型的早期实验
本周 Reddit 本地 AI 圈一篇高赞帖分享了家用 Agent 配置:open-webui + 隔离虚拟机 + Qwen 大模型。我们关心的是,它折射出本地大模型正在走出机房,但评论区对硬件门槛和安全性的冷静声音同样值得一听。
9月23日·www.reddit.com
NInfervLLM
百万上下文跑在两张 5090 上 — 企业自建 AI 的硬件神话被业余玩家打破
一位 Reddit 开发者改造开源推理引擎 NInfer,让 27B 参数 Qwen 模型在两块消费级 5090 上跑出百万 token 上下文,速度比 vLLM 快近 3 倍。值得关心的是:企业自建大模型的硬件门槛正被业余项目瓦解。
8月30日·www.reddit.com
Ling金融大模型
金融大模型跑分争议:每家都穿自己的装备上场,这榜还公平吗
本周 Reddit 技术圈拆解了一张国内金融大模型 Ling 的官方跑分卡:不同模型在不同测试里用了完全不同的推理设置、Agent 框架甚至工具,所谓的榜单排名更像一场「测试方案」的比拼。这事对所有用 benchmark 选模型的企业和投资人都值得警惕。
8月29日·www.reddit.com
Political CompassLocalLLaMA
大模型也要测政治立场了:Reddit 用户拿 Political Compass 跑了十几个模型
Reddit 用户 Thrumpwart 把十几款主流大模型丢进 Political Compass 测试,结果多数偏向经济左翼 + 社会自由象限。这事表面是社区玩票,背后是训练数据偏见与企业部署选型的真实风险。
8月29日·www.reddit.com
RedditLocalLLaMA
本地跑大模型有张没人算的账单 — 你的 GPU 在给房间供暖
Reddit 用户实测:双 5060Ti 跑 Qwen 27B 做编码任务,每张卡满载 170W,相当于一台小型取暖器持续工作。本地 AI 看似'免费',电费和散热成本却没人提前算清。
8月28日·www.reddit.com