返回首页
Intel Arc
找到 3 篇关于此标签的文章
LocalLLaMARTX 3060
消费级显卡跑大模型个人部署 AI 离企业可用还差多远
一位开发者用 6 张 RTX 3060 和 Intel Arc B60 显卡,在自家跑起了大语言模型,把经验写成 4 篇实战。我们看到,这是个人玩家领域的进展,但商业部署的稳定性与成本结构,仍是另一回事。
8月26日2 分钟
Ling-3.0llama.cpp
中国 Ling-3.0 进入 llama.cpp 官方支持 — 12GB 显存跑满 128K 上下文
本周中国开源模型 Ling-3.0 正式进入 llama.cpp 主分支,开发者用 12GB 消费级显卡就能跑满 128K 上下文。本地推理门槛进一步降低,金融、医疗等数据敏感行业的私有化部署迎来新选项。
8月18日2 分钟
llama.cppIntel Arc
llama.cpp Q8_0 通过 SYCL 修复在 Intel Arc GPU 上实现 3.1 倍加速
一段 200 行的 SYCL 补丁修复了 Q8_0 缺失的重排序优化,使 Intel Arc B70 的吞吐量从 4.88 t/s 提升至 15.24 t/s。
4月6日2 分钟