DeepSeek 本地部署教程刷屏 — 真正的门槛不是技术,是耐心
本周一篇 DeepSeek 本地部署教程被广泛转发:1.5b 参数版本只需 1.1GB 存储空间、连没有独立显卡的笔记本都能跑——这件事的意义比看上去更大,因为它意味着本地大模型从极客玩具开始走向普通用户。
相关推荐
基于 #DeepSeek 推荐
DeepSeekGLM
GLM 两张显卡跑赢 DeepSeek — 国产开源不再「将就」
Reddit 用户用两台 NVIDIA DGX Spark(约六万元一台)对比智谱 GLM-5.3 Flash 与 DeepSeek V4 Flash:写代码测试 GLM 97%,DeepSeek 94.5%,但 GLM 慢三成、上下文也短。开源小模型开始有真正的取舍。
8月30日·www.reddit.com
TransformerGPT
200 行代码拆穿 Transformer — 大模型护城河在哪
一篇 PyTorch 教程把 GPT、Claude、DeepSeek 同源的 Transformer 架构拆成 200 行——算法早公开,AI 公司真正的护城河另有所在。
9月26日·juejin.cn
Oh My PiLocalLLaMA
本地跑大模型又省了一道手续 — 但企业能用的版本还差几道关
Oh My Pi 等开源工具把 vLLM、llama.cpp、SGLang 等本地推理引擎封装在一起,切换模型不再需要分别装环境、配参数。对个人玩家是好消息,但对企业生产环境还差几道关键能力。
9月26日·www.reddit.com
LocalLLaMACline
12GB 显卡跑不动主流 AI 编程助手 — 本地部署的真实门槛被低估了
r/LocalLLaMA 一位开发者用 12GB 显存的 RTX 显卡测试 Cline、VS Code 等 AI 编程插件,每次启动就吃光显存。本地部署听起来美好,但 Agent 类工具(让 AI 自动写代码的应用)对硬件的胃口远超普通聊天。
9月26日·www.reddit.com
通义千问Qwen
阿里 Qwen 跑在一张专业显卡上 — 中国大模型本地化跨过第一道坎
本周 Reddit 工程师分享:通义千问最新模型通过 4-bit 量化压缩,跑在了单张 72GB 专业显卡上。过去这类中国顶级模型通常需要几张 H100 加一个机房。
9月26日·www.reddit.com
Mica小模型
30 美元训练的小模型把对手甩开 4 倍 — 大模型「越大越强」开始出现裂缝
独立开发者用 30 美元租显卡训练出 4B 参数的 Mica——它不写文字,只输出每个动作的概率用于决策。三个种子的方块测试中,Mica 平均清行数约为对照模型的 4 倍。重点不在游戏成绩,而在「专精小模型」挑战「通用大模型」的可能性。
9月26日·www.reddit.com