这是什么
Cloudflare 旗下的 1.1.1.1 是全球最大的公共 DNS 解析服务之一,每时每刻缓存着超过 2500 亿条 DNS 记录——DNS 负责把"baidu.com"翻译成机器能识别的 IP 地址。本周他们发布工程博客:通过 5 次代码改动,把每条缓存的内存占用砍掉一半以上,整个集群腾出大约 100TB 内存,相当于 130 台最新一代服务器的全部 RAM。
关键细节是:他们没买一台新服务器。改动的是用 Rust(一门主打性能和内存安全的编程语言)写的缓存模块,把动态数组换成更紧凑的结构、合并零散对象、去掉冗余字段。代价是零成本,性能还提升了:写入快 43%,查询延迟降 19%。
行业怎么看
这件事乍看"硬核但无聊",编辑部注意到三个值得品味的判断:
第一,这是「软件吃掉基础设施资本支出」的又一个案例。过去十年,公司解决性能问题本能反应是"加机器",Cloudflare 的实践说明:在内存成为瓶颈的场景里,工程优化完全可以取代硬件采购。
第二,Rust 在基础设施层的渗透已经不可逆。这次优化本质上是 Rust 内存模型的红利——没有零成本抽象(语言本身不会让程序变慢)和对内存布局的精细控制,写不出这种代码。Hacker News 上多位工程师直言:"不用 Rust,根本看不到这些字节在哪被浪费。"
反对意见也值得听:一位前 Meta 基础设施工程师评论,"这种优化只有规模到一定程度才划算。小公司照搬可能亏到哭——工程师时间比 RAM 贵。"我们同意这个边界:盲目抄作业不现实。
还有一层更广的含义:AI 行业最大的瓶颈不是 GPU 算力,而是显存(HBM,堆叠在 GPU 上的高速内存)。谁能用同样的卡数跑更大的模型,谁就赢——Cloudflare 这套思路,迟早会被 AI 基础设施公司复刻。
对普通人的影响
对企业 IT:遇到数据库、缓存、消息队列容量告警,先问能不能改代码少占内存,再考虑要不要买新服务器。用 Java、Go 跑高并发服务的团队,垃圾回收机制(自动管理内存的机制)和对象布局里能挤出的水分,往往比想象多。
对个人职场:Rust 不再是系统程序员的小众技能,而是云原生基础设施的事实标准。懂一点 Rust 和内存模型,会越来越像当年的"懂一点 SQL"——不用亲自写,但要能判断方案。
对消费市场:不少路由器默认指向 1.1.1.1,查询快 19%,网页打开理论上能快几十毫秒。但这是后台基础设施的变化,普通用户基本不会直接感受到。