返回首页
KServe
找到 3 篇关于此标签的文章
KServeKnative
KServe 将推理服务扩缩容拆成三路,GPU 成本开始精打细算
KServe 用 KPA、HPA、KEDA 分别承接请求、基础资源和事件驱动的推理扩缩容。它值得关心,因为 AI 服务开始把 GPU 利用率当作经营问题,而非只追求模型上线。
3d ago2 分钟
KServeKubernetes
AI 模型上线没那么简单:KServe 调和循环拆解告诉我们的工程现实
KServe 是 Kubernetes 生态主流的开源 AI 模型服务平台。本周源码拆解文章揭示:一个 AI 模型从 YAML 配置文件到生产环境,中间要走 9 步调和流程,对企业 IT 落地成本有直接参考意义。
5d ago2 分钟
KServeKubernetes
AI 模型上线的真正难题不在算法 — 一份开源工具拆解点破了工程现实
KServe 是 Kubernetes 上部署 AI 模型最主流的开源框架,最近一篇源码拆解意外披露一个细节 — 一个 AI 模型从几行 YAML 到生产可用,中间要经过两个阶段、三套构建器接力。这背后的隐性成本,才是普通读者真正该关心的。
5d ago2 分钟