返回首页
向量检索
找到 6 篇关于此标签的文章
知衣科技阿里云
知衣科技把服装检索搬上阿里云:算力砍七成,向量搜索正式成为云上标配
知衣科技把跨境服装选品检索迁到阿里云 MaxCompute,CPU 消耗降 73%、内存降 93%。值得关注的是,向量检索正在变成云上标配,AI 落地的成本曲线又下一档。
4d ago2 分钟
字节跳动火山引擎
向量检索又准又快还省 90% — 字节系开源了,但这是一篇产品广告
向量检索是 AI 回答'基于文档'问题的核心环节。字节系火山引擎打包开源 DiskANN+RaBitQ 组合,号称比 HNSW 快 5.5 倍、内存省 90%。技术上值得关注,但原文本质是七夕营销稿,落地在云搜索和 Milvus 产品里。我们拆开看。
Aug 202 分钟
RAGEmbedding
企业 AI 知识库的隐藏成本:文档每次更新,都在重新烧一遍算力
我们注意到一个常被忽视的问题:企业花大钱建的 AI 知识库,文档每次更新,背后的索引都得重新处理。百万级文档全量重建要几小时,增量更新又容易新旧版本冲突。这才是 RAG 真正落地的坑。
Aug 192 分钟
Simon WillisonDoug Turnbull
1856 个标签塞不进提示词?工程师的解法:让 AI 先'瞎编'再向量匹配
当你的标签库大到塞不进提示词,传统的'让 AI 从词表里挑'就行不通了。Doug Turnbull 的思路是让模型自由生成标签,再用向量嵌入匹配回现有词表。这反映了一种更普遍的分工:让 LLM 做它擅长的,让向量检索做约束。
Aug 152 分钟
ElasticsearchElastic
Elasticsearch 9.4 把搜索改造成 Agent 基础设施 — 数据底座话语权正在转移
Elasticsearch 9.4 把搜索从「给人看的工具」升级为 Agent 的记忆体与行动驱动层:向量检索 DiskBBQ 吞吐达 Qdrant 7 倍,Agent Builder 与 MCP 协议把搜索结果直接接入推理链路。这是中间层厂商对 Agent 时代的一次明确押注。
Aug 142 分钟
RAG向量检索
企业 AI 知识库总答非所问,90% 的败因在检索层而非大模型
企业 AI 知识库总翻车,多数人以为是模型不行,但我们注意到真正的瓶颈在检索层。向量相似度不等于业务相关性,优化检索策略才是让 AI 落地的解药。
May 42 分钟