·tian
RAG 流水线中被你忽略的查询重写层
大多数检索失败源于查询形态的问题,而非嵌入模型本身。本文将深入探讨 HyDE、查询分解、多查询并行分发以及排名融合等技术,并教你如何在盲目更换编码器之前,诊断出你的 RAG 流水线真正需要的优化方案。
insider
rag
retrieval
llm
+2·tian
生产环境中的实时网络接地:调用搜索 API 只是开始
为什么'直接调用搜索 API'产出的流水线远比工程师预期的差——延迟数学、故障模式,以及将演示级与生产级网络接地区分开来的架构模式。
rag
llm
production
search
+1·tian
发现难题:为什么语义搜索会让浏览型用户失望
基于嵌入的检索针对的是那些明确知道自己想要什么的用户。对于其他用户,它往往默默地失效了 —— 本文将介绍如何识别浏览意图并优化你的排名策略。
search
retrieval
rag
recommendations
·tian
语义搜索作为产品:当检索理解意图时,什么发生了改变
构建面向用户的语义搜索与构建 RAG 管道是两个截然不同的问题。一半的失败发生在任何向量被触及之前——这里是什么会出问题以及如何修复。
insider
search
semantic-search
retrieval
+1·tian
生产环境中的混合检索:为什么 BM25 在关键查询上仍然更胜一筹
纯稠密检索在精确标识符、代码和罕见词条上会悄无声息地失败。本文介绍生产级 RAG 系统实际采用的分数融合架构、重排序策略以及诊断方法。
retrieval
rag
search
embeddings
+1