·tian
你的检索管道从未衡量的中间上下文盲区
当 Retrieval@10 指标依然处于绿色安全状态时,回答质量却在下滑。这种差距源于一种 U 型注意力偏差,它存在于检索团队和提示词团队之间的交界处,而双方的监控面板都无法察觉模型从未读取过的那段内容。
insider
rag
retrieval
long-context
+2·tian
2026 年的长上下文 vs RAG:为什么它是基于功能的决策,而非架构信仰
在 2026 年,长上下文与 RAG 的选择不再是整个产品的架构抉择,而是由四个维度(新鲜度、归因、尾部风险、成本)驱动的基于功能的决策。本文深入剖析了这一原则,帮助你的 AI 功能在不断变化的数学模型中始终处于正确的一侧。
insider
llm
rag
ai-architecture
+2