博客
来自AI智能体经济的洞见、分析与更新。 按标签浏览.
你的智能体忘记发送的幂等键
智能体重试带有副作用的工具调用时,其方式与重试读取操作完全相同 —— 这会导致静默地重复扣款和重复发送邮件。本文将探讨幂等性究竟应该放在哪里,以及为什么提示词(Prompt)不是实现它的正确位置。
你的 Agent 链路中无人分配的延迟预算
Agent 的 SLO 通常设置在边界处,而内部却缺乏预算分配,导致没人能归因是哪一跳搞砸了 P99。你需要分配逐跳预算,在 Span 级别进行追踪,并约束那个呈乘性而非加性增长的尾部延迟。
P99 是产品决策,而非基建决策
你的尾部延迟目标并不是基建团队单纯优化出的一个数字 —— 这个数字本身就是一个产品选择。本文探讨了 UX 交互设计与延迟预算如何相互权衡,以及为什么 P99 应该出现在设计评审中。
语义差异:当行级对比毫无意义时,如何评审 Prompt 变更
仅仅三个词的 Prompt 修改就可能让你的幻觉率翻三倍,而行级对比(Line Diff)看起来却毫无破绽。为什么 Prompt 变更需要语义差异(Semantic Diff)—— 比较行为而非文本 —— 以及如何在 PR 中对此进行门控拦截。
你从未进行过压测的每分钟 Token 上限
供应商的速率限制是你无法控制的每分钟 Token 预算 —— 而产品发布则是发现这一上限的最糟糕时机。本文将介绍如何在 429 错误发生前进行预测、压测并预留缓冲空间。
没人使用的长尾:工具带是如何变得尾大不掉的
你给智能体增加的每一个工具,都在削弱它选择正确工具的能力。那几十个无人问津的工具正在悄悄降低那三个核心工具的被选概率 —— 本文将探讨如何保持工具目录的精简与高效。
你无法删除的用户:AI 系统中的被遗忘权
一项“被遗忘权”请求揭示了 AI 系统中一个令人不安的事实:用户数据散布在模型权重、向量索引和缓存中,且没有单一的数据行可以删除。本文探讨如何为“可遗忘性”进行设计。
聊天并非最佳界面:为什么你的智能体不应只是一个文本框
大多数打开聊天窗口的人从不发送消息。聊天是一种不错的输入原语,但作为运行环境却很糟糕 —— 本文将探讨何时该采用结构化 UI、生成式 UI 和环境智能体。
与先验对抗:当模型掌握了错误版本的技术栈时
你的编程模型并不是对你的框架一无所知 —— 它掌握的是一个自信但错误的版本。本文将探讨为什么模型的先验知识会战胜你提供的上下文,以及哪些对策能真正奏效。
间接提示注入:你以为处于惰性的数据平面
你的智能体将检索到的每个文档都视为惰性数据,但检索到的文本实际上是以系统提示词的权限运行的。本文将探讨间接提示注入的工作原理、为什么 EchoLeak 证明了它的存在,以及真正有效的防御手段。
没人会为你的智能体承保
你的智能体准确率足以在无人看管的情况下运行,但部署过程却卡在了一个问题上:当它出错时,谁来承担损失。本文探讨了为什么自主性现在成了一个保险问题,以及如何让智能体变得可承保。
试点炼狱:廉价的 90% 正是你的 AI POC 无法转正的原因
一个可运行的 AI 演示只是那看起来像 100% 但其实很廉价的 90%。那些能确保其在生产环境中安全运行的评估、护栏、可观测性、成本上限和权属划分,才是没人预估过的昂贵的 10% —— 这里有一份清单,帮你提前预估这些成本。