一次导致所有运行中 Agent 任务失效的 Prompt 热重载故障
在晚上 11:46 进行了一次正常的 Prompt 推送,一分钟后却出现了由于幻觉导致的退款 —— 深度解析为什么在 Agent 运行期间,Prompt 注册表需要将会话视为契约而非缓存。
绕过清理器的提示词注入:当智能体通过工具读取恶意指令
输入清理器位于用户和模型之间,但使用工具的智能体还有数十种其他的摄入路径。本文将探讨为什么检索到的文档、网页抓取、MCP 响应以及其他智能体的输出会绕过你的分类器,以及真正的工具感知型防御方案长什么样。
人类编写但 AI 客服 Agent 无法解析的运维手册
当 AI 客服 Agent 像人类一样阅读人类编写的操作指南时,它们会失败——因为它们会试图补全那些隐含的步骤,导致产生幻觉并触发错误的工具调用。本文将教你如何编写能够让 Agent 机械化执行的运维手册。
逐渐腐化的工具描述:当你的 Agent 仍在盲目调用时
工具描述是团队忘记进行版本管理的接口契约。本文将探讨它们是如何腐化的、为什么这种腐化是隐蔽的,以及保持你 Agent 诚实所需的纪律。
由客户端时钟而非网关标记时间戳的链路追踪时间线
在你的 Agent 链路中,浏览器标记的 Span 与网关标记的 Span 是不可比的。本文探讨为什么客户端时钟会“撒谎”、SDK 是如何传播这一偏差的,以及缩小差距的几种模式。
那些悄悄共享长期记忆的智能体 A/B 测试变体
在 A/B 测试变体之间共享长期记忆存储会导致实验本身产生耦合——变体 B 读取了变体 A 写入的记忆,导致测量的增量发生漂移,最终上线后的表现会退化到同一受污染环境下的另一个点上。
隐蔽式安全与正在阅读你 Wiki 的智能体
一个内部端点因为没人能找到它而保持了十年的安全。直到一个智能体索引了 Wiki。当“隐蔽”不再是一项时间成本时,情况会发生怎样的变化。
变成关键路径的审批队列
当你在 Agent 和不可逆的操作之间加入人工环节时,你增加的并不是一个安全原语。你增加的是一个具有吞吐量限制、可用性配置以及质量与负载曲线的队列。本文将探讨它是如何演变成一个无人预定义的 P0 级问题的。
你的智能体记住的浏览器选择器
记忆 CSS 路径的计算机使用 (computer-use) 智能体正在步入静默失败的陷阱。本文探讨了选择器失效、语义锚点、基于视觉的后备方案,以及为什么存储的选择器是对智能体无法控制的渲染决策的一次豪赌。
对话树:你的服务器作为日志存储的对话结构
聊天界面允许用户编辑和重新生成消息,而后端则静默地将每一次修改追加到线性日志中 —— 结果就是模型在回答那个用户以为已经撤回了的对话。
你用智能体替换的内部搜索框刚刚成为了你的 SLO
停用一个确定性功能而转用智能体,会悄无声息地将前任的 SLO 移交给一个无法满足它的系统 —— 而这种差距会在你的推理提供商进行限流的那个早晨显现出来。
Agent 循环从搜索框偷走的延迟预算
将 200 毫秒的搜索调用换成 4 秒的 Agent 循环,延迟预算并没有消失 —— 它从基础设施迁移到了 UX。如果团队没有捕捉到这种交接,就会在交付一个指标更好但实际体验更差的产品。