
Tian Pan
Software Engineer
你用智能体替换的内部搜索框刚刚成为了你的 SLO
停用一个确定性功能而转用智能体,会悄无声息地将前任的 SLO 移交给一个无法满足它的系统 —— 而这种差距会在你的推理提供商进行限流的那个早晨显现出来。
Agent 循环从搜索框偷走的延迟预算
将 200 毫秒的搜索调用换成 4 秒的 Agent 循环,延迟预算并没有消失 —— 它从基础设施迁移到了 UX。如果团队没有捕捉到这种交接,就会在交付一个指标更好但实际体验更差的产品。
你的编程 Agent 记错的库版本
编程 Agent 会自信地生成针对错误依赖库版本的代码。模型并不是在胡言乱语 —— 它只是在记忆一个已不复存在的库版本。
悬在两张日历上的多智能体死锁
包含人工审批队列的多智能体工作流重现了每一个经典的死锁条件。这种循环隐藏在两个队列和两张日历之中,直到被客户发现。
那个假设人类会阅读页面的 On-Call 运维手册
当智能体在故障频道发布了一份客气的摘要,而指挥官将其理解为已接手时,升级链条中悄然出现了一个无人定义的转换点。本文将探讨弥补这一差距的模式。
没有模型推理项的故障复盘模板
大多数事件模板都没有留出记录 AI Agent 推理内容的栏位——导致行动项在试图为概率性失效寻找确定性的解决方案,从而使得同一类故障不断重复发生。
你的 Agent 在无文档情况下悄然掌握的流程
当一个 Agent 的提示词成为业务流程的唯一权威描述时,你实际上在云端发布了一份无人能审计、无法版本控制也无法移交的运维手册。
被你的个性化层悄悄杀掉的 Prompt 缓存
在系统 Prompt 顶部放置单用户上下文是让你的推理账单翻三倍的隐形陷阱。本文将揭示为什么这种“成本悬崖”在账单结算前难以察觉,以及如何在代码、代码评审和 CI 中守护缓存边界。
那个让你的故障面成倍增加的供应商故障转移方案
增加备用 LLM 供应商并不能让你的系统实现冗余。它会让维护成本翻倍 —— 如果你跳过了后续的提示词工程工作,系统还会变得更加脆弱。
你为人类设置的速率限制,AI 智能体三秒钟就会让其饱和
为人类节奏流量校准的速率限制,在智能体首次将规划循环指向端点时就会崩溃。应将限制视为一种拆分契约 —— 吞吐量预算加上滥用上限 —— 并基于租户和工作负载类别进行挂钩。
智能体安排的无人继承的周期性任务
当一个智能体启动了一项周期性任务然后离去,该计划的寿命将超过其所有者 —— 孤儿率会在悄无声息中累积,直到有人进行审计。
自相矛盾的流式响应
流式 LLM 会显现用户视作最终答案的部分推理过程。本文探讨为何单次响应内的自相矛盾会破坏 UX 和评估,并介绍了四种重新引入提交边界的模式。