站会在撒谎:当智能体集群整夜运行,如何协调工作
每日站会和燃尽图默认人类一次只处理一个任务。而整夜运行的智能体集群打破了这种工作单元,这些协调工具也悄然变得不再能反映现实。
审批疲劳:人机协同关口如何退化为橡皮图章
在大量任务面前,人机协同审批关口会悄然退化为反射性的橡皮图章。本文探讨了为什么自动化偏见会将监管变成一场“表演”、由此产生的安全漏洞,以及如何设计能够保持实效的关口。
你的内部平台的新首要客户是 AI Agent
AI Agent 正在成为内部 API 的主要消费者,且它们出错的方式与人类完全不同。如何为那些无法阅读文档或提交工单的客户设计工具。
为 Agent 进行容量规划:为什么并发数而非 QPS 才是你的真实衡量单位
QPS 会掩盖 Agent 的真实负载,因为运行过程会持续数分钟并产生扇出效应。使用利特尔法则(Little's Law)来按并发数进行估算——这才是真正占用你资源的指标。
MCP 工具列表在会话中途增加,你的智能体调用了一个它从未被告知过的工具
在同一会话的两次调用之间,MCP 服务端可以增加其工具列表,而智能体的下一次选择可能会落在一个客户端从未被告知过的工具上 —— 这是一种能够转化为真实操作的幻觉。
用户关闭对话后才完成的异步工具调用
长时间运行的工具调用往往比触发它们的聊天会话存续时间更长。当你关闭标签页时,结果仍然会返回 —— 但面对的却是一个已不存在的对话、错误的会话,或者根本无处投递。
一个工具请求的 OAuth 作用域,为何被其他所有工具悄悄继承了?
探讨基于提供商的 OAuth 令牌存储如何静默地将所有工具的作用域并集授予每个工具,以及如何通过改进存储键结构来重新划定设计预期的权限边界。
安全智能体如何跨过那行它“看不见”的注释,升级了被固定的依赖
两个 AI 编程智能体因为互不知道对方的存在,向欧洲客户发布了一个差一错误(off-by-one)的日期 Bug。这是一份关于将代码库中的多智能体协作视为分布式系统问题的实战指南。
云厂商负载均衡器悄然忽略的会话亲和性
聚合缓存命中率掩盖了在高负载下亲和性提示被丢弃的对话。本文探讨了为什么单 Pod KV 状态和尽力而为的路由会导致长 Agent 会话的首字延迟激增,以及你应该如何进行监测。
导致你的智能体重试机制失效两周的工具 Schema 迁移
为期六周的弃用窗口对每一位人类消费者都运作完美,却让智能体静默失效了整整十四天。本文探讨了重试预算、解析错误和优雅降级为何会交织成一场无人报警的故障,以及捕获这些问题的关键指标。
那个批准了“单次调用成本”却从未衡量“单次解决任务成本”的智能体预算
一个使单次调用成本下降了 25% 但单次解决任务成本却上升了 40% 的智能体,是智能体部署中最常见的单位经济失效案例。本文将探讨为什么供应商的 SKU 并不是工作单元,以及如何建立正确的衡量指标。
当“转接人工”变成排队:AI 客服栈中隐藏的激励机制 Bug
拦截率仪表盘在撒谎。你上线的奖励函数悄悄地让“转接人工”变成了 AI 代理成本最低的操作——而你的支持团队则沦为了它的溢出队列。