断连代理模式:为不稳定的网络环境进行设计
大多数 AI 代理技术栈都假设网络始终在线。但在飞机上、地下室或不稳定的 Wi-Fi 环境中,这一假设就会失效。本文将探讨离线优先架构的实际运作机制。
个性化设置应当属于 Dotfile,而非向量数据库
大多数 Agent 的个性化其实是语气、格式、默认工具和项目上下文 —— 这些声明式设置在数十年前就通过 Dotfile 模式解决了。只有在穷尽配置手段后,才应考虑微调和持久化记忆。
人格叠加(Persona Overlays):当一个智能体需要为不同客户群提供多种声音时
为跨群组的客户群发布单一的智能体人格正在悄无声息地消耗你的续订率。解决方案是叠加(overlays)而非分支(forks)——以及能够捕捉到被聚合评分所掩盖的性能倒退的切片级评估。
发布前的爆炸半径清单:你的智能体团队遗漏编写的文档
大多数智能体团队在第一次事故发生时才发现缺失了爆炸半径清单。本文将介绍这一交付物、它所需的列,以及如何将其设为 CI 合并门槛以确保其准确性。
Abandon 原语:为什么你的智能体循环需要一个一等公民的方式来终止计划
大多数智能体框架都提供了 continue、return 和 retry,但却没有一种一等公民的方式来抛弃一个注定失败的计划。这种缺失的原语能将浪费的预算转化为转机。
你的 LLM 账单只占 Agent COGS 的一半 —— 另一半是无人监控的部分
推理仅占 Agent 真实成本的 40-60%。另一半则隐藏在向量数据库、检索嵌入、遥测、重试、评估和人工审核中 —— 而这些成本往往没有明确的归口团队。
作为 Cron 任务的智能体:当定时触发优于对话循环时
大多数生产环境中的智能体其实是伪装成聊天界面的后台任务。本文将探讨为什么定时触发、状态检查点和有界信封在成本、可靠性以及可操作性方面优于对话循环。
智能体凭据爆炸半径:你的 IAM 模型从未列举的主体类别
智能体继承了平台所能发放的最广泛 OAuth 范围,然后因一段提示词产生漂移——让安全团队花费 10 年才消灭的高权限服务账号死灰复燃。这是一份关于逐工具范围划分、即时凭据、动作级审计以及负责连接这些环节的 IAM 所有者的实战指南。
智能体权限提示存在习惯化曲线,而你的安全叙事就建立在其斜率之上
权限提示是一种具有可衡量半衰期的安全控制手段。你应该跟踪每个用户的审批率,根据爆炸半径对摩擦力进行分层,并停止让 100% 的点击率作为你安全叙事的唯一支撑。
人类注意力预算是你的 HITL 系统在默默透支的约束条件
HITL 系统通常将审核员的时间视为无限,但警觉度下降和自动化偏差正悄悄地将安全网变成“橡皮图章”。请针对真实的人类极限进行设计。
分页是一项工具目录规范:为什么智能体在处理列表返回时会耗尽上下文
返回无界列表的工具会将智能体变成函数调用时代的 SELECT * 反模式。分页是一种降级原语 —— 应该将其作为工具目录中的规范,而不是逐个工具去决定。
智能体记忆漂移:为什么一致性对齐是你缺失的关键环
长期运行的智能体在停止观察的那一刻起就与世界脱节。应将记忆视为数据库副本:使用水位线 (watermarks)、变更摘要 (change feeds) 和惰性重校验。