Notebook 对编程智能体来说是“敌对领域”
隐藏的内核状态破坏了编程智能体所做出的每一项假设:文件并非程序本身、输出可能带有欺骗性,且重新运行单元格是不安全的。本文探讨了为什么“重启并运行所有单元格”是智能体唯一能验证的契约,纯函数式单元格如何让 Notebook 对智能体更安全,以及 Notebook 工具现在欠其最新用户(AI 智能体)的功能。
绩效评估衡量的是舰队,而不是工程师
PR 数量和速度现在衡量的是你对智能体的驾驭能力,而不是你的工程判断力。当 AI 编写了一半的代码变更时,绩效校准、评估指标和职业阶梯必须如何随之改变。
学习型系统的任意时间点恢复:那个没人做的备份
你的数据库有快照,代码有 git,但你的智能体大脑却分散在五个独立版本化的存储库中。为什么对于大多数智能体技术栈来说,“恢复到昨天下午 3 点”是一个无法定义的概念,以及存储工程中的一致性组(consistency-group)规范如何解决这一问题。
Agent 的端口与适配器架构:为什么你的工具 Schema 应该比供应商更长寿
供应商迁移往往在工具层而非提示词层崩溃。将工具 Schema 视为你拥有的端口 —— 为每个供应商和后端提供轻量级适配器 —— 你将免费获得确定性的 Agent 测试。
Postel 法则在工具边界是一种负担
宽容的解析器通过强制转换“差一点就对”的工具调用,会误导 AI Agent 认为草率的调用也是可行的,从而在循环中累积错误。带有清晰示例且包含错误的严格验证是一种循环内训练信号 —— 本文将探讨何时应保持严格,以及 Postel 法则在何处依然适用。
无障碍树是你最新的公共 API
浏览器代理读取的是你的 ARIA 角色和 DOM 语义,而不是像素 —— 因此,过去十年推迟的无障碍债务现在变成了与收入挂钩的集成债务。本文将介绍如何像审计公共 API 一样审计你的无障碍树。
你的 Agent 从未读过的 ADR
编程智能体正以机器速度重新审视每一个未记录的决策。本文探讨了为什么架构决策记录(ADR)已从官僚式的点缀演变为集群基础设施,如何将它们接入智能体上下文,以及无人提醒你的过时 ADR 失效模式。
掌握你信用卡的人工智能代理:支出授权、商户欺诈以及当买家是软件时的争议处理
AI 代理在为人类设计的支付轨道上完成了价值 2620 亿美元的节日订单。本文将探讨支出授权、代理令牌和委托证明的工作原理,以及当代理买错东西时,谁来承担损失。
新员工带来的智能体:个人 AI 记忆是双向的知识产权边界
现在,员工带着个人 AI 助手入职,这些助手的记忆中存储了上一份工作的上下文——而在离职时,你的公司信息又会被吸收到一个你无法审计或擦除的租户中。本文探讨了为什么智能体记忆是一个商业机密管理问题,以及入职、离职流程和雇佣合同需要做出哪些改变。
黑板模式回归:1980 年代的 AI 如何处理多智能体协作
通过共享计划文件进行协作的智能体团队正在重新发现 20 世纪 70 年代的黑板架构 —— 但他们只重建了白板,却遗忘了让其发挥作用的调度器、置信度评分和层级结构。
工程师离职,Agent 记忆也将随之消失
离职工程师个人的 CLAUDE.md、自定义技能和 Agent 记忆文件编码了数月以来关于代码库的隐性知识——而在他们离职的那天,这些都将荡然无存。本文探讨了为什么 Agent 配置正成为新的“影子知识”,以及如何在这些知识随人走掉之前,将其提升到团队拥有的代码库中。
内部容量市场:在团队间分配稀缺的推理资源
当多个团队共享同一个推理池时,一个团队的评估扫描(Eval Sweep)可能会使另一个团队的生产环境对话系统陷入饥饿。借鉴大型机分时系统和 Borg 的优先级波段:本文将探讨优先级层级、抢占、费用回填,以及团队在何时应当获得专用容量。