
Tian Pan
Software Engineer
你的 AI 披露在第三轮就消失了,没人察觉,直到监管者发现
你的法务团队批准的单轮披露评审,无法在为它服务的 Agent 循环中存活——到第十四轮,模型已经在用一份悄悄删掉了「我是 AI」的摘要回答用户,而这个缺口如今是一个有牙齿的监管责任。
推理账单:没人愿意背的损益表科目
推理已经占到企业 AI 支出的 85%,但组织架构里仍然把它当成工程线下的一项杂项。真正的解法是:一个有名有姓的预算负责人、一条分摊规则,以及一个事先约定好的关停阈值——这三样工具都帮不了你,得你自己谈出来。
多模态追踪:当各种模态必须共享一个 ID
当语音、视觉和 LLM 各自打开自己的根 span 时,多模态 Agent 就让 span 树支离破碎。修复办法是:一个轮次 ID、附着的工件,以及一个对接合层负责的所有者。
一路重试穿过你限流器的 agent
你的 token bucket 衡量的是用户点击;账单衡量的是模型调用。当一次点击扇出成三十次调用,HTTP 边界上的限流器就变成了一把纸糊的伞。
团队内部的 AI 素养鸿沟,才是你路线图上最大的交付风险
团队对外宣称的 AI 能力,是成员中最强那一位的水平;而真实的交付速度,是这群人的中位数水平。这道鸿沟是你路线图上定价最不充分的风险。
长出胳膊和腿的缓存提示词前缀
六个月前你的提示词前缀是 4k tokens,几乎可以摊销到免费。今天它是 11k tokens,你的缓存命中率是 31%,没有人能指出是哪个 PR 干的。
凌晨 3 点拥有合并权限的 CI Agent
把一个有合并权限的 AI Agent 接入 CI,就在你的体系里创造了一种 SRE 手册从未命名过的新型操作主体。给它的动作分级、把不能无人值守的动作排进队列、为每次变更留下可追溯的归属,并定期演练它的紧急停机开关。
那个谁也不敢从注册表里删掉的死工具
一个无人认领的工具可能永远赖在你的共享 agent 目录里,在 token、选择准确率和安全攻击面上对每一次推理课税。建一套能让你把它干净拔掉的弃用生命周期。
那位通过反复试验摸清你 Prompt 的高级用户
你的 AI 功能与用户之间有一份未公开的契约,它完全编码在系统 prompt 里。一小部分有耐心的用户会逆向破解它,其余的人则只能用到一个更糟糕的产品。与其藏着,不如把契约显式呈现出来。
你的 Agent 读不懂的生产日志
把 agent 接入日志系统只是给了它访问权,不是理解力。真正的集成工作,是教它你的数据叫什么名字。
在用户说"是"之前就已提交的流式响应
流式 UX 继承了一个工具调用并不遵守的可逆性契约。本文剖析为何停止按钮无法撤回已发送的邮件,以及修复这一问题所需的框架变更。
当 Agent 选择事后道歉而非事前请示
默认的自治策略悄悄把『撤销』变成一种愿望——以及在工具层、评测层和编排层需要落地的纪律,让 Agent 不再先动手后道歉。