跳转到主要内容

384 含有标签「ai-agents」

Posts tagged "ai-agents" on TianPan.co.

查看所有标签

·tian

智能体在凌晨 3 点呼叫我:触达人类工具的爆炸半径策略

授予智能体 PagerDuty 访问权限是一项会影响产品团队的基础设施决策。这是一个针对触达人类工具的控制平面 —— 包含速率限制、演练(dry-run)、退出机制(off-ramps)—— 且这些是 Prompt 无法强制执行的。

insider
ai-agents
mcp
on-call
+2
·tian

你的思维链是一个故事,而非审计日志

推理追踪读起来像审计证据,但它们仅描述了意图——而非实际执行的内容。本文探讨了为什么合规性需要运行时生成的边车操作日志。

insider
ai-agents
observability
compliance
+2
·tian

智能体无法察觉的死锁:生成计划中的循环工具依赖

LLM 编写的智能体计划通常包含经典死锁检测无法发现的隐式循环。通过静态计划图处理结合运行时看门狗,可以在 Token 耗尽前捕获这些问题。

insider
ai-agents
llm
observability
+2
·tian

你的 Prompt 时钟是正确性边界,而非日志字段

LLM Agent 没有时钟 —— 它们信任你注入的任何时间戳。将 Prompt 中的时间视为正确性契约,而非日志字段,否则你将不断遇到“周二还是周三”的 Bug。

insider
ai-agents
temporal-reasoning
prompt-engineering
+1
·tian

“完成!”不是返回码:为什么智能体完成需要结构化信号

智能体用自然语言发出完成信号;编排器则需要结构化事件。一个带有状态枚举、原因代码和可恢复句柄的 done 工具,能将静默的智能体失败转变为清晰的模式违规 (schema violations),让你的流水线能够真正进行路由。

ai-agents
orchestration
llmops
agent-design
+1
·tian

你的评测框架是单用户运行的,但你的智能体并非如此。

顺序运行的评测框架无法捕获当多个智能体共享基础设施时爆发的漏洞。本文介绍了四种失效模式以及修复它们的架构方案。

ai-agents
evaluation
concurrency
llm-ops
+1
·tian

首次触达工具损耗:为什么你的智能体在执行任务前要先读 12 个文件

AI 智能体在进行首次编辑前,60–80% 的 Token 预算都损耗在了读取操作上。通过任务类别路由、探索预算上限和“先规划后执行”门控机制可以减少这种浪费。

ai-agents
llm-ops
cost-optimization
agent-architecture
·tian

幻觉成功问题:当你的智能体宣称完成却一事无成时

那些在没有实际完成工作的情况下却自信地报告任务完成的智能体,正在悄悄地破坏你的仪表盘数据。本文将介绍在用户发现之前捕捉这些问题的验证模式。

ai-agents
reliability
observability
llm
+1
·tian

MCP 服务端坟场:当你的智能体依赖停止更新时

第三方 MCP 服务端已成为 AI 智能体面临的新型长尾依赖风险。被弃用的维护者、过时的填充代码(shims)以及继承的 CVE 漏洞引发了能够绕过所有供应链告警的无声失败 —— 本文将介绍如何在采用前识别孤立项目,以及何时应当进行分叉(Fork)、Vendor 化或自行构建。

mcp
ai-agents
supply-chain
dependencies
+1
·tian

无结果并不代表不存在:为什么智能体将检索失败视为证明

那些回答“无结果”的智能体很少是在对现实世界做出陈述。它们只是将一个空数组描述为一种证明——而这正是隐性生产事故产生的原因。

ai-agents
rag
tool-design
retrieval
+1
·tian

你的 OAuth 令牌在任务执行途中过期:长时运行 Agent 的隐形故障模式

OAuth 最初是为短请求设计的,而 Agent 循环的运行时间往往超过了令牌的有效期。本文将深入探讨长时运行 Agent 在其生命周期中面临的故障模式、刷新模式,以及能够经受住 Agent 时间尺度考验的凭据生命周期架构。

oauth
ai-agents
authentication
reliability
+1
·tian

“规划并执行”只是营销而非契约:将计划依从度作为一等 SLI

“规划并执行”智能体生成的计划看起来像契约,但在实际表现中更像是预测。你应该将计划依从度视为一项 SLI,具备测量、强制执行和有限的重新规划预算,而不是一个每季度评分一次、可有可无的质量指标。

insider
ai-agents
llm-evaluation
observability
+2
显示第 241–252 篇,共 384 篇