跳转到主要内容

6 含有标签「agent-reliability」

Posts tagged "agent-reliability" on TianPan.co.

查看所有标签

·tian

演示成功是因为有人在看:会话长度是你的评测套件遗漏的那个维度

五轮的演示掩盖了在第二十八轮才会出现的误差累积、注意力漂移和承诺粘性。把会话长度当作一等评测维度来对待,否则你交付的可靠性数字,用户其实已经见过它的另一个版本。

insider
ai-engineering
llm-evals
agent-reliability
+1
·tian

过时的工具描述是 AI Agent 最大的隐形故障诱因

工具模式(Schemas)会随着时间的推移与其实现发生偏离,使过时的描述成为隐形故障的诱因。以下是防止这种情况的工程规范。

insider
agent-reliability
tool-use
llm-engineering
+1
·tian

当你的智能体具有自愈能力时,MTBF 已死

自愈智能体运行时已经吞噬了 MTBF 最初旨在统计的故障信号。以下是取代它的指标集:恢复后成功率、单次成功恢复成本以及单次追踪的恢复尝试分布。

insider
agent-reliability
observability
llm-ops
+2
·tian

生产环境 AI 故障响应:当你的智能体在凌晨 3 点出错时

AI 故障与常规软件故障并不相同 —— 没有堆栈跟踪,没有 500 错误,只有看似笃定的错误答案和失控的循环。这是一份关于生产环境 LLM 系统检测、分类、遏制和复盘的实用指南。

agent-reliability
llmops
production-ai
observability
·tian

Agent 系统中的重试风暴问题:为什么每次失败的工具调用都在烧掉你的 Token 预算

在链式 Agent 工具调用中,简单的重试逻辑会导致成本指数级增长——一个 0.01 美元的任务可能演变成 2 美元的崩溃。通过工具预算、Agent 预算、编排背压和错误分类构成的四层防御体系,可以防止生产环境下 AI Agent 的级联故障。

agent-reliability
distributed-systems
llm-production
cost-optimization
·tian

长程智能体中的陈旧世界模型问题

长程 AI 智能体会默默积累关于外部状态(文件、API、数据库)的陈旧假设,这些假设在任务执行过程中会与现实脱节。本文将探讨这种故障如何复合化、为什么没有框架能自动解决它,以及构建显式新鲜度保证的五种模式。

ai-agents
agent-reliability
production-ai
state-management