·tian
你的仪表盘以三种不同方式统计了那次重试
一个智能体在成功前重试了三次。产品团队看到了转化,SRE 团队看到了 75% 的错误率,财务团队看到了四次计费推理。通过任务结果、步骤健康度和预算消耗这三个层面,在保持数据一致性的同时,无需强求一个指标满足所有人的需求。
insider
ai-engineering
agent-observability
llm-ops
+2·tian
解读智能体堆栈跟踪:在模型、工具与 Harness 之间定位故障
大多数智能体漏洞存在于模型、工具与 Harness 的结合部——单层日志无法识别它们。构建统一追踪、OpenTelemetry GenAI span 表面、因果假设面板以及复现包络,像对待分布式系统一样调试你的智能体。
agent-observability
debugging
tracing
llm-ops
+1·tian
为什么在 AI Agent 出错时,你现有的可观测性栈无法救场
当你的 AI Agent 推理错误时,HTTP 200 状态码和整洁的延迟图表将毫无意义。本文将探讨执行层追踪的工作原理、需要衡量的指标,以及生产级 Agent 系统中可观测性工具的具体分类。
agent-observability
llm-tracing
ai-agents
production