跳转到主要内容

209 含有标签「agents」

Posts tagged "agents" on TianPan.co.

查看所有标签

·tian

你的 stop_reason 在说谎:构建生产环境故障排查真正需要的停止分类法

厂商提供的 stop_reason 值只给了你四个分类,但生产环境的故障排查通常需要八个。本文将介绍如何构建并行停止分类法,将黑盒式的终止转换为可调试的信号。

llm
observability
ai-engineering
incident-response
+1
·tian

并行工具扇出的结构化并发:谁来负责部分失败?

大多数智能体框架将并行工具调用作为分离的 goroutine 运行,然后重新发现了结构化并发在二十年前就已经解决的失败模式 —— 部分失败、响应取消以及成本失控。

insider
agents
concurrency
llm
+2
·tian

Token 放大:烧掉你账单的提示词注入攻击

大多数提示词注入威胁模型都集中在数据泄露上。更隐蔽的一类攻击是账单放大 —— 0.01 美元的请求变成了 40 美元的推理发票。这里是阻止该攻击的防御准则。

insider
ai-engineering
security
prompt-injection
+2
·tian

供应商 99.9% 的 SLA 对你的 Agent 来说衡量边界错了

供应商 99.9% 的可用性是按单次调用衡量的;而你的 Agent 每个任务需要进行 12 次调用。本文将探讨其中的算术逻辑、缺失的合同条款,以及如何在用户察觉之前捕获故障的发散告警。

insider
sla
agents
reliability
+2
·tian

你的智能体发件箱将是你的下一个送达率事故

一个智能体在早餐前发出了 80,000 封邮件,导致重置密码域名的声誉在六周内荡然无存。在第一次发送之前,你需要建立子域名、DKIM 和速率限制的纪律。

insider
agents
email
deliverability
+2
·tian

你的 API 曾假设一次只有一个人类用户。并行智能体打破了这一契约。

内部 API 是为人类节奏的会话而设计的。当用户生成并行智能体时,速率限制、幂等性假设、审计日志架构和 CSRF 流程都会瞬间失效。

insider
agents
apis
infrastructure
+2
·tian

人格漂移:当你的智能体忘记自己的身份时

长对话会悄悄侵蚀系统提示词。本文探讨了为什么智能体人格会在 8–12 轮对话后发生漂移,如何衡量其半衰期,以及哪些强化模式能够保持稳定性。

insider
agents
evals
reliability
+2
·tian

Agent 的链路追踪采样:每日千万级 Span 中哪些值得保留

为什么默认的均匀采样在 Agent 工作负载中会失效,以及决定你的链路账单和故障平均修复时间 (MTTR) 的四个关键决策 —— 开始、结束、分层与保留。

agents
observability
llm
sampling
+1
·tian

冷启动评估:如何在零生产环境追踪的情况下发布 AI 功能

没有生产追踪意味着没有免费的评估信号 —— 但等待真实用户也不是解决办法。本文介绍一套四层冷启动评估栈:结构化的内部试用、基于角色的场景模拟、专家标注的种子集,以及公开的对抗性探测库。通过明确权重,确保声音最大的内部用户不会左右评估标准。

ai-evaluation
llm
product
agents
+1
·tian

对话历史是你的提示词从未承认的负担

聊天历史并非免费的上下文。每一轮对话都会增加噪声,干扰注意力,并导致单轮准确率下降 —— 本文将介绍如何检测、压缩和整理这些内容。

llm
context-management
ai-engineering
agents
+1
·tian

持久化智能体:为什么异步队列无法胜任长运行 AI 工作流

多步骤 AI 智能体在生产环境中往往会失败,因为队列采用“至少一次”交付,而 LLM 的规划具有非确定性。解决方案是持久化执行 —— 通过 Saga 模式、幂等检查点以及围绕无状态规划器的有状态底层来构建。

agents
durable-execution
workflow-orchestration
reliability
+1
·tian

人机回环 (HITL) 是一个队列,而队列具有动态特性

智能体工作流中的审批步骤表现得就像生产环境中的队列 —— 伴随着积压增长、陈旧性、疲劳感和优先级倒置。以下是如何设计能够承受规模化压力的 HITL 的方法。

insider
ai-engineering
hitl
agents
+2
显示第 133–144 篇,共 209 篇