跳转到主要内容

278 含有标签「reliability」

Posts tagged "reliability" on TianPan.co.

查看所有标签

·tian

那个因等待另一个 Agent 而死锁的 Agent

两个能力出色的 Agent 可能会在你的账单飞涨时永远互相等待。为什么是协作——而非模型能力——导致了 Agent 群体的崩溃,以及分布式系统准则如何修复这一问题。

insider
ai-agents
multi-agent-systems
distributed-systems
+2
·tian

你的智能体从未执行过的补偿事务

AI 智能体在现实世界中执行不可逆的操作,往往无法撤销。借用 Saga 模式:为每个工具配对一个补偿事务,对不可逆行为设置门控,并在执行前记录日志。

ai-agents
reliability
distributed-systems
llm-engineering
·tian

你的智能体读不懂的弃用通知

智能体不会阅读更新日志或 Sunset 响应头。本文将探讨为什么工具弃用对大语言模型智能体来说会静默失败,以及如何对工具契约进行版本化,从而让模型能够真正接收到通知。

insider
ai-agents
api-design
tooling
+2
·tian

无人值守的人工升级路径

每个智能体流程图中的“转人工”方框,通常指向一个没有负责人、没有 SLA、也没有人值班的队列。应将升级视为一个需要专人负责的产品界面,而不仅仅是一段代码路径。

ai-agents
human-in-the-loop
customer-support
reliability
+1
·tian

你的智能体忘记发送的幂等键

智能体重试带有副作用的工具调用时,其方式与重试读取操作完全相同 —— 这会导致静默地重复扣款和重复发送邮件。本文将探讨幂等性究竟应该放在哪里,以及为什么提示词(Prompt)不是实现它的正确位置。

ai-agents
reliability
idempotency
tool-calling
+1
·tian

你从未进行过压测的每分钟 Token 上限

供应商的速率限制是你无法控制的每分钟 Token 预算 —— 而产品发布则是发现这一上限的最糟糕时机。本文将介绍如何在 429 错误发生前进行预测、压测并预留缓冲空间。

llm
capacity-planning
rate-limits
reliability
+1
·tian

无人负责的对话:问责制如何在智能体移交链中消散

在多智能体系统中,每个智能体都可以通过各自的测试,但整个对话却可能失败。本文探讨了为什么移交流程会分散所有权,以及重新建立问责制的原始原语。

ai-agents
multi-agent
reliability
observability
+1
·tian

嘈杂邻居竟是你:当失控的 Agent 让共享账户中的其他人全都触发 429 错误

共享的模型账户拥有一个全组织范围的 Token 预算,任何未限速的批处理作业都可能让其他团队的生产流量陷入饥饿。本文将探讨为什么基于组织的限制会让 Agent 成为一种“共担命运”的资源,为什么仅靠退避机制会引发惊群效应,以及哪些隔离模式行之有效。

insider
rate-limiting
llm-infrastructure
reliability
+1
·tian

没有根本原因的事后分析

“五个为什么”事件回顾假设存在一个模型并不具备的确定性原因。本文将介绍如何编写一份真实的 LLM 事后分析报告,它建立在故障率增量和促成因素堆栈之上,而非寻找单一的根本原因。

insider
postmortem
llm
reliability
+2
·tian

两个模型厂商,一个功能:用冗余换来的连贯性噩梦

增加一个备选 LLM 厂商听起来像是教科书级的弹性设计,但两个模型并非两个副本。这里有没人预料到的隐藏的一致性与维护成本。

llm
reliability
architecture
ai-engineering
+1
·tian

对你的工具接收的内容保持严格:波斯塔尔法则在智能体系统中失效

宽容地处理格式错误的工具参数看似健壮,但会悄无声息地将 Schema 违规转化为评估无法发现的数据损坏。严格拒绝并提供模型可读的错误反馈,才是让智能体循环具备自纠错能力的关键。

ai-agents
tool-calling
reliability
api-design
·tian

不稳定的测试毒化 Agent 循环的速度比伤害人类时快得多

人类对不稳定测试耸耸肩;Agent 却将报错视为绝对真理——回退正确的更改并在虚影上浪费 token。为什么测试确定性现在已成为一项 SLO,以及 Agent 集群如何检测并修复它们所遭受的不稳定测试。

ai-agents
testing
ci-cd
reliability
显示第 1–12 篇,共 278 篇
1 / 24下一页