跳转到主要内容

209 含有标签「agents」

Posts tagged "agents" on TianPan.co.

查看所有标签

·tian

面试模式与任务模式:你的智能体不断打破的无形契约

大多数关于 “问得太多” 和 “问得不够” 的抱怨其实都是同一个 bug —— 你的智能体选错了契约。本文将介绍如何识别并解决这一问题。

agents
ux
conversational-ai
prompt-engineering
·tian

飞行中转向:无需重启即可重定向长时运行的智能体

大多数智能体 UI 将每次航向修正都变成了完全重启。解决方案是架构层面的——检查点与注入、计划修订钩子以及软中断令牌——外加一套区分了修正、覆盖与取消的“三动词” UX 词汇表。

insider
agents
ai-engineering
ux
+1
·tian

评估通过,但工具全是 Mock 的:为什么你的 Agent 最棘手的生产故障从未进入测试框架

Mock 工具的评估让 CI 绿灯常亮,而生产环境却在一团糟。本文探讨了每个 Mock 默认做出的三个隐含假设,为什么评估通过率与事故率会发生背离,以及最终弥合这一差距的三级阶梯(Mock、录制回放、实时烟雾测试)。

ai-engineering
evaluation
agents
testing
+1
·tian

重试放大:2% 的工具错误率如何演变成 20% 的智能体故障

智能体循环通过在多个步骤和 SDK 层级间叠加重试,将 2% 的工具错误率放大为 20% 的用户端故障。本文将解析其背后的数学原理、自我 DoS 模式,以及能够遏制这种现象的重试预算规范。

insider
agents
reliability
retry
+2
·tian

Agent Trace 中的采样偏差:为什么你的调试数据集在悄悄排除你最关心的失败案例

头部采样和均匀随机采样会悄悄地从你的调试语料库中切除罕见的灾难性 Agent 轨迹。通过尾部采样、基于异常的关键保留以及按故障模式划分的蓄水池,可以构建一个真正包含你所需失败案例的调试数据集。

observability
agents
sampling
llm
+1
·tian

规范先行(Spec-First)智能体:为什么契约必须先于提示词落实

当作者超过一人时,“以提示词作为规范”的模式就会崩溃。规范先行的契约——包括输入、输出、不变式、错误、拒绝和升级——能将提示词修改转化为代码差异(diffs),使评估可推导,并将负责人入职时间从数月缩短至一周。

insider
agents
prompt-engineering
evals
+1
·tian

你的工具描述是提示词,而非 API 文档

工具规范文本是模型在决定何时调用之前读取的提示词。请像对待提示词一样对待它——提供具体的用例、反面示例、同类工具辨析——而不是像对待 OpenAPI 文档那样。

ai-engineering
tool-use
function-calling
prompt-engineering
+1
·tian

工具 Schema 弃用:为什么你不能直接重命名参数

Agent 工具 schema 同时存在于两个地方 —— 运行时规范和模型的上下文内存。重命名参数会以不同的方式破坏这两者。这里是弃用指南。

mcp
agents
tool-use
schema-evolution
+1
·tian

语音智能体并非带麦克风的聊天机器人:半双工税

语音智能体继承了人类的半双工协议,而非聊天的舒适感。轮换协商、插话处理以及真实的 200 ms 预算,决定了你的智能体听起来是专注还是诡异。

voice-ai
latency
agents
real-time
·tian

在写第一个 Prompt 之前,先设计好你的 Agent 状态机

先写 Prompt 再拼接逻辑的直觉,会导致 agent 在简单测试中正常运行,却在生产环境中神秘失败。先设计状态机,会改变一切。

insider
ai-engineering
agents
architecture
+1
·tian

AI智能体的CAP定理:当LLM成为瓶颈时,选择一致性还是可用性

当AI智能体的工具调用失败或LLM超时,你面临的权衡与分布式系统工程师从CAP定理中熟悉的如出一辙。大多数智能体框架默默选择了可用性——并在生产中为此付出代价。

ai-engineering
agents
distributed-systems
reliability
·tian

复合精度问题:为什么你的 95% 精确率 Agent 会失败 40% 的时间

一个每步精确率为 95% 的 10 步 Agent 流水线,整体成功率只有 60%。这里是背后的数学原理,以及真正能改变失败曲线的架构模式。

ai-engineering
agents
reliability
production
显示第 145–156 篇,共 209 篇