跳转到主要内容

45 含有标签「tool-use」

Posts tagged "tool-use" on TianPan.co.

查看所有标签

·tian

没人使用的长尾:工具带是如何变得尾大不掉的

你给智能体增加的每一个工具,都在削弱它选择正确工具的能力。那几十个无人问津的工具正在悄悄降低那三个核心工具的被选概率 —— 本文将探讨如何保持工具目录的精简与高效。

insider
ai-agents
tool-use
mcp
+2
·tian

当用户取消对话后,下游 API 却仍在继续写入

点击停止按钮可以干净地关闭 LLM 流。但这并不会停止工具已经向第三方开启的 HTTP 请求,而第三方并不知道对话已经结束。本文将解释为什么 AbortSignal 止步于套接字,以及你应该在提交边界构建什么来替代它。

insider
agents
cancellation
tool-use
+2
·tian

由于注册表缓存存在一小时延迟,你的智能体仍在调用已被撤销的工具

当用户移除一个智能体工具时,一小时的注册表缓存以及将拒绝视为暂时性错误的重试策略,会将一次常规的撤销变成一个安全事件,而用户只能通过审计日志才发现这一问题。

agents
tool-use
mcp
caching
+1
·tian

增加更多工具后,你的智能体“不知道”率为何反而下降了

扩大工具覆盖范围在仪表盘上看起来像是能力的提升。但实际上,这往往是计划器在悄悄地将诚实的“不知道”转化为自信的错误答案。

agents
evaluation
tool-use
reliability
·tian

流式中止后遗留的计费副作用

点击停止只会关闭连接,并不会撤回 Agent 已经发出的邮件。本文将探讨“部分提交”问题以及用于弥补这一鸿沟的“账本模式”。

streaming
agents
tool-use
reliability
+1
·tian

你的 LLM 抄不准的那个账号

LLM 是 token 预测器,不是字符串复印机。当两个相似的账号出现在同一段上下文里,智能体会换错数字、把退款打给错的客户,留下一条干净得看不出问题的 trace。修复方式是把『标识符保真』从模型的工作描述里剔除出去。

insider
llm-agents
tool-use
reliability
+1
·tian

那个用一小时反复重试同一个 400 错误的 Agent

400 不是瞬时错误。把它当瞬时错误处理的重试循环,就是 agent 用一小时、一份预算、一个限流额度反复砸同一个错误负载的根源。

ai-agents
retry-logic
observability
tool-use
·tian

无法说出"等一下"的智能体

生产环境中的智能体可以执行动作、给出答案或提出问题——但说不出"等一下"。缺失的原语如何把犹豫挤压成无谓的工具调用和过度自信的承诺,以及如何把审议重新纳入协议。

insider
ai-agents
harness-engineering
tool-use
+2
·tian

把每个工具都当作 O(1) 的规划器

为什么智能体规划器会选出正确但代价极高的工具序列,以及无需重新训练模型即可让规划具备成本感知能力的模式级改造。

insider
ai-agents
llm
planning
+2
·tian

你的智能体把指针当成了值:工具输出里的引用 vs 值

当工具的返回值是 ID、路径或 URL 时,它实际上是在让智能体去做一次解引用。但模型何时解析、何时直接"假装已解析"地继续往下编,这套策略是隐式的、不一致的、悄无声息地出错的。把这层间接寻址显式地写进类型里。

insider
ai-engineering
agents
tool-use
+2
·tian

流式 Token 是无法收回的承诺

当背后的工具调用失败时,原本自信的流式回答就会崩溃。流式传输是一种不可逆的契约 —— 有一些模式可以在不牺牲感知延迟的情况下重新获得选择权。

streaming
agents
ux
reliability
+1
·tian

你为单个智能体添加的工具,现在每个智能体都能用了

共享的工具注册表正悄无声息地将所有能力赋予每个智能体。只有基于单个智能体的白名单,而非工具目录本身,才是真正约束智能体行为的授权单元。

ai-agents
tool-use
permissions
security
+1
显示第 1–12 篇,共 45 篇
1 / 4下一页