跳转到主要内容

45 含有标签「tool-use」

Posts tagged "tool-use" on TianPan.co.

查看所有标签

·tian

那个本该计算却随口编造数字的智能体

LLM 智能体往往会随口说出一个看似合理的数字,而不是去进行计算,流畅的文字掩盖了缺失的工具调用。本文探讨如何强制使用工具并为每一个数据附上出处。

insider
ai-agents
llm
hallucination
+2
·tian

组合性税收:为什么增加工具会让你的规划器性能下降

你添加的每一个工具都会使规划器的准确率曲线向下弯曲。解决方案是引入一个退役指标 —— 频率 × 成功率 × 下游提升 —— 并设立单一的目录所有者。

insider
agents
tool-use
evals
+1
·tian

延迟感知工具选择:当“当下的足够好”优于“未来的最出色”

智能体提示词中的静态工具描述在实时延迟和错误率面前会逐渐失效。提示词中的运行时“等待成本”信号,是将工具选择从僵化的评估产物转变为路由决策的关键。

insider
ai-agents
tool-use
latency
+2
·tian

MCP 能力披露税:当每个连接的服务都在消耗你的上下文窗口

MCP 工具定义在每一轮规划时都会重新加载,每次调用悄然消耗 15-66K 个 token。随着连接的服务增多,这不仅会增加成本,还会降低工具选择的准确度。本文将探讨如何评估这种“披露税”,并通过渐进式披露、单服务成本归因和稳定 schema 来控制开销。

insider
mcp
ai-agents
context-engineering
+2
·tian

双跳工具链:为什么 95% 的工具组合会变成 80% 的流水线

虽然单个工具的仪表板保持绿色,但端到端的 Agent 可靠性却在崩溃。故障发生在工具之间的衔接处,契约漂移、分页处理和单位不匹配将 95% 的原始组件变成了 80% 的流水线。

insider
agents
tool-use
reliability
+1
·tian

MCP 冷启动税:工具服务器开销如何在智能体第 7 步发生累加

为什么 200 毫秒的 MCP 工具调用会演变成 4 秒的智能体循环,冷启动税究竟存在于何处,以及如何通过预热池规范将数秒的惩罚降低到 100 毫秒以下。

insider
mcp
agents
latency
+2
·tian

流式工具结果破坏了请求-响应式智能体规划器

“缓冲并移交”式的集成会将流式工具转变为撑爆上下文、吞噬延迟的隐形故障点。一个由四个部分组成的规划器契约 —— 流式标志、运行摘要、consume_until 和预算中止 —— 能让智能体在执行轨迹而非具体数值上进行推理。

insider
ai-agents
tool-use
mcp
+2
·tian

工具组合沙箱逃逸:当三个安全工具组合成数据泄露时

每个工具的 ACL 都没有问题,但它们的组合导致了 PII 泄露。智能体权限表面是工具目录在组合下的闭包,而针对单个工具的审查只是在审计词汇,规划器却在构建句子。

agent-security
llm-security
tool-use
mcp
+1
·tian

规模化工具发现:为何纯嵌入检索在超过 20 个工具后开始失效

当AI智能体的工具库超过20个后,平面嵌入检索就会崩溃。本文解析其失败原因、结构化能力元数据的形态,以及分层路由器如何解决更好的工具描述无法修复的架构问题。

insider
ai-agents
tool-use
retrieval
+2
·tian

工具输出 Schema 设计:你的工具响应如何塑造智能体推理

糟糕的工具输出 schema 会导致智能体推理失败,表面上看像是模型问题。本文提供字段命名、可空性、冗余性、错误设计以及输出契约测试的实用指南。

llm-agents
tool-use
schema-design
rag
+1
·tian

过时的工具描述是 AI Agent 最大的隐形故障诱因

工具模式(Schemas)会随着时间的推移与其实现发生偏离,使过时的描述成为隐形故障的诱因。以下是防止这种情况的工程规范。

insider
agent-reliability
tool-use
llm-engineering
+1
·tian

下线一个 Planner 已产生依赖的 Agent 工具

从你的 Agent 工具目录中移除一个函数不仅仅是语法上的更改,更是一次行为迁移。这种阶段式下线模式可以防止回退幻觉和隐性回归。

insider
agents
tool-use
deprecation
+2
显示第 13–24 篇,共 45 篇