跳转到主要内容

209 含有标签「agents」

Posts tagged "agents" on TianPan.co.

查看所有标签

·tian

MCP 冷启动税:工具服务器开销如何在智能体第 7 步发生累加

为什么 200 毫秒的 MCP 工具调用会演变成 4 秒的智能体循环,冷启动税究竟存在于何处,以及如何通过预热池规范将数秒的惩罚降低到 100 毫秒以下。

insider
mcp
agents
latency
+2
·tian

多维 Agent 二分查找:当回归出现在交互中时

当 Agent 的回归源于新模型与新工具描述之间的交互时,单轴回滚会产生明显的假阴性。解决方案是对模型、Prompt、工具目录、检索索引和采样配置的笛卡尔积进行二分查找——并以命名的版本信封作为回滚的最小单元。

agents
debugging
evals
observability
+1
·tian

多模态通道冲突:当模型在视觉与文本之间自我矛盾时

多模态模型会静默地将冲突的视觉和文本通道融合为自信的混合答案。本文探讨这种失效发生的场景、评估指标为何会漏掉它,以及如何构建一个冲突检测原语。

insider
multimodal
vision-language-models
evaluation
+2
·tian

静默工具截断:你的智能体在不知情下进行推理的默认限制

大多数智能体框架会在超过隐藏的字节或 Token 限制时静默裁剪工具输出。模型会基于一个它无法察觉是被截断后的片段进行推理,而这个 Bug 往往在几个月后才会因客户投诉而浮现。

insider
agents
mcp
llm-ops
+1
·tian

当工具撒谎时:智能体默认信任的“伪成功”失败模式

工具调用返回成功,但底层操作从未实际执行——这是导致“模型对用户撒谎”事件背后的结构性失败模式,也是高风险智能体所需的校验层。

insider
agents
tool-calling
reliability
+2
·tian

挂钟时间截止日期漂移:为什么你的智能体认为它还有时间但实际上没有

透明的工具重试在静默地消耗挂钟时间预算,而规划器却基于过时的截止日期进行推理,从而导致单一层级指标无法捕捉的双峰 SLA 故障。

agents
observability
latency
sla
+1
·tian

Agent 循环容量计算:为什么你的预置吞吐量只有你想象的一半

基于用户 QPS 估算的预置吞吐量往往会因为循环扇出因子而导致 Agent 产品资源配置不足。应改为基于模型调用率、循环深度和突发尾部延迟进行规划。

insider
agents
capacity-planning
llm-inference
+1
·tian

对话式 REST:当你的聊天 UI 需要分页、过滤和排序时

聊天是一种极佳的输入方式,但却是一种糟糕的输出方式。一旦你的智能体返回的结果超过三个,正确的做法是渲染 UI,而不是继续说下去。

ai-engineering
ux
agents
generative-ui
+1
·tian

MCP 中的 OAuth:在工具服务器中传递用户身份

MCP 标准化了智能体如何获取工具服务器令牌的方式,但将更棘手的问题——这些服务器如何将用户身份传递给下游 API——留给了实现者。本文探讨了哪些方案能够通过严格的审计。

insider
mcp
oauth
security
+2
·tian

幻影技能:当你的智能体展示出你从未测试过的能力

当用户基于未经测试验证的 AI 智能体行为构建工作流时,你发布的正是你无法维护的能力。在下一次模型升级悄然移除这些“幻影技能”之前,你需要一套发现它们的学科方法。

ai-engineering
evaluation
agents
production
+1
·tian

快照追踪测试:将生产环境追踪作为你的回归测试套件

人工筛选的 LLM 评估集在用户行为发生变化的瞬间就会失效。固定生产环境追踪,对输出进行语义等价断言,对工具调用进行结构化相等断言,并使用延迟区间而非点估计。

llm-evals
observability
agents
regression-testing
+1
·tian

总结税:当压缩消耗的 Token 超过了它节省的量

长期运行的 Agent 在溢出或层级化处理时会触发摘要生成,而在大规模应用中,压缩过程会悄然成为主要的推理成本——而仪表盘永远不会告诉你这一点。

insider
llm
agents
cost
+2
显示第 61–72 篇,共 209 篇