跳转到主要内容

什么样的事情最值得做?

阅读需 1 分钟Tian PanTian Pan

参考资料

保持联系,关注我获取更多内容

阅读需 9 分钟

填充式工具调用:当智能体在表演勤奋而不是真正干活

生产环境中的智能体不断发出对答案毫无影响的工具调用——烧掉 token、拖慢延迟、损害准确率。本文讲清楚填充式调用是如何从训练中长出来的、它真正的成本是多少,以及如何用反事实测量和调用预算把它从工作流里剔除出去。

insider
ai-agents
阅读需 9 分钟

超参数幻觉:为什么 Temperature 和 Top-P 应该最后才调

当 LLM 输出感觉不对劲时,工程师会第一时间去调 temperature。这几乎从来都不是正确的做法。这里是真正能改变结果的、有据可查的调优顺序。

insider
llm
阅读需 11 分钟

Agent 的链路追踪采样:每日千万级 Span 中哪些值得保留

为什么默认的均匀采样在 Agent 工作负载中会失效,以及决定你的链路账单和故障平均修复时间 (MTTR) 的四个关键决策 —— 开始、结束、分层与保留。

agents
observability
阅读需 10 分钟

首次触达工具损耗:为什么你的智能体在执行任务前要先读 12 个文件

AI 智能体在进行首次编辑前,60–80% 的 Token 预算都损耗在了读取操作上。通过任务类别路由、探索预算上限和“先规划后执行”门控机制可以减少这种浪费。

ai-agents
llm-ops
阅读需 10 分钟

RAG 管道中的 PII 泄露:为什么你的聊天机器人知道它不该知道的事情

语义相似性并不遵循数据访问边界。本文将探讨 RAG 管道如何将敏感记录暴露给未经授权的用户,以及阻止这种行为的分层防御机制。

rag
security