跳转到主要内容

博客

来自AI智能体经济的洞见、分析与更新。 按标签浏览.

·tian

你的智能体忘记发送的幂等键

智能体重试带有副作用的工具调用时,其方式与重试读取操作完全相同 —— 这会导致静默地重复扣款和重复发送邮件。本文将探讨幂等性究竟应该放在哪里,以及为什么提示词(Prompt)不是实现它的正确位置。

ai-agents
reliability
idempotency
tool-calling
+1
·tian

你的 Agent 链路中无人分配的延迟预算

Agent 的 SLO 通常设置在边界处,而内部却缺乏预算分配,导致没人能归因是哪一跳搞砸了 P99。你需要分配逐跳预算,在 Span 级别进行追踪,并约束那个呈乘性而非加性增长的尾部延迟。

ai-agents
observability
latency
distributed-systems
+1
·tian

P99 是产品决策,而非基建决策

你的尾部延迟目标并不是基建团队单纯优化出的一个数字 —— 这个数字本身就是一个产品选择。本文探讨了 UX 交互设计与延迟预算如何相互权衡,以及为什么 P99 应该出现在设计评审中。

insider
latency
ux
llm-inference
+2
·tian

语义差异:当行级对比毫无意义时,如何评审 Prompt 变更

仅仅三个词的 Prompt 修改就可能让你的幻觉率翻三倍,而行级对比(Line Diff)看起来却毫无破绽。为什么 Prompt 变更需要语义差异(Semantic Diff)—— 比较行为而非文本 —— 以及如何在 PR 中对此进行门控拦截。

prompt-engineering
llm
code-review
evaluation
+1
·tian

你从未进行过压测的每分钟 Token 上限

供应商的速率限制是你无法控制的每分钟 Token 预算 —— 而产品发布则是发现这一上限的最糟糕时机。本文将介绍如何在 429 错误发生前进行预测、压测并预留缓冲空间。

llm
capacity-planning
rate-limits
reliability
+1
·tian

没人使用的长尾:工具带是如何变得尾大不掉的

你给智能体增加的每一个工具,都在削弱它选择正确工具的能力。那几十个无人问津的工具正在悄悄降低那三个核心工具的被选概率 —— 本文将探讨如何保持工具目录的精简与高效。

insider
ai-agents
tool-use
mcp
+2
·tian

你无法删除的用户:AI 系统中的被遗忘权

一项“被遗忘权”请求揭示了 AI 系统中一个令人不安的事实:用户数据散布在模型权重、向量索引和缓存中,且没有单一的数据行可以删除。本文探讨如何为“可遗忘性”进行设计。

ai-engineering
privacy
gdpr
machine-unlearning
+1
·tian

聊天并非最佳界面:为什么你的智能体不应只是一个文本框

大多数打开聊天窗口的人从不发送消息。聊天是一种不错的输入原语,但作为运行环境却很糟糕 —— 本文将探讨何时该采用结构化 UI、生成式 UI 和环境智能体。

ai-agents
ux
product-design
generative-ui
+1
·tian

与先验对抗:当模型掌握了错误版本的技术栈时

你的编程模型并不是对你的框架一无所知 —— 它掌握的是一个自信但错误的版本。本文将探讨为什么模型的先验知识会战胜你提供的上下文,以及哪些对策能真正奏效。

ai-engineering
llm
code-generation
context-engineering
+1
·tian

间接提示注入:你以为处于惰性的数据平面

你的智能体将检索到的每个文档都视为惰性数据,但检索到的文本实际上是以系统提示词的权限运行的。本文将探讨间接提示注入的工作原理、为什么 EchoLeak 证明了它的存在,以及真正有效的防御手段。

insider
ai-security
prompt-injection
llm
+2
·tian

没人会为你的智能体承保

你的智能体准确率足以在无人看管的情况下运行,但部署过程却卡在了一个问题上:当它出错时,谁来承担损失。本文探讨了为什么自主性现在成了一个保险问题,以及如何让智能体变得可承保。

insider
ai-agents
liability
insurance
+2
·tian

试点炼狱:廉价的 90% 正是你的 AI POC 无法转正的原因

一个可运行的 AI 演示只是那看起来像 100% 但其实很廉价的 90%。那些能确保其在生产环境中安全运行的评估、护栏、可观测性、成本上限和权属划分,才是没人预估过的昂贵的 10% —— 这里有一份清单,帮你提前预估这些成本。

insider
ai-engineering
llm
mlops
+1
显示第 13–24 篇,共 2312 篇