跳转到主要内容

23 含有标签「llm-engineering」

Posts tagged "llm-engineering" on TianPan.co.

查看所有标签

·tian

你的智能体从未执行过的补偿事务

AI 智能体在现实世界中执行不可逆的操作,往往无法撤销。借用 Saga 模式:为每个工具配对一个补偿事务,对不可逆行为设置门控,并在执行前记录日志。

ai-agents
reliability
distributed-systems
llm-engineering
·tian

你的工具 Schema 验证的是类型,而非单位

一个接收“分”为单位的退款工具往往会收到以“元”为单位的数值,因为 JSON Schema 验证的是结构而非含义。本文探讨了单位混淆是如何绕过类型、Schema 和评估的,以及如何通过命名、边界断言和评估模式来防止产生 100 倍金额的账单。

ai-agents
tool-calling
llm-engineering
reliability
·tian

你的模型已经学会通过可见输入预测的那个功能开关

当路由哈希与 Prompt 组装器共享输入时,LLM Prompt 实验就会发生策略泄漏 —— 本文将深入探讨这种虚假提升是如何产生的、仪表盘无法显示的症状,以及弥合这一差距的工程实践。

insider
experimentation
llm-engineering
ab-testing
+2
·tian

你的智能体无法穿透推理的脱敏层

隐私脱敏可以保留分类准确率,却悄悄破坏多步骤智能体所依赖的实体连续性。修复的关键不在于占位符是否存在,而在于它们的作用域如何划定。

insider
ai-agents
privacy
pii
+2
·tian

MCP Server 蔓延:无人监管的无边界工具表面

每个团队都在接入另一个 MCP Server,Agent 的工具表面在没有负责人、没有预算的情况下不断扩大,且每一轮对话都要支付 Token 税。本文探讨这种蔓延如何破坏选择准确性,以及什么样的策展纪律可以修复它。

insider
mcp
ai-agents
tool-calling
+2
·tian

你在没告诉智能体的情况下修改了工具 Schema

重命名一个字段对你的后端来说只是常规的 API 变更,但对于调用该工具的 LLM 而言,这却是一个无声的破坏性变更。本文探讨如何将工具 Schema 视为拥有两个消费者的版本化契约。

insider
ai-agents
function-calling
api-design
+1
·tian

LLM 作为编译器模式:分离计划生成与执行

引导 LLM 输出由确定性引擎运行的结构化执行计划——而不是让它逐步行动——能以八分之一的成本提供高出 50% 的准确率。本文将探讨该模式何时值得这些额外开销,以及如何在生产环境中实现它。

agent-architecture
llm-engineering
ai-reliability
production-ai
·tian

过时的工具描述是 AI Agent 最大的隐形故障诱因

工具模式(Schemas)会随着时间的推移与其实现发生偏离,使过时的描述成为隐形故障的诱因。以下是防止这种情况的工程规范。

insider
agent-reliability
tool-use
llm-engineering
+1
·tian

你不该上线的 AI 功能:任务形态错位核查清单

大多数 Demo 都能跑通。但在已上线的 AI 功能中,仍有相当一部分存在任务形态错位——即将随机性引擎强行接入需要确定性输出的场景。本文提供了一份开发前的核查清单以及路线图调整建议,帮助你重新引导那些不符合模型形态的创意。

ai-product
eval
risk
roadmap
+1
·tian

上下文窗口不是免费存储:显式驱逐策略的必要性

工程团队习惯性地把代码库、历史记录和文档塞进上下文,默默承受成本上升和质量下降,却从不进行度量。本文阐述为何 LLM 上下文需要像 CPU 寄存器一样进行显式管理,以及如何构建切实可行的驱逐策略。

insider
llm-engineering
context-management
ai-infrastructure
+1
·tian

当你的智能体框架成为 Bug 时

高级智能体框架虽然能加速早期原型开发,但却隐藏了会在生产环境中暴露的失败模式——不透明的重试放大、不可见的 Token 成本,以及需要阅读框架源码才能解决的调试困境。本文将探讨如何识别框架何时成为瓶颈,以及如何在不进行全面重构的情况下进行迁移。

agent-architecture
llm-engineering
production-ai
orchestration
·tian

工具文档字符串考古学:描述字段是你杠杆率最高的提示词

工具定义看起来像 API 文档,但其本质是自然语言提示词。请将描述字段视为生产级别的提示词资产 —— 并添加相应的 Lint 规则来捕捉那些无声的回归风险。

insider
tool-use
function-calling
prompt-engineering
+2
显示第 1–12 篇,共 23 篇
1 / 2下一页