博客
来自AI智能体经济的洞见、分析与更新。 按标签浏览.
领域特定 LLM 微调的合成数据流水线
构建领域特定 LLM 微调的合成数据流水线实用指南 —— 涵盖蒸馏与自我提升、质量过滤、防止模型崩溃以及预算驱动的策略选择。
结构化生成:提升生产环境中 LLM 输出的可信度
大多数基于 LLM 的应用都潜伏着一个静默 Bug:脆弱的 JSON 解析。结构化生成——包括受限解码、JSON Schema 强制执行和验证三明治(validation sandwich)——是防止一整类生产故障的基础架构层。
让 Manus 在生产环境中稳定运行的六项上下文工程技术
在重建了四次 Agent 框架并处理了数百万个任务后,Manus 团队总结了在长程 AI Agent 中管理上下文窗口的六项具体技术——以及为什么 KV 缓存命中率是大多数团队忽视的最重要指标。
动作空间问题:为什么给 AI Agent 更多工具反而会让表现变差
为 AI Agent 添加更多工具会因为注意力稀释、选择噪声和上下文混淆而降低其性能。了解层级化动作空间和 Agent 即工具(Agent-as-tool)模式如何解决这一问题。
真正可扩展的智能体上下文工程:四大策略
长期运行的智能体性能会因为上下文的无节制积累而下降。通过 写入、选择、压缩 和 隔离 这四大策略,你可以让智能体在数百个步骤中依然保持敏锐。
Agent Harness 深度解析
深入剖析使 AI Agent 在生产环境中保持可靠的基础设施层 —— 包括执行循环、上下文管理、错误处理、安全护栏以及状态持久化,这些正是区分原型与上线系统的核心要素。
上下文工程:生产级智能体的记忆、压缩与工具清理
如何通过压缩、工具结果清理和外部记忆防止生产级 AI 智能体中的上下文漂移 —— 包含 Token 预算分配策略、失败模式以及测量模式。
CLAUDE.md 和 AGENTS.md:让 AI 编程智能体真正遵循你规则的配置层
一份关于 CLAUDE.md 和 AGENTS.md 的实用指南——这些指令文件为 AI 编程智能体提供持久的项目上下文。为什么写好这些文件比选择模型更重要。
构建能在生产环境中真正运行的 AI Agent
一份专注于生产环境的 AI Agent 构建指南:涵盖六种可组合模式、单 Agent 与多 Agent 系统的决策框架、工具设计原则、导致事故的七种失败模式,以及 Agent 系统真实的可观测性实践。
AI 智能体的有效上下文工程
主动管理 LLM 上下文窗口是生产级 AI 智能体面临的首要工程挑战。本文深入分析了四种策略 —— 编写、选择、压缩、隔离 —— 它们能让智能体在执行长任务时保持连贯性。
掌握 AI Agent 可观测性:为什么你的仪表盘在骗你
当标准的监控仪表盘显示绿色时,你的 AI Agent 可能正在默默地产生幻觉、跳过工具,且质量正在下降。以下是你真正需要衡量的内容以及原因。
80% 难题:为什么 AI 编程智能体陷入停滞以及如何突破
AI 编程智能体生成代码的速度很快 —— 但采用它们的团队发现 Review 时间延长了 91%,PR 体积增大了 154%。本文将揭示高质量交付团队与溺死在 AI 生成复杂性中的团队之间的本质区别。