跳转到主要内容
Tian Pan

Tian Pan

Software Engineer

查看所有作者

·tian

AI Agent 代币经济学:在不牺牲质量的前提下降低成本

AI Agent 消耗的代币比聊天机器人多 3 到 10 倍,而未优化与优化后的部署在成本上可能相差 200 倍。这是一份关于提示词缓存、模型路由、上下文压缩和硬限制的实用指南,旨在真正解决成本痛点。

ai-agents
cost-optimization
llm
finops
·tian

AlphaEvolve 的架构:演化搜索 + LLM 如何发现更优的矩阵算法

深入解析 AlphaEvolve 的四大核心组件循环——程序数据库、提示采样器、LLM 集群和评估器,以及工程师能从这一击败了 56 年历史算法的架构中学到什么。

ai-agents
algorithm-discovery
llm
optimization
·tian

评估 AI Agent:为什么只看结果会误导你

一份关于 AI Agent 评估的实操指南,涵盖了结果评分与多步轨迹评分 —— 包含评分器类型、pass@k 与 pass^k 的对比、评估框架设计,以及导致评估计划失败的组织陷阱。

ai-agents
evaluation
llm
testing
+1
·tian

上下文工程:生产级 AI 智能体的隐形架构

上下文腐化在大规模应用中会削弱所有主流 LLM 的表现。了解如何将上下文作为一级基础设施进行管理——包括 KV 缓存优化、可逆压缩、错误追踪保留,以及在首个生产事故发生前揭示性能下降的关键指标。

context-engineering
ai-agents
llm
production
·tian

Agentic 工程模式:While 循环只是最简单的部分

每一个生产级 Agent 都运行着相同的平凡循环。真正重要的模式是围绕它构建的——提示词链式调用、路由、反思,以及防止每周产生 47,000 美元账单的上下文管理规范。

agents
engineering
production
patterns
·tian

再谈取舍:像狐狸一样思考,还是像刺猬一样专注?

通过刺猬理念,理解如何在创业中找到核心竞争力,明确热情、能力与经济引擎的交集,避免分散精力,实现长期价值。

entrepreneurship
strategy
hedgehog concept
business thinking
·tian

构建多智能体研究系统:来自生产环境的设计模式

探讨多智能体研究系统的实际构建方式——包括行之有效的架构模式、生产环境中常见的失败模式,以及在控制成本和质量时所需的工程纪律。

multi-agent
ai-agents
orchestration
production
+1
·tian

治理 Agentic AI 系统:当你的 AI 具备行动能力时,会发生什么变化

当 AI Agent 能够调用 API、写入数据库并生成子 Agent 时,治理的核心从控制输出转向了控制行为。本文提供了一个实用的工程框架,涵盖授权、最小化足迹、提示注入防御以及结构化的人力监督。

agentic-ai
security
authorization
governance
·tian

智能体工程是一门学科,而非一种感觉

为什么大多数 AI 智能体在生产环境中会失败 —— 以及区分可靠系统与仅能在演示中运行系统的六个结构维度(意图、记忆、规划、控制流、权限、工具)。

agent-engineering
llm-agents
production-ai
reliability
·tian

从第一性原理设计智能体运行时

生产级智能体运行时并非简单的函数运行器 —— 它是一个执行基板。本文将从第一性原理出发,涵盖图执行模型、检查点、人机回环以及可观测性,教你如何正确设计一个智能体运行时。

agent-architecture
ai-engineering
llm
production
·tian

为什么你的智能体应该编写代码,而不是 JSON

代码操作智能体 (Code-action agents) 让大语言模型 (LLM) 能够生成并运行 Python 而非 JSON —— 任务成功率提高 20%,LLM 往返次数减少 30%。本文将介绍它们的工作原理、局限性,以及如何在生产环境中安全地运行它们。

agents
llm
python
code-execution
+1
·tian

为什么你的 AI Agent 将大部分上下文窗口浪费在了工具上

你加载的每一个工具定义都是预先支付的 Token 税。在连接了 50 多个 MCP 工具的情况下,仅定义本身就在工作开始前消耗 130K Token。以下是破坏生产环境工具使用的三个瓶颈以及修复它们的模式。

tool-use
ai-agents
llm
production
+1
显示第 2005–2016 篇,共 2313 篇