·tian
你为人类设置的速率限制,AI 智能体三秒钟就会让其饱和
为人类节奏流量校准的速率限制,在智能体首次将规划循环指向端点时就会崩溃。应将限制视为一种拆分契约 —— 吞吐量预算加上滥用上限 —— 并基于租户和工作负载类别进行挂钩。
rate-limiting
ai-agents
api-design
multi-tenant
+1·tian
没人写的 AI 功能下线指南
大多数 AI 功能下线仅停留在端点层面,却遗留了提示词(prompt)、评测员(judge)、回归集和故障记忆。这是一份按资产分类的指南,教你如何下线 AI 功能,避免在两个季度后出现孤立配置、幽灵评测运行以及丢失的组织知识。
ai-engineering
deprecation
prompt-management
evals
+1·tian
AI 功能依赖图:当提示词修改成为静默破坏性变更时
提示词修改对每一个消耗其输出的下游功能来说都是一项破坏性变更。清单、实时语料库契约测试和漂移警报,是团队在下一次故障替他们画出 AI 依赖图之前,主动绘制该图谱的方法。
insider
ai-engineering
llmops
observability
+2·tian
评估框架(Eval Harness)而非提示词,才是你真正的供应商锁定
重写提示词是切换 LLM 供应商时最简单的部分。评估框架才是真正的供应商锁定所在 —— 当你尝试重新协商时,真正的账单就会随之而来。
llm
evals
ai-engineering
platform
·tian
构建生成式 AI 平台:架构、权衡以及真正重要的核心组件
一份关于 LLM 周边基础设施层的实践指南,涵盖 RAG 流水线、模型网关、缓存策略、护栏和可观测性,以及何时应当真正引入这些组件。
ai-engineering
llm
platform
rag
+1