跳转到主要内容
Tian Pan

Tian Pan

Software Engineer

查看所有作者

·tian

你的智能体记忆需要两个时钟

智能体记忆存储通常将两条时间线压缩成一个扁平的事实,导致没人能回答智能体在行动时的真实想法。双时态建模 —— 有效时间加事务时间 —— 将记忆过时导致的故障和事后审计转化为简单的查询。

ai-agents
agent-memory
temporal-data
observability
·tian

你的 AI 工作负载也有“夜晚”:批处理折扣是对架构的考验

每一个主要的供应商都通过批处理 API 以半价销售同样的 token,但大多数团队从未获得过这一折扣,因为他们从未对哪些推理调用确实需要即时响应进行过分类。本文介绍了一个延迟分道(latency lanes)框架、批处理所需的架构重构,以及为什么 50% 的折扣是结构性的。

ai-engineering
llm
cost-optimization
infrastructure
·tian

你的上下文是有质量的:数据重力与“计算向数据移动”的回归

Agent 循环在每一轮都会跨越 VPC 和云边界传输数 MB 的上下文,而这笔运费从未出现在模型账单上。为什么 Hadoop 时代的“计算向数据移动”原则正在回归,以及如何审计你推理栈的重力。

insider
ai-agents
infrastructure
cloud-costs
+1
·tian

你的上下文流水线需要一份新鲜度 SLA

大多数 “幻觉” 其实是伪装下的新鲜度事故。上下文窗口是基于十个上游数据源的物化视图 —— 它像任何其他数据流水线一样,需要血缘追踪、新鲜度 SLA 和回填计划。

insider
ai-engineering
context-engineering
data-engineering
+2
·tian

你的数据 Agent 需要一个统一的营收定义

Text-to-SQL Agent 的失败在于语义而非语法。基准测试显示,语义层能将 Agent 的准确率从 84% 提升到接近 100% —— 为什么你为 BI 构建了一半的指标层,正是你的数据 Agent 所缺失的工具契约。

insider
ai-engineering
data-engineering
llm
+1
·tian

你的设计系统曾是文档,现在它需要成为一个编译器

编程代理生成略有偏差的 UI 速度超过了任何设计师的审核能力,且风格指南提示词会逐渐失效。解决方法是:让设计令牌成为唯一可导入的设计数值来源,通过 Lint 规则和类型进行强制约束,并将你的设计系统转化为一份能导致构建失败的契约。

ai-engineering
design-systems
frontend
coding-agents
·tian

你的 Embedding 是个人身份信息 (PII):反向攻击与向量数据库中的被遗忘权

反向攻击可以从 embedding 中恢复出原始文本——甚至包括临床笔记中的姓名——这使得你的向量数据库属于个人数据,而非匿名的数学表示。本文将探讨为什么删除请求在面对软删除、快照和代理 ID 时会失效,以及如何通过删除传播架构来解决这一问题。

privacy
security
rag
vector-database
+1
·tian

你的错误信息现在成了 Prompt:为 AI Agent 编写失败输出

AI Agent 阅读你的堆栈跟踪和 CLI 错误信息的频率远高于人类 —— 并且它们会将这些信息当作指令来执行。如何编写能让重试循环趋于收敛的错误信息,而不是让成群的 Agent 陷入失控的螺旋。

ai-engineering
agents
developer-tools
api-design
·tian

你的微调模型是一个你需要维护的分支

微调是对他人代码库的一次分支(Fork),而每一次基座模型的发布都是一次你并未计划的上游变基(Rebase)。弃用时钟、LoRA 适配器移植壁垒,以及当提示词加检索胜过拥有模型权重时的分支经济学规则。

insider
llm
fine-tuning
ai-engineering
+1
·tian

护栏也是模型:那个没人放进仪表盘的隐藏依赖

置于 LLM 之前的审核分类器是关键路径上的第二个模型 —— 它同样存在延迟尾部、模型漂移和停机风险。本文将探讨如何规划其延迟预算,有意识地选择故障开启或故障关闭策略,并像监控核心模型一样监控这道关卡。

ai-engineering
llm
reliability
guardrails
+1
·tian

你的内部框架是一种低资源语言

编程智能体可以写出完美的 React,却会对你公司内部的 ORM 产生幻觉。本文探讨了为什么内部框架表现得像低资源语言,如何衡量这种能力断层,以及何时应该让你的技术栈顺应模型的训练分布。

insider
ai-engineering
coding-agents
llm
+2
·tian

你的模型认为你的技术栈已过时 2 年

AI 生成的代码虽然看起来符合习惯,但针对的是 2 年前的技术栈版本,这种类型的 Bug 是常规代码审查难以发现的。将模型知识的陈旧性视为一个依赖管理问题:根据你的 lockfile 进行文档注入,将 Lint 规则作为反馈通道,并进行陈旧性审计。

ai-engineering
coding-agents
developer-tools
llm
显示第 109–120 篇,共 2312 篇