跳转到主要内容

96 含有标签「architecture」

Posts tagged "architecture" on TianPan.co.

查看所有标签

·tian

你删除的代码对你的编程 Agent 是不可见的

编程 Agent 会重新引入你昨天删除的代码,因为已删除的内容在仓库中没有留痕。这是一份记录 Agent 需要遵守的“否定决策”的实战指南。

insider
coding-agents
ai-engineering
developer-experience
+1
·tian

那个悄然演变成延迟敏感型服务的夜间批处理作业

随着一个又一个合理需求的加入,一个夜间批处理作业最终演变成了对延迟要求极高的服务。本文将探讨为什么批量推理和在线推理的优化目标截然相反,架构漂移如何导致隐蔽的故障,以及如何有针对性地进行重新架构。

insider
ai-engineering
system-design
mlops
+2
·tian

对于你的 AI 功能,“自研还是购买” 是个错误的问题

一个 AI 功能是一个包含五个层级的技术栈,而不是一件可以简单制作或购买的单一事物。真正重要的决策是:哪个层级能累积你的差异化优势,而哪个层级又是竞争对手可以轻易买到的。

insider
ai-engineering
architecture
strategy
+1
·tian

为什么你的智能体需要只读副本:智能体记忆的读写分离

智能体记忆通常是一个存储承担两份工作。将其视为没有副本的单主数据库,并实现读写分离,可以解决过时的上下文、写入过程中的损坏以及随记忆增长而增加的延迟。

insider
ai-agents
memory
architecture
+1
·tian

Prompt Caching 的隐形代价:当缓存命中提供错误的用户上下文时

Prompt 缓存键是一个正确性边界,而非一个计费开关。如果你只为了提高命中率而设计它,就会引发跨租户上下文泄露和过时的个性化。

ai-agents
prompt-caching
llm
architecture
+1
·tian

自研还是购买 AI 网关:锁定你未来 18 个月的关键决策

大多数团队在第一周凭直觉决定是对 AI 网关进行自研还是购买,然后在第九个月感到后悔。这是一个针对在 18 个月后依然至关重要的决策框架。

ai-gateway
llm-infrastructure
build-vs-buy
architecture
·tian

智能体记忆是合规层面:你从未打算构建的记录管理系统

在智能体产品中,长期记忆并非仅仅是一项功能 —— 它是一个记录管理系统。从写入第一条数据的那天起,溯源、删除、审计和数据驻留义务便随之而来;在截止日期前临时修补这些功能的成本远高于在设计之初就构建它们。

ai-agents
compliance
memory
gdpr
+1
·tian

对话历史是信任边界,而非文本块

对话历史是多源反馈流,而非仅可追加的状态。为每一轮对话的来源打上标签,使用 HMAC 锚定用户回合,并将工具输出封装在信任区内 —— 否则你的 Agent 攻击面将随对话轮数线性增长。

insider
ai-security
agents
prompt-injection
+2
·tian

智能体内存驱逐:为什么 LRU 在模型升级中屹立不倒,而显著性评分却不行

基于显著性权重的内存驱逐在上线首日看起来像是提升了质量,但每次模型升级都会演变成一场迁移工程 —— 本文将探讨为什么 LRU 这种“无聊”的选择才是最终的赢家。

insider
agents
memory
llm-ops
+1
·tian

工具延迟尾部:为什么 p99 重塑了智能体架构而 p50 掩盖了问题

基于单个工具中位数构建的智能体延迟预算在生产环境中会悄无声息地失效:经过 7 个步骤后,尾部延迟开始占据主导地位,导致尽管单个工具的仪表盘显示为绿色,用户却仍在等待。本文将深入探讨为什么 p99 会重塑智能体架构,相关的工程规范是什么样的,以及哪些具有 40 年历史的分布式系统技术可以直接应用。

insider
ai-agents
latency
distributed-systems
+2
·tian

以单次对话成本为产品契约:当定价驱动架构设计时

AI 功能的定价是架构设计的输入,而非财务后的补救。为了不让工程师在午夜修补单位经济效益的漏洞,PRD 中应该包含哪些内容。

ai-engineering
product
pricing
unit-economics
+1
·tian

跨渠道记忆:当你的智能体遗忘邮件上下文时

多端 AI 智能体在聊天、邮件、短信和语音之间割裂了记忆,导致用户收到自相矛盾的回答。本文探讨统一身份、写穿式存储以及上下文隐私。

insider
ai-agents
memory
architecture
+1
显示第 13–24 篇,共 96 篇