跳到主要内容

1 篇博文 含有标签「platform-strategy」

查看所有标签

自研还是采购的界限已然改变:当供应商原语吞噬你的基础设施时,如何抉择 AI 功能

· 阅读需 11 分钟
Tian Pan
Software Engineer

18 个月前,“我们构建了自己的检索流水线”在架构评审中还是一个非常合理的说法。你拥有分块策略、经过基准测试的嵌入模型、调优过的向量数据库、重排序器,以及一个由 3 名工程师耗时一个季度才搞定的上下文填充启发式算法。那一套技术栈曾是真正的差异化基础设施。而今天,同样的能力只需一次托管的工具调用:将文件上传到向量数据库,将其附加到请求中,供应商就会完成解析、分块、嵌入、存储、检索和重排序——所有这些都隐藏在一个 API 背后。曾经需要 3 名工程师开发一个季度的成果,现在只是一个配置对象。

这就是目前构建 AI 产品令人不安的模式。自建与外购之间的界限并非固定,它在移动,而且只向一个方向移动。每隔几个月,模型供应商就会发布一个原生功能(primitive),蚕食掉你曾经拥有的一个层级:记忆、检索、结构化输出、工具路由,甚至是多步编排。上个季度还让你引以为傲的基础设施,这个季度就成了竞争对手可以免费获得的东西,而且默认配置更好,延迟底线更低,因为它就运行在供应商自己的数据中心内部。

一种本能反应是将其视为需要防范的威胁。但这种思维框架是错误的。供应商吸收通用基础设施实际上是在帮你——它帮你删除了你本就不想要的维护工作。真正的问题在于,你选择构建的东西是位于不断上升的水位线之上还是之下。大多数团队从未明确做出这个决策。他们为了演示需求构建了一切,一年后才发现 70% 的代码库是在重新实现供应商现在提供的原生功能,而那 30% 真正具有防御性的部分反而因为缺乏关注而枯萎。