跳转到主要内容

博客

来自AI智能体经济的洞见、分析与更新。 按标签浏览.

·tian

你的 AI 功能没有 DRI:为什么它在没有季度目标负责人的情况下处于漂流状态

AI 功能横跨产品、工程、研究和 FinOps,最终却落得无人负责。这里提供了一种组织模式,可以防止它们在季度评估之间处于漂流状态。

insider
ai-product-management
engineering-leadership
dri
+2
·tian

你的 AI 功能可靠性受限于无人负责的上游 ETL 流水线

大多数 AI 质量退化实际上是伪装成 AI 问题的上游数据问题。数据契约、血缘关系和结对轮值机制能将隐形的 ETL 接缝转化为一等公民工件。

insider
data-engineering
etl
ai-reliability
+2
·tian

AI 功能观察期:为什么两周的灰度发布会错过真正关键的问题

两周的灰度发布能捕捉到系统崩溃,但 AI 功能的失败通常表现为趋势性变化。本文深入探讨了观察期、慢性失败指标以及保持足够长有效期的回滚路径的实际案例。

ai-engineering
llmops
deployment
observability
·tian

你的律师还没学会要求的 AI 采购条款

标准 SaaS 模板缺少 AI 特有的条款——如训练数据排除、模型锁定、输出赔偿和审计权——这些条款决定了你的供应商关系能否在下一次模型更迭中幸存。

insider
ai-procurement
vendor-contracts
engineering-leadership
+1
·tian

自主性开关:为何智能体模式应是用户设置而非模型设置

在你的智能体产品中硬编码单一的自主性级别会疏远一半的用户。相反,你应该交付单项任务自主性阶梯、成比例的撤销机制以及学习型默认设置。

insider
ai-agents
ux
product-design
+1
·tian

AI 功能的 Bug Bash:分布采样,而非猎捕缺陷

为什么传统的 Bug Bash 流程在具有随机性的 AI 功能上会失效,以及如何将其重新设计为一种产生评估(evals)而非轶闻的采样过程。

insider
ai-engineering
qa
evals
+2
·tian

闭环升级漏洞:当你的专精型智能体陷入循环路由

两个专精型智能体之间来回传递同一个对话,可能会在任何人察觉之前悄无声息地烧掉五万美元的推理成本。请将移交(handoffs)视为一种路由协议,而非领域抽象。

insider
ai-engineering
multi-agent
agents
+2
·tian

你的编程智能体是一个从不阅读测试的初级工程师

编程智能体的生产力源于模型周边的脚手架 —— 这些脚手架正是团队原本就为初级工程师准备的。本文将探讨需要记录哪些内容,以及为什么智能体最终会迫使你这么做。

ai-agents
developer-productivity
code-review
engineering-culture
·tian

群体感知微调:当单一模型不够,而针对每个用户的微调又负担过重时

大多数微调都处于两个极端:要么一个模型服务所有人,要么每个客户一个模型。中间地带 —— 三到八个针对特定群体的感知微调 —— 才是杠杆效应所在。

insider
fine-tuning
llm-ops
evaluation
+1
·tian

生产级智能体的 90 秒冷启动:当 LLM 不再是瓶颈时

生产级智能体在模型运行之前,通常需要 60 到 120 秒进行冷启动。解决方案不在于更快的 TTFT — 而在于将冷启动延迟视为一级 SLO,并通过预热池、快照/恢复、工具延迟加载以及 CI 门禁来进行优化。

insider
ai-agents
latency
infrastructure
+2
·tian

对话重置按钮:在不丢失 Artifacts 的情况下重新开始的 UX 模式

大多数聊天产品将对话历史记录和 Artifacts 绑定在同一个生命周期中,因此点击重置会连同受污染的上下文一起销毁用户的工作。将两者解耦可以让重置变成一种安全、可恢复的操作。

ai-ux
chat-design
agent-architecture
product-design
·tian

你的 CS 团队构建了一个影子 Agent。这就是你的路线图。

你的 CS 团队未经授权的 Slack 机器人并非安全事故。它是你的工程团队今年将获得的最准确的 AI 路线图信号 —— 以及它已经回答的四个产品问题。

insider
shadow-ai
ai-strategy
platform-engineering
+1
显示第 913–924 篇,共 2312 篇