跳转到主要内容

834 含有标签「ai-engineering」

Posts tagged "ai-engineering" on TianPan.co.

查看所有标签

·tian

为什么回滚 AI 功能比回滚代码更难

技术层面的代码回滚可以修复系统,但无法修复用户。本文将探讨为什么 AI 行为的改变具有代码变更所不具备的“粘性”,以及如何在不破坏信任的前提下,让你重新获取设计空间的模式。

ai-engineering
mlops
deployment
product-management
·tian

没人愿意写的 AI 事故复盘:四层诊断框架

当 AI 功能引发生产事故时,标准的复盘流程往往失效。本文提出一套四层诊断框架——模型层、数据层、集成层、基础设施层——帮助团队在不陷入责任推诿的情况下明确责任归属。

insider
ai-engineering
mlops
incident-response
+1
·tian

AI 功能的沉默退出者:如何检测用户的无声不信任

大多数 AI 功能的失败在聚合指标中是不可见的。用户不会提交工单,不会禁用功能——他们只是悄悄地绕开它。本文介绍如何通过行为信号在留存曲线预警前检测用户的无声信任流失。

insider
ai-engineering
product-metrics
user-trust
+1
·tian

在不触发法律红线的前提下,用生产数据训练你的 AI

用于 AI 模型改进的行为遥测数据如何与 GDPR 和 CCPA 产生冲突——以及联邦学习、差分隐私和同意架构等模式如何在不触发法律风险的前提下维持反馈闭环。

insider
gdpr
privacy
ai-engineering
+2
·tian

API 文档即可靠性基础设施:文档如何决定智能体的成功率

当 AI 智能体通过工具调用(tool calling)消费你的 API 时,文档质量就成了直接的可靠性变量。模糊的参数和缺失的错误语义会导致可衡量的失败率,这是任何提示词优化都无法修复的。

insider
ai-engineering
agents
api-design
+1
·tian

大多数团队在无意中做出的上下文格式选择:JSON vs Markdown vs 纯文本

在 LLM 上下文中选择 JSON、Markdown 还是纯文本并非风格偏好,它决定了推理模式、准确性和成本。本文将介绍如何深思熟虑地做出这一决策。

llm
agents
prompt-engineering
ai-engineering
·tian

AI 代码反馈循环:今日生成的代码如何训练明日的模型

随着AI生成的代码涌入生产代码库,它正在成为下一代模型的训练数据。这一反馈循环已经可以量化——而其失效模式足够隐蔽,以至于可能在不被察觉的情况下悄然到来。

ai-engineering
llm
code-quality
training-data
+1
·tian

为什么 AI 功能会让 A/B 测试失效(以及不会撒谎的因果推断方法)

标准 A/B 测试在应用于 AI 功能时会违反其核心假设。本文介绍如何使用能够处理污染、溢出效应和长期行为变化的因果推断方法来衡量真实影响。

ai-engineering
experimentation
causal-inference
product
·tian

跨用户一致性问题:当你的 AI 对同一问题给出不同答案时

当同事问了同一个问题却得到不同的答案,企业 AI 工具会悄悄侵蚀信任。本文解释了为何 temperature=0 无法解决问题,以及真正有效的工程模式。

insider
llm
enterprise-ai
reliability
+2
·tian

RAG 中的领域专家瓶颈:为什么知识策展会导致生产环境 AI 崩溃

构建一个 RAG 管道只需几天。但在第一年里,维护支撑它的知识库才是让团队崩溃的原因。领域专家策展是生产环境 RAG 中真正的“最后一公里”难题。

insider
rag
ai-engineering
knowledge-management
+1
·tian

集成 vs. 辩论:两种多模型验证范式及其失效场景

运行更多模型并不保证更好的答案。当前沿 LLM 共享训练数据时,它们的错误相关性达到 r = 0.77 —— 使得三个模型实际上仅相当于 1.3 个独立模型。本文将深入分析集成与辩论验证、它们各自的失效模式,以及当两种方法都失效时的情况。

insider
multi-agent
llm
evaluation
+1
·tian

解释债务:为什么用户有权知道你的AI做了什么

团队花费数月优化AI输出质量,却在没有解释层的情况下上线——本文分析了这一选择所积累的代价,以及能够解决问题的轻量级归因模式、置信度信号和申诉机制。

insider
ai-engineering
explainability
ux
+2
显示第 253–264 篇,共 834 篇