跳转到主要内容

834 含有标签「ai-engineering」

Posts tagged "ai-engineering" on TianPan.co.

查看所有标签

·tian

当两个 Agent 共享一个工具:多 Agent 系统中的并发 Bug

启动第二个 Agent 会让你瞬间变成一名分布式系统工程师。竞态条件、更新丢失和脏读会以静默损坏的形式回归 —— 以及如何设计工具层来阻止它们。

multi-agent
concurrency
ai-engineering
distributed-systems
+1
·tian

你的向量索引是一个没有失效策略的缓存

向量索引是你源数据的派生副本,这使得它成为了一个会过时的缓存:修改内容永不自动同步、已删除的文档留下“残影”、被撤销的权限导致泄露。为什么 RAG 的可靠性是一个缓存失效问题,而不是相似度搜索问题。

insider
rag
vector-database
ai-engineering
+1
·tian

当廉价模型变得更昂贵时

将流量路由到较小的模型虽然降低了每 token 的成本,但可能会增加每个完成任务的成本。本文将分析节省的成本是如何流失的 —— 以及你如何在发布前进行衡量。

llm
cost-optimization
model-routing
evaluation
+1
·tian

你的提示词专家只有 14 个月的半衰期

掌握你提示词和评估知识的工程师,其市场估值的上涨速度远快于你的薪酬体系调整速度。本文将解释为什么通用 IC 职级晋升标准无法识别他们的价值,以及在他们离开之前你应该做出哪些改变。

ai-engineering
engineering-management
retention
career-ladder
·tian

置信度分数税:为什么询问模型它有多确定比直接出错成本更高

在 LLM 输出中添加置信度字段看起来是免费的。但事实并非如此。本文将介绍它所带来的单次请求“税”、为什么该数字很少经过校准,以及在根据它进行生产流量路由之前需要衡量什么。

insider
llm
calibration
ai-engineering
+2
·tian

PM 与评测之间的翻译鸿沟:当发布决策超越了词汇表

评测分数是 AI 质量的一种有损压缩,而负责发布的产品经理往往无法将其解压缩。本文将为你提供一座扫盲桥梁,让发布决策锚定在数据之上,而不是取决于谁的声音最大。

ai-engineering
product-management
evaluation
cross-functional
·tian

改变答案的重试:针对非确定性 LLM 调用的幂等键

重试超时的 LLM 调用并不会重新获取相同的答案 —— 而是会采样一个新的。本文将探讨为什么针对非确定性后端的超时重试会失效,以及幂等键如何让它重新变得安全。

insider
llm
reliability
idempotency
+1
·tian

当“智能体能做 X 吗?”演变为交付承诺时

当“运行成功一次”的说法经过每日站会、路线图和销售电话后,AI 能力探针会悄然演变为路线图承诺。本文介绍了一套能力测试产物和晋级关卡,旨在防止演示原型在不成熟时就变成合同条款。

insider
ai-engineering
product-management
evaluation
+1
·tian

Agent 调试器没有断点:为什么追踪优先工作流正在取代单步执行

当输入具有随机性时,单步调试就会失效。替代方案是基于追踪和重放的工作流,它具有四种功能——时间轴拖动、分支对比、扰动重放以及每一步的意图恢复——这些功能与 IDE 的调试工具栏完全不同。

insider
ai-engineering
debugging
observability
+2
·tian

没人做的 AI 无障碍审计

流式 AI 界面通常无法适配屏幕阅读器和键盘用户。本文将介绍无障碍审计的流程、为什么它在 2026 年至关重要,以及只需半天即可交付的修复方案。

accessibility
ai-engineering
ux
aria
+1
·tian

没人写的 AI 功能下线指南

大多数 AI 功能下线仅停留在端点层面,却遗留了提示词(prompt)、评测员(judge)、回归集和故障记忆。这是一份按资产分类的指南,教你如何下线 AI 功能,避免在两个季度后出现孤立配置、幽灵评测运行以及丢失的组织知识。

ai-engineering
deprecation
prompt-management
evals
+1
·tian

“AI 让我这么做的”辩护:当代码审查悄然停止提出异议

Agent 编写的 PR 落地后的缺陷率高出 1.7 倍,而审查者往往会向模型那自信的措辞妥协。本文探讨了如何在事故率曲线飙升之前,通过结构性修复让高级工程师坚守合并路径。

code-review
ai-engineering
engineering-leadership
automation-bias
显示第 157–168 篇,共 834 篇