·tian
聊天并非最佳界面:为什么你的智能体不应只是一个文本框
大多数打开聊天窗口的人从不发送消息。聊天是一种不错的输入原语,但作为运行环境却很糟糕 —— 本文将探讨何时该采用结构化 UI、生成式 UI 和环境智能体。
ai-agents
ux
product-design
generative-ui
+1·tian
重提率:你的评估流水线从未提取出的失败信号
在会话中重复同一个问题的用户是在告诉你之前的回答失败了——但回合级评估和会话结束时的 CSAT 都会忽略这一点。本文将介绍如何将重提率作为核心指标进行检测。
insider
llm-evaluation
conversational-ai
metrics
+1·tian
能真正收敛的 AI 澄清对话:面向单轮解决的设计方案
多轮澄清循环会让用户感到沮丧,并降低 LLM 的性能。本文介绍了一个设计框架,旨在通过信息增益优先级、置信度阈值门控和架构约束,让 AI 系统在单轮对话中解决歧义。
ai-agents
conversational-ai
ux
nlp
·tian
面试模式与任务模式:你的智能体不断打破的无形契约
大多数关于 “问得太多” 和 “问得不够” 的抱怨其实都是同一个 bug —— 你的智能体选错了契约。本文将介绍如何识别并解决这一问题。
agents
ux
conversational-ai
prompt-engineering