前置课 · 第二部分 Agent · A15

人机交互与信任:agent UX 的四道必答题

20 min · 先讲清 agent UX 和普通软件 UX 的本质区别,再逐题给答案

🎒 预备知识:完成上一课「A14 规划与长任务」(零基础入口:第 0 课)

本课唯一结论:agent 的用户体验有四个普通软件没有的问题—— 长时延要过程反馈、不确定要校准信任、不可逆要少而重的确认、内部机器要不可见。 每道题 Easel 都给了参考答案,而且答案几乎都在工程层不在模型层。

一、基础:agent UX 和普通软件 UX 差在哪

普通软件的交互契约是确定性的即时交换:点按钮 → 百毫秒内出结果,结果永远一样。 用户不需要"信任"计算器,只需要会用它。agent 改写了这个契约的三个前提:

契约维度普通软件agentUX 必答题
时延毫秒级一轮可能 20 分钟怎么让人等得安心?→ 过程反馈
确定性同样的输入同样输出非确定、可能错(L3/L5/A13)怎么让人知道该信几分?→ 信任校准
后果操作可撤销发布/付费不可逆哪些点必须拦人?→ 确认设计
决策权用户逐步操作用户委托 agent 自主它自作主张的边界在哪?→ 问询设计

一句话概括:普通软件 UX 管理操作,agent UX 管理委托关系—— 用户把决策权部分交给了机器,UX 的使命是让这份委托知情、可控、可校准。

二、第一题:长时延 → 过程反馈的梯度

一次 turn 可能跑 20 分钟,用户盯着空白界面 = 产品死亡。反馈不是"加个 loading", 是分梯度的信息流。Easel 的梯度(正课 L10):

秒级   "⏳ 已收到,正在唤醒 agent…"      ← 请求一进来立刻发,不等模型
流级   token 逐个渲染(thinking 可见)    ← 让人看到"在干活"
步骤级 "🔧 调用工具后继续推理(第 2 步)" ← 每次工具调用发 activity 事件
轮级   turn_end → 结果呈现

设计原则:任何时刻界面都有"正在发生什么"的答案。最贵的是第一秒的确认感 ("已收到"不花钱,缺失它最伤——用户不知道点了有没有用),最有效的是步骤级 (用户能自己判断"卡住了还是正常慢",这比任何进度条都安抚人心)。

三、第二题:决策权 → 问询设计

AGENTS.md 规则④"查现有信息再提问"是 agent UX 的第一定律:能查到的别问—— 问用户要账号名而登录态就在磁盘上,是最败好感的行为(等于告诉用户"我什么都没查")。 真要问的时候三条纪律:给选项而不是开放题(Easel 的 ask_user 选项卡:点选优于打字, 用户委托 agent 就是不想自己做开放决策);一次问全(三个问题挤在一次问询里, 好过三连打断);带推荐默认值("建议选 B,因为你的画像偏技术向"—— 推荐附理由,用户可以盲选也可以改)。

四、第三题:不可逆 → 确认设计(少而重)

和 A12/A13 呼应但站在 UX 侧:确认点只守不可逆操作(付费、发布、删除), 可逆操作交给闸门和留痕。确认界面要给决策所需的最小信息集—— Easel 发布前的 dry-run 预览是范本:列出最终标题/正文/媒体清单让用户看"将要发生什么", 而不是问"确定吗?"。道理:用户要判断的是内容对不对, 不是要不要点一个按钮。警报疲劳是确认机制的死敌:什么都确认的 agent, 两周后用户就闭着眼点"是"——确认机制名存实亡。

五、第四题:非确定 → 信任校准

用户对 agent 的信任必须与实际可靠度对齐——高估导致灾难 ("它说发成功了"结果没有),低估导致弃用("这玩意不可靠"再也不用)。校准三手段: ① 证据呈现("已发布 ✓ 回读创作者中心确认"——readback 的 verified 就是给用户看的证据, 而非 agent 的自我报告);② 不确定说不确定(unverified 如实显示,不粉饰成成功—— 一次性粉饰换来的信任,一次事故连本带利吐出来);③ 失败带原因和出路 (Easel 人格文件 SOUL.md——给 agent 写人格与沟通风格的常驻文件,正课 L04 精读——里写着:"实话实说卡在哪,再给个能走的替代路子")。SOUL.md 里那句 "务实、诚实:先尽力做,做不到或不确定才直说,不粉饰、不编数据"——是人格层写下的 UX 契约。

六、内部机器不可见

内部机制不该暴露给用户:Easel 的 TURN_REMINDER 每轮注入但对用户不可见(前端只显示用户原文); 对话附件的内部路径不复述;对外发布的内容绝不带工具痕迹(A12 出站闸门的 UX 侧面)。 原则:用户要的是结果和过程感,不是管道日志——把 ANSI 色码和 traceback 直接怼给用户, 是工程师审美不是产品。

七、常见踩坑

坑 1:无过程反馈。同步等待 20 分钟白屏——哪怕加一行"正在执行第 3/8 步"。 坑 2:开放题问询。"你想怎么做?"——用户请 agent 就是不想自己做决定; 给 2–3 个带推荐的选项。坑 3:把不确定说成确定。为了一次性讨好用户, 把 unverified 说成"发布成功"——信任崩塌只要一次。

八、检索练习

九、出口检验

给"自动订机票 agent"设计交互方案:四个环节(搜票→选票→支付→出票确认) 各配什么反馈/问询/确认/证据呈现?哪个环节必须人确认、其余怎么做到少而重? 发到对话里我批改。