AI 点下按钮之前:把人工确认设计成真正有用的一步
AI 能替你整理信息,也能调用工具改变外部世界。两种能力放在同一条流程里,很容易把“它理解了我的意思”误当作“我批准了这个具体动作”。人工确认真正有价值的地方,是让人看清即将发生的变化,并且让系统执行的内容与看到的内容一致。
AI生成概念配图
确认应该发生在动作前
OpenAI Agents SDK 的官方文档提供了工具审批流程:需要审核的调用可以暂停,把工具名称和参数交给人批准或拒绝,再恢复运行。这是实现机制,不是自动生成的业务规则;哪些操作必须停下来,仍需要产品开发者与使用者事先定义。
实践建议:把一句话换成审核卡
“是否继续处理订单”信息太少。继续究竟指查询物流、取消订单,还是向商家发送消息?下面是作者设计的虚构示例,它把一次取消动作拆成可以核对的内容。订单号和金额仅用于演示。
准备执行:取消订单 DEMO-218 目标:示例商店,桌面支架一件 影响:取消后不再发货 页面当前显示:退款 89 元,无取消费 动作范围:仅此订单,不取消其他订单 请选择:批准这一次 / 拒绝 / 返回修改
真实界面应展示实际查到的条款;不知道退款金额时,就写“尚未确认”,而不是沿用模型猜测。收件人、文件名、付款金额、公开可见范围等,也都属于用户做决定所需的信息,不能藏在一长串工具参数里。
批准绑定具体参数,而不是一句泛泛的同意
假设用户确认后,系统重新查询发现订单状态已经改变,需要额外取消费。原批准就不应继续套用。同样,原来批准发给一位同事,执行时新增了抄送人,也需要重新检查授权范围。作者建议给审核记录保存动作、目标、关键参数和版本;执行前对比,实质变化时重新确认。
审核人看得见差异:哪些文字会发出,哪些文件会被修改。
审核记录有范围:批准一次、批准这批,还是明确约定的持续规则。
审核结果有时效:长时间搁置后,重新确认页面状态与关键条件。
拒绝能真正停止动作:不能把拒绝解释成换个工具再试。
不要让每个点击都变成疲劳测试
如果只是在已授权范围里读取普通公开资料,频繁弹窗可能让人习惯性点同意。可以根据影响分层:整理草稿先预览,修改可恢复文件保留差异,对外发送、删除、支付等动作提高审核强度。具体要求必须服从所在平台、组织和账户的规则,不能用这套建议削弱已有的强制确认。
还有一个常被忽略的时刻是失败重试。界面超时不代表动作没有成功。重新发送通知或重复提交订单前,应先查执行记录与目标状态;否则一个批准可能变成两次影响。对于系统开发者,建议给可重试动作配置去重标识,保持一次意图对应一次结果。
确认后也要给结果
完成时反馈实际对象、结果与可用的撤销路径;失败时区分“未执行”“结果未知”和“已执行但回执失败”。这样用户才能判断是否需要介入。一个好的审核步骤既能阻止错误,也能减少事后猜测。本文的审核卡和分层方法均为作者的设计建议,不是 SDK 自动提供的完整安全保障。


