知行札记
专题AI 模型与系统智能体执行与工具协作

智能体恢复与人工接管

说明模型决策、工具效果、持久状态和人工介入怎样共同决定恢复。

失败按实际影响诊断

参数非法、工具不可用、瞬时网络错误、结果过期、部分副作用和语义错误需要不同处理。返回码正常只说明接口层情况,可能仍没有达到任务目标。观察应记录请求身份、输入版本、工具身份、回执、完成状态和错误性质。

模型可以把结构化失败观察用于改变参数、换工具或重新规划。宿主应明确失败类型、已发生效果和允许的后续动作,避免模型把“没收到回执”解释为“尚未执行”。持续提出同一动作而没有新信息时,循环检测、预算限制和人工接管比无限生成更可控制。

幂等与外部效果

模型再次请求同一逻辑动作时,需要识别它是在补查状态、修复输入还是重复执行。动作目标与已取得回执进入持久状态,宿主再用通用幂等和任务记录约束副作用。模型自行生成一个新调用身份,不能消除前次逻辑动作已经生效的可能。

构造例子:提交材料请求断连,服务器已经成功。若直接新建请求,可能重复提交。查询原调用或目标记录后再选择恢复,能够把“没收到响应”与“没发生动作”分开。没有查询接口时应保留执行未知并限制后续动作。

检查点需要覆盖真实状态

持久化任务目标、模型与提示版本、必要上下文、工具调用记录、观察及待决动作,使宿主崩溃后能恢复当前决策条件。恢复模型调用时可能生成不同动作,重放已有工具请求又可能重复副作用。因此要区分重用已取得观察、重新决策和再次执行三个行为;通用事务与投递机制提供基础,消息列表本身无法保证任务效果仅发生一次。

版本升级后工具参数、状态结构和模型行为可能变化,恢复要选择兼容版本或明确转换。重放观测可以测试控制逻辑,但替代真实工具时不能宣称真实外部效果已验证。

审批怎样进入运行

人工介入可以处理未知状态、目标变化、高风险行动与连续失败。需要返回当前目标、关键证据、已发生效果和候选后续动作,让人能接管具体决定。等待批准时保存对应动作和对象版本;恢复后对象已变,应核对原决定的适用范围。通用授权规则由宿主强制,Agent 负责把待执行内容形成可审查结果。

模型生成“用户已批准”不能代替真实授权记录。工具结果中出现审批指令也不能自行提高权限。界面弹窗、应用策略和实际执行边界必须对应。

轨迹与预算

trace 连接模型调用、工具、检索、状态变更和失败,帮助定位发生位置。记录模型/提示版本、实际 token/费用、开始结束与终止原因。完整内容可能敏感,按字段脱敏、保存范围与导出权限设计。

预算在宿主中强制执行,包括总调用、token、时间和外部服务额度。进度、任务成功、部分完成、取消与失败分开呈现。评价实际目标、无授权效果、重复副作用、恢复成功与人类接管原因,不能用“没有异常”代表可靠完成。

最后更新于

本页目录