资讯详情

OpenRig rig restore 恢复指南:如何按名重启多智能体团队,5 步让每个节点结果透明可查

📅 2026/9/30 5:12:15 | 华诺云谱 👁 阅读
OpenRig rig restore 恢复指南:如何按名重启多智能体团队,5 步让每个节点结果透明可查
OpenRig rig restore 恢复指南如何按名重启多智能体团队5 步让每个节点结果透明可查【免费下载链接】openrigMulti-agent harness that runs Claude Code and Codex together as one system项目地址: https://gitcode.com/GitHub_Trending/op/openrig刚重启过电脑昨天跑了一整晚的 Claude Code Codex 智能体团队就断了这正是OpenRig的rig restore命令要解决的问题。OpenRig 是一个把 Claude Code 和 Codex 组建成一个团队的多智能体multi-agent运行框架你先用 YAML 定义团队再一条命令启动整个 rig智能体编排组。而rig restore就是它的按名恢复能力从快照把整个团队重新拉起来并且逐节点汇报恢复结果——哪个节点成功、哪个失败、怎么补救一目了然。1 分钟理解OpenRig 里 restore 恢复的是什么在 OpenRig 中一个rig就是一个由多个座位seat/node组成的团队每个座位跑一个 AI 编码智能体Claude Code 或 Codex由 tmux 会话托管。你可以参考仓库自带的演示定义它用 YAML 描述了 lead、impl、qa、design、r1、r2 等成员及其协作关系demo/rig.yaml。恢复依赖两个核心概念快照snapshot团队在某一时刻的状态存档恢复的原料。恢复尝试restore attempt每次执行rig restore都会产生一个 attemptId你可以随时查询它的进度和结果。恢复不是一刀切守护进程daemon会逐个节点执行恢复最终给出restored/fresh/failed等状态并对未成功的节点附带可操作的补救建议recovery guidance。这就是每个节点结果透明可查的由来相关逻辑见 restore.ts。恢复前自检用 restore-check 确认能不能恢复盲目恢复是新手最常见的坑。OpenRig 提供了rig restore-check命令跨所有运行中的 rig 做一次恢复就绪体检输出红绿灯式的检查项rig restore-check # 体检所有 rig默认精简输出 rig restore-check --rig my-rig # 只查某一个 rig rig restore-check --full --json # 完整明细含每个座位它的输出会给出四类信息全部可读、可解释输出项含义VERDICT总体判定RESTORABLE/RESTORABLE_WITH_CAVEATS/NOT_RESTORABLE/UNKNOWNREADINESS就绪状态ready、ready_with_caveats、not_ready 等 5 类CONTINUITY连续性证明状态会话续接能力是否被验证过REPAIR STEPS修复步骤包每条带命令、原因并标注是否阻塞blocking退出码也约定得很清楚0 可恢复1 有红色阻塞项2 未知/探测失败——方便脚本化。命令实现见 restore-check.ts。 小技巧如果体检提示守护进程没在运行先执行rig daemon start再重试输出里会直接告诉你怎么修。五步完成按名恢复从快照到逐节点汇报下面是完整的rig restore恢复流程每步一条命令。第 1 步列出快照挑选恢复点rig snapshot list my-rig输出是一张表ID、Kind快照类型、Status、创建时间。快照的创建本身很简单例如在团队状态良好时手动打一个rig snapshot my-rig实现见 snapshot.ts。第 2 步按名执行恢复rig restore snapshotId --rig my-rig这里--rig指定的就是你在 YAML 里给团队起的名字——所谓按名恢复指的就是按 rig 名称 快照 ID精确定位要恢复的团队。命令成功后会打印恢复尝试编号Restore attempt id: 12 Status: started Daemon is restoring per-node in the background; follow progress with rig ps --nodes or rig restore-check.第 3 步用rig ps --nodes跟踪逐节点进度恢复在守护进程后台逐节点进行rig ps --nodes的每个节点行都带有restoreOutcome恢复结果字段随时刷新都能看到当前状态ps.ts。第 4 步查询某次恢复尝试的回执rig restore status attemptId --rig my-rig它会告诉你当时选的是哪个快照、为什么选它rationale、初始判定original verdict与当前意图集判定current intended-set verdict以及预期 N 个节点 / 排除历史节点 N 个 / 未解决 N 个的明细。这是核对恢复结果最权威的一手数据。第 5 步处理未成功节点对fresh或failed的节点恢复命令会直接打印Recovery guidance补救建议包括该节点的会话名、tmux 接入命令、工作目录、可复制执行的补救命令和注意事项。照着做即可把个别节点补到位而不必重跑整个团队。也可以在图形界面上验证打开rig ui后在左侧 Explorer 选中你的 rig拓扑图里每个节点都标有运行时CLAUDE / CODEX与状态点点击节点的 CMUX 按钮还能直接跳进对应终端。读懂逐节点结果透明在哪一次恢复结束后rig restore会按节点逐行打印结果格式非常克制lead: restored impl: restored qa: failed — session not found而真正透明的部分在恢复回执与节点明细里每个节点最多告诉你这些事实定义见 restore.tsstatus恢复状态restored / fresh / failed …error失败原因仅 failed 时出现canonicalSessionName规范会话名方便你手工定位tmuxAttachCommand一键接入该节点终端的命令resumeCommand/recoveryGuidance续接命令与补救建议整体团队则汇总为rigResultrestored/partially_restored/failed/not_attempted。只要出现部分失败或整体失败命令退出码就是 1——脚本和 CI 都能可靠地感知。新手避坑常见报错与处理方式恢复被事前校验拦住时OpenRig 会明确告诉你尚未开始恢复并逐条列出阻塞项blocker与修复建议remediation场景你会看到怎么处理快照或 rig 不存在404Snapshot x or rig y not foundrig snapshot list --rig name核对 IDrig 还在运行409Restore conflict ... rig may still be running先rig down rigId再恢复快照不可用409Restore refused: the selected snapshot is not restore-usable换一个快照事前校验失败Restore blocked 逐条 blocker 与 remediation按提示逐条修复后重试另外注意一个诚实的细节Ctrl-C 中断的只是 CLI 客户端守护进程侧的恢复仍会继续。OpenRig 会直接提示你用rig ps --nodes或rig restore-check继续跟踪而不是假装一切停止了restore.ts。⚠️ 还有一个新手容易踩的坑如果环境变量里泄漏了指向测试夹具的OPENRIG_HOMErestore-check不会误报宿主机宕机而是会诚实地报告这是泄漏的测试夹具真实内核未被探测并给出清除环境变量的修复步骤restore-check.ts。常见问题 FAQQ恢复能完全还原智能体的对话上下文吗A要看快照里保存了什么。restore-check的 CONTINUITY 一栏会如实标注哪些续接能力如 provider 会话续接、上下文窗口保留已被验证、哪些未验证——它不做虚假承诺。Q部分节点失败要整个重跑吗A不用。每个失败节点都有独立的 recovery guidance 与接入命令单独补齐即可其余已restored的节点保持原样。Q恢复前必须做什么A跑一次rig restore-check。有红色阻塞项就先修输出里附了修复命令包全绿或仅有黄色提示时再执行rig restore。Q去哪里看更多示例A仓库的 demo/README.md 提供了可直接运行的演示 rig 与脚本README.md 覆盖安装与首次启动需要 Node.js 20/22/24 和 tmux。小结OpenRig 的rig restore把重启后恢复智能体团队这件烦心事变成了一条可预期、可验证的流水线rig snapshot list—— 选对恢复点rig restore snapshotId --rig rigName—— 按名发起恢复rig ps --nodes—— 实时跟踪逐节点进度rig restore status attemptId—— 核对权威回执Recovery guidance —— 单独补救失败节点配合恢复前的rig restore-check体检整个团队在重启后的状态恢复就做到了每一步透明、每个节点可查——这正是 OpenRig 作为多智能体编排框架在可靠性上的底气所在。【免费下载链接】openrigMulti-agent harness that runs Claude Code and Codex together as one system项目地址: https://gitcode.com/GitHub_Trending/op/openrig创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。

↑