Multica 任务执行日志的失败原因码怎么读懂并手动重试

Multica 任务执行日志的失败原因码怎么读懂并手动重试 Multica 任务执行日志的失败原因码怎么读懂并手动重试【免费下载链接】multicaMake humans and AI agents work as one team — open-source and self-hostable.项目地址: https://gitcode.com/GitHub_Trending/mu/multica当一个 agent runMultica 中一次 agent 执行记录失败后issue 侧边栏的执行日志Execution log里会给出一个失败原因码例如runtime_offline或agent_error.provider_quota_limit。这篇文档对应的任务是看懂这个码属于哪一类、平台会不会自动重试、需要先修什么以及如何在确认后手动重试让工作继续。适用环境是 Multica 的 Web 界面或 CLI失败码说明与重试规则来自 Runs 文档。在哪里看执行日志和失败码issue 右侧边栏的Execution log部分列出该 issue 产生的每一次 run——没有单独的页面或标签页。该部分默认展开进行中的 run 固定在最上方已结束的历史记录折叠在Show past runs (N)后面。每行显示触发来源、执行的 agent、状态和时间页面保持打开时日志通过实时连接更新不需要手动刷新。如果在窄屏上看不到该部分用 issue 头部右侧的面板按钮打开侧边栏。两个查看细节点击某行的View transcript可以看到 agent 的消息、工具调用和错误输出。进行中的 run 在弹窗保持打开时会持续流式更新Newest first开关可翻转事件顺序。排查environment_prepare_failed、process_failure、unknown这类需要看原始错误的码时就是在这里读 raw error。命令行里对应multica issue runs issue-id查看 run 历史--full-id可显示完整 idmultica issue run-messages task-id查看单次 run 的消息支持--since、--issue命令清单见 CLI 参考。失败原因码分两大类执行日志和用量统计中显示的失败原因分两组无前缀的码由平台记录agent_error.*码是从 AI 编码工具自身返回的错误归类出来的。平台侧无前缀原因码含义文档建议的处理runtime_offlinerun 执行期间 runtime 掉线恢复 runtime 后重试queued_expiredruntime 停止心跳超过重连宽限期且该 run 排队时间也达到同样时长确认 runtime 在线后重试runtime_recoverydaemon 重启后回收了一个被中断的 run直接重试environment_prepare_faileddaemon 无法为该 run 准备执行环境——工作目录或写入其中的本地 runtime 配置读原始错误确认是哪一步失败然后检查那台机器磁盘空间、权限、仍被占用的目录、AI 编码工具的本地配置cancelled手动停止或随归档/删除一起取消无需处理timeout超过 daemon 配置的执行时长上限缩小 issue 范围或调整 daemon 的agent_timeoutiteration_limit达到单次 run 的迭代上限缩小 issue 范围agent_blockedagent 报告无法继续提供它评论中要求的东西api_invalid_request平台 API 拒绝了无效请求重试再次出现则报告问题codex_semantic_inactivityCodex 长时间没有产生有意义输出被判定卡死重试或调整 Codex 无活动超时工具侧agent_error.*下表省略前缀原因码含义文档建议的处理provider_auth_or_access模型提供方认证失败或访问被拒401/403在该 AI 编码工具中重新登录或检查 API keyprovider_quota_limit配额或余额耗尽402充值或切换账号provider_capacity_or_rate_limit被限流或容量不足429/529稍后重试provider_server_error模型提供方服务端错误5xx稍后重试provider_network连接模型提供方的网络故障会自动重试持续出现则检查执行机器的网络model_not_found_or_unavailable模型不存在或当前不可用在 agent 设置里换一个可用模型context_overflow上下文超过模型窗口缩小 issue 范围或减少输入missing_config缺少 API key 等必需配置补上 agent 的环境变量或工具配置runtime_missing_executable找不到 AI 编码工具的可执行文件重装该工具见 安装 AI 编码工具runtime_version_unsupportedAI 编码工具版本过旧升级工具process_failure工具进程异常退出查看 run 记录定位原因后重试empty_or_unparseable_output工具没有输出或输出无法解析重试反复出现则检查工具安装agent_timeout工具长时间无响应后被终止重试或缩小 issue 范围unknown未归类的失败查看 run 记录中的原始错误agent 自身返回的错误一般不会被自动重试凭证过期、配额耗尽、配置错误、模型无法完成请求这些都要求先修好原因再手动重试。哪些失败会自动重试自动重试只覆盖瞬态故障且只适用于挂在 issue 或 chat 上的 runAutopilot 的run only模式除外它为避免与下一次定时 run 重叠而不自动重试可自动重试的失败原因尝试上限Runtime 掉线默认 2 次首次执行 1 次重试daemon 重启后回收默认 2 次平台判定的执行超时默认 2 次Codex 卡死无有效输出默认 2 次Skill bundle 下载失败默认 2 次此时 agent 进程尚未启动已下载的 bundle 来自本地缓存工具网络中断最多 3 次最后一次在约 5 秒延迟后开始其余原因认证、配额、配置、模型等一律不会自动重试先修原因再手动重试。另外两个边界queued状态的 run 失败后同样不自动重试当一个 issue 没有其他活动 run、也没有新重试等待执行时一次失败会把in_progress的 issue 移回todo。还有一类情况根本不会创建 run如果系统在触发前就已知目标 runtime 离线某些即时操作会直接报告现在无法启动而不是创建一条没有任何 runtime 能领取的 run。手动重试的两种做法从执行日志点重试UI在执行日志对应行上点重试按钮。注意这条重试调用的是当时处理该 run 的 agent——即使 issue 后来改派了别人重试也不会切换到新负责人。重试对现场文件的处理规则只要可能保留上一次 run 已写入本地目录的文件如果原会话仍然安全、且同一个 runtime 领取了这次重试会继续原会话会污染会话的错误如 context overflow、invalid request会在原工作目录之上开一个新会话如果原目录已不存在则使用全新的工作目录。用 CLI 重新入队multica issue rerun issue-idissue-id换成要重跑的 issue 的 id。这种形式不指向某条具体的历史 run因此使用 issue 当前的 agent 负责人并从全新的会话和工作目录开始。和 UI 重试的区别就在这一点UI 重试绑定原 agent、尽量延续原会话与目录rerun则按当前指派全新一把。先修原因再重试对必须先修原因的码文档给出的对应动作如下。runtime_offline/queued_expired恢复 runtime背景机制daemon 每 15 秒发一次心跳失去心跳的 runtime 最多约 3 分钟内被标记离线。Daemon 与运行时文档给出离线 runtime 的排查顺序运行multica daemon status确认 daemon 在跑运行multica daemon logs -f找登录、网络或工具检测错误在同一环境运行command -v tool-commandtool-command换成实际工具命令如claude确认 daemon 能找到它打开 Multica 的Runtimes页面确认目标电脑和对应 AI 编码工具显示在线安装工具、改路径或更新 profile 之后运行multica daemon restart。确认 runtime 在线后再回到执行日志重试该 run。timeout/agent_timeout调整执行时限daemon 侧的执行时长上限由agent_timeout控制默认不限制环境变量MULTICA_AGENT_TIMEOUT默认0表示无限制。可用环境变量也可写入~/.multica/config.json例如2h为文档示例的 duration 格式值按需替换multica config set agent_timeout 2hduration 键接受正的 Go duration如10s、2h0s和负值被拒绝唯一例外是agent_timeout其0s合法并显式关闭执行时限。优先级为命令行 flag → 环境变量 →~/.multica/config.json→ 内置默认值。详见 环境变量。如果文档建议的另一条路成立——缩小 issue 范围——也可以不动配置直接重试。codex_semantic_inactivity重试或调整 Codex 无活动超时对应 daemon 配置键codex_semantic_inactivity_timeout未设置时取 idle 与 tool watchdog 预算的较大者。runtime_missing_executable/runtime_version_unsupported按 安装 AI 编码工具 重装或升级工具完成后按上一步顺序第 5 条运行multica daemon restart再重试。认证、配额、模型、配置类provider_auth_or_access、provider_quota_limit、model_not_found_or_unavailable、missing_config分别重新登录/检查 API key、充值或切换账号、在 agent 设置里换可用模型、补上 agent 环境变量或工具配置然后手动重试。确认重试生效重试后会产生一条新的 run 记录——每次执行都有自己的记录旧记录不会被覆盖。验证方式Web 上新 run 出现在该 issue 的 Execution log 顶部活动 run 固定置顶行上的状态按queued等待 runtime 领取→dispatched已被领取正在启动工具→running→completed/failed推进dispatched状态停留超过 5 分钟会被当作失败。需要看工具原始输出时再点View transcript。CLI 上multica issue runs issue-id查看 run 历史multica issue run-messages task-id查看单次 run 的消息。issue 状态若失败时该 issue 没有其他活动 run它会被移回todo重试成功跑完前不要假设工作已完成——completed只代表这一次 run 正常结束不代表 issue 目标已达成。限制与边界UI 重试不跟随改派始终用当时的 agent想让新负责人跑用multica issue rerun issue-id。Autopilotrun only模式的失败不自动重试两种模式run only / create issue的最终结果都显示在 Autopilot run history 中。修改 issue 的负责人或状态不会停止已开始的 run要中断在执行日志里停止对应 run。活动 run 只会在 issue 被删除时随 issue 一起取消。自动重试次数与超时数值均为服务器默认配置供排查时快速对照你的部署如有调整以实际配置为准。【免费下载链接】multicaMake humans and AI agents work as one team — open-source and self-hostable.项目地址: https://gitcode.com/GitHub_Trending/mu/multica创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考