GitHub 原文

运行记录

左侧“运行记录”用于查看后台任务的排队、运行、失败、完成和恢复位置。旧文档或提示中的“任务中心”指向同一入口。这里是只读列表:帮助你确认真实进度、错误原因和任务来源,不在这里继续、恢复、重试、取消或归档任务。

任务中心界面截图

什么时候打开

  • 生成、拆书、知识库索引或自动导演任务运行时间较长。
  • 页面提示任务失败、等待恢复或没有响应。
  • 想查看任务是否仍在后台执行。
  • 需要确认错误后回到关联页面处理。

遇到“好像没反应”时,先看运行记录。很多长任务会继续运行,不一定是失败。

任务状态怎么看

常见状态可以这样理解:

  • 排队:任务已创建,等待执行资源。
  • 运行中:后台正在调用模型、处理资料或写入结果。
  • 完成:任务结果已保存,可以回到相关模块查看。
  • 失败:执行过程中出现错误,需要阅读失败原因。
  • 等待恢复:任务链需要你确认下一步或从恢复入口继续。
  • 取消:任务被用户或系统停止。

如果状态没有及时刷新,可以先刷新页面,再查看关联模块。

失败诊断

失败后先看三类信息:

  1. 任务类型:开书、章节、拆书、知识库还是图片生成。
  2. 错误来源:模型、网络、数据、结构化输出还是运行时异常。
  3. 可用结果:是否生成了正文、分析结果或部分资产。

处理方向:

  • 模型或网络临时错误:先处理连接或额度,再回到来源页面重试。
  • 结构化输出失败:到模型设置调整模型路由,再回到来源页面重试。
  • 缺少基础数据:回到小说页补信息。
  • 已有可用正文但审核不完美:记录质量债务,继续后续章节。
  • 明确要求重新规划:回到导演跟进处理。

执行详情会优先展示模型服务返回的余额、配额、限流或连接错误。看到这类错误时,先处理模型连接和额度,再打开来源页面继续;不要把“章节步骤未完成”当成正文丢失,也不要重新发起已完成章节范围。

暂停和失败怎么区分

状态含义推荐动作
等待确认 / 暂停处理本书规则或 checkpoint 在等用户决定打开来源页面查看原因并显式恢复
失败当前命令没有完成查看真实错误,再回到来源页面决定重试或换模型
等待恢复后台中断后仍保留可恢复位置打开来源页面,从首个未完成步骤继续
已完成但有提醒产物可用,仍有质量债或后续事项打开来源页核对,不要重复运行

“质量优先”造成的人工暂停不会被后台轮询或 worker 自动清除。完成问题处理后,需要从导演跟进明确恢复。

操作应该在哪里完成

运行记录只展示事实和“打开来源页面”。真正的操作要放在能够展示创作上下文、已保存产物和影响范围的页面:

  • 自动导演候选或规划失败:回到 AI 自动导演页面重试或恢复。
  • 章节生成或修复失败:回到章节页面处理。
  • 拆书、知识库或图片任务失败:回到对应工作台处理。
  • 模型、额度或连接问题:先到模型设置修正,再返回原任务页面。

操作前先确认记录没有仍在运行。对同一个阶段重复触发多次,可能造成状态难以判断。

和创作主链的关系

运行记录不决定一本书下一步写什么,也不执行任务动作,只负责呈现事实状态和来源位置。下一步创作动作在小说页、自动导演、章节页或其他来源工作台完成。

你可以按这个顺序排查:

  1. 运行记录确认任务状态和错误。
  2. 导演跟进理解链路位置。
  3. 打开来源页面继续执行;创作中枢只提供状态解释和入口导航。

使用建议

养成两个习惯:

  • 发起长任务后,遇到等待先看运行记录。
  • 失败后先读错误信息,再从来源页面决定重试、恢复或重新规划。

运行记录能减少重复点击和盲目重跑,是排查长链路问题的只读入口。

DirectorRunCommand 队列模型

自动导演的后台动作会写入 DirectorRunCommand 队列,再由 DirectorWorker 执行。

状态含义用户看到什么
queued命令已入队,等待 worker 租约任务排队或等待执行。
leasedworker 已领取命令,还没正式运行短暂状态,通常很快进入运行。
runningworker 正在执行命令并续租任务运行中。
succeeded命令完成任务结果可查看。
failed命令失败运行记录显示错误和来源页面。
staleworker 租约过期,需恢复等待自动恢复,或打开来源页面手动恢复。
cancelled命令取消用户或系统取消。

常见命令类型包括 generate_candidates、confirm_candidate、continue、resume_from_checkpoint、retry、takeover、approve_gate 和 repair_chapter_titles。

DirectorWorker 如何执行

DirectorWorker 会:

  1. 从队列领取最早可运行命令。
  2. 给命令写入租约和 worker owner。
  3. 获取 ResourceGate。
  4. 标记 running。
  5. 执行对应命令。
  6. 成功、失败、取消或释放资源。
  7. 定期续租,避免长任务被误判为 stale。

这意味着你可以离开当前页面,后台仍会继续运行;但也意味着重复点击同一个入口可能排出多个命令。

ResourceGate 并发上限

ResourceGate 按“小说 + 资源类型”限流。默认资源类型包括:

resource class默认槽位典型任务
planner2候选、规划、卷战略、拆章
writer2正文生成
repair2章节修复、质量修复
state_resolution2状态提交、角色资源同步

另外,节奏板、章节清单、章节细化、章节同步属于高内存自动导演阶段。同一本书同范围通常只允许一个高内存任务,避免批量拆章互相覆盖。

[!WARN] 不要重复启动同范围任务

如果提示已有自动导演任务正在处理同一范围,先打开运行记录查看进度。重复启动可能让你难以判断哪个任务写入了最终结果。

stale 任务恢复

stale 表示 worker 租约过期。常见原因:

  • 应用或服务重启。
  • 后台进程退出。
  • 长任务运行时间超过租约且续租失败。
  • 本机休眠或网络中断。

系统会区分自动恢复和手动恢复:

情况行为
全书自动执行、continue、resume_from_checkpoint 且尝试次数未超限自动回到 queued,继续执行。
尝试次数超限或命令不适合自动恢复标记 stale,任务进入等待恢复。
用户在来源页面点击恢复从最近 checkpoint 或命令 payload 继续。

重试、恢复、重启区别

操作适合情况会不会改变产物
重试同一命令临时失败通常只重跑失败命令。
恢复stale、等待确认、checkpoint从已保存进度继续。
重新生成当前阶段结果不满意可能覆盖目标阶段产物。
重规划上游目标改变或质量要求明确会影响后续阶段。

这些动作不会出现在运行记录中。来源页面应根据后台命令和 checkpoint 的真实状态,提供对应的重试、恢复、重新生成或重规划入口。

与导演跟进协作

推荐排查顺序:

  1. 运行记录确认命令是否还在运行。
  2. 如果是 waiting approval,进入导演跟进处理 checkpoint。
  3. 如果是 failed,先读错误信息,再打开来源页面决定重试还是回上游阶段。
  4. 如果是 stale,打开来源页面使用恢复入口。
  5. 如果章节已有正文但状态同步失败,优先重试同步,不要直接重写正文。

运行记录给出事实和来源;对应工作台给出并执行下一步。