跳到主要内容

批量处理

💡TL;DR

文件夹动作共享选取与进度控件,但各自保留不同输出和覆盖行为。默认并发数为一。从专用测试目录开始,核对选取范围与目标后再扩大批次。

概览​

使用侧栏文件夹动作或文件浏览器对应菜单。支持添加链接、概念提取、标题生成、翻译、原文提取、Mermaid 修复和公式修复。没有通用文件夹研究动作;标题生成可选加入研究。

批次不是覆盖整个目录的事务;一个文件失败或取消时,其他已完成输出保留。

工作原理​

批量执行模型​

  1. 选择任务和目录,确认只含计划处理的文件。
  2. 按任务扩展名、选择规则收集符合条件文件,排除任务特定输出。
  3. 使用该任务 provider/model,报告进度、失败与路径。
  4. 完成或取消后先核对报告和文件,再重试。

默认添加链接、概念提取、标题生成、原文提取、Mermaid 和公式修复包含子目录;文件夹翻译默认只含直接子文件。同时开启开发者模式与高级文件选取后,profile 可覆盖范围与过滤。应检查实际 profile,不要假定所有任务递归行为一致。

覆盖行为​

任务重跑前检查
添加链接默认独立处理后文件;检查后缀、输出目录和移动源文件选项
概念提取开启时可给已有概念补反向链接;重复检测独立
标题生成写入符合条件的源笔记,目标空闲时移至报告的 complete 目录
翻译同名译文可被覆盖;默认 _<language>.md
Mermaid/公式修复直接修改所选笔记;先检查小样本并保留备份

不同任务没有通用跳过/追加/替换设置。批量标题生成遇到既有 complete 目标会阻止移动,不表示此前的生成被跳过。结果区分生成数与移动数。

并发控制​

代表性样本成功前保持 batchConcurrency: 1。部分路径还需 enableBatchParallelism 才启用并行;文件夹翻译直接使用并发设置。更高并发增加 provider、内存和本地服务压力,不保证更快。

API 调用间隔与组间延迟可减少突发,但不保证避开请求/token 配额、账户限制或共享端点的其他客户端。

配置​

设置默认值作用
batchConcurrency1适用批量路径请求的并发数
enableBatchParallelismfalse在支持路径启用并行调度
batchSize50分组调度路径的组大小
batchInterDelayMs1000适用路径的调度组间延迟
apiCallIntervalMs500并发请求调度使用的间隔
folderTaskIncludeSubfoldersModelegacy保留各任务默认子目录范围
enableStableApiCallfalse显式稳定请求模式

批量任务模型​

文件夹动作与对应单文件任务使用相同任务专用 provider/model,处理私密内容前核对。批量标题生成的可选本地检索使用批次开始时构建的一份快照,运行期间修改不会混入后续检索;需要纳入修改时开始新批次。

示例​

创建只含两个标题笔记的 trial-titles 目录,运行 从标题批量生成。核对正文、trial-titles_complete 目录和生成/移动/错误数。先诊断失败文件;重跑原目录不是精确恢复未完成任务。

取消与恢复​

取消停止新增调度并传播到受支持请求。外部系统已接受的调用或写入仍可能完成,远端计费由 provider 控制。等待批次收敛,核对完成文件和恢复/冲突路径。与当前笔记比较前保留恢复输出。

建议​

  • 核对实际匹配文件后再使用选择 profile。
  • 429 时降低并发并检查配额。
  • 区分取消、失败和完成。
  • 修改已有笔记前保留未变样本与备份。

后续阅读​