批量处理
文件夹动作共享选取与进度控件,但各自保留不同输出和覆盖行为。默认并发数为一。从专用测试目录开始,核对选取范围与目标后再扩大批次。
概览
使用侧栏文件夹动作或文件浏览器对应菜单。支持添加链接、概念提取、标题生成、翻译、原文提取、Mermaid 修复和公式修复。没有通用文件夹研究动作;标题生成可选加入研究。
批次不是覆盖整个目录的事务;一个文件失败或取消时,其他已完成输出保留。
工作原理
批量执行模型
- 选择任务和目录,确认只含计划处理的文件。
- 按任务扩展名、选择规则收集符合条件文件,排除任务特定输出。
- 使用该任务 provider/model,报告进度、失败与路径。
- 完成或取消后先核对报告和文件,再重试。
默认添加链接、概念提取、标题生成、原文提取、Mermaid 和公式修复包含子目录;文件夹翻译默认只含直接子文件。同时开启开发者模式与高级文件选取后,profile 可覆盖范围与过滤。应检查实际 profile,不要假定所有任务递归行为一致。
覆盖行为
| 任务 | 重跑前检查 |
|---|---|
| 添加链接 | 默认独立处理后文件;检查后缀、输出目录和移动源文件选项 |
| 概念提取 | 开启时可给已有概念补反向链接;重复检测独立 |
| 标题生成 | 写入符合条件的源笔记,目标空闲时移至报告的 complete 目录 |
| 翻译 | 同名译文可被覆盖;默认 _<language>.md |
| Mermaid/公式修复 | 直接修改所选笔记;先检查小样本并保留备份 |
不同任务没有通用跳过/追加/替换设置。批量标题生成遇到既有 complete 目标会阻止移动,不表示此前的生成被跳过。结果区分生成数与移动数。
并发控制
代表性样本成功前保持 batchConcurrency: 1。部分路径还需 enableBatchParallelism 才启用并行;文件夹翻译直接使用并发设置。更高并发增加 provider、内存和本地服务压力,不保证更快。
API 调用间隔与组间延迟可减少突发,但不保证避开请求/token 配额、账户限制或共享端点的其他客户端。
配置
| 设置 | 默认值 | 作用 |
|---|---|---|
batchConcurrency | 1 | 适用批量路径请求的并发数 |
enableBatchParallelism | false | 在支持路径启用并行调度 |
batchSize | 50 | 分组调度路径的组大小 |
batchInterDelayMs | 1000 | 适用路径的调度组间延迟 |
apiCallIntervalMs | 500 | 并发请求调度使用的间隔 |
folderTaskIncludeSubfoldersMode | legacy | 保留各任务默认子目录范围 |
enableStableApiCall | false | 显式稳定请求模式 |
批量任务模型
文件夹动作与对应单文件任务使用相同任务专用 provider/model,处理私密内容前核对。批量标题生成的可选本地检索使用批次开始时构建的一份快照,运行期间修改不会混入后续检索;需要纳入修改时开始新批次。
示例
创建只含两个标题笔记的 trial-titles 目录,运行 从标题批量生成。核对正文、trial-titles_complete 目录和生成/移动/错误数。先诊断失败文件;重跑原目录不是精确恢复未完成任务。
取消与恢复
取消停止新增调度并传播到受支持请求。外部系统已接受的调用或写入仍可能完成,远端计费由 provider 控制。等待批次收敛,核对完成文件和恢复/冲突路径。与当前笔记比较前保留恢复输出。
建议
- 核对实际匹配文件后再使用选择 profile。
- 429 时降低并发并检查配额。
- 区分取消、失败和完成。
- 修改已有笔记前保留未变样本与备份。