批次處理
資料夾動作共享選取與進度控制,但各有輸出及覆寫行為。預設並行數一。先用專用測試目錄,核對範圍和目標,再擴大批次。
概覽
使用側欄資料夾動作或檔案瀏覽器對應選單,可添加連結、擷取概念、依標題生成、翻譯、擷取原文及修復 Mermaid/公式。沒有通用資料夾研究,標題生成可選加入研究。
批次不是整個目錄的交易;個別失敗或取消時,已成功寫入的輸出保留。
工作原理
執行模型
- 選任務與資料夾,確認只含要處理的檔案。
- 依副檔名和選取規則收集合格檔案,排除任務特定輸出。
- 使用任務的 provider/model,報告進度、失敗與目標。
- 完成或取消後核對報告和檔案再重試。
添加連結、概念擷取、標題生成、原文擷取、Mermaid 和公式修復預設包含子目錄;資料夾翻譯預設只有直接子檔案。開發者模式與進階選取都啟用時,profile 可覆寫範圍/過濾。不要假定每項任務都同樣遞迴。
覆寫行為
| 任務 | 重跑前檢查 |
|---|---|
| 添加連結 | 預設獨立處理後檔案;檢查後綴、目錄與移動原文設定 |
| 概念擷取 | 啟用時可補既有概念來源連結;去重是獨立操作 |
| 標題生成 | 寫入合格源筆記,目標空閒時移至 complete 目錄 |
| 翻譯 | 同名譯文可能覆寫,預設 _<language>.md |
| Mermaid/公式修復 | 修改所選筆記,先審核小樣本並備份 |
沒有共通的略過/附加/替換設定。標題生成遇到既有 complete 目標只阻止移動,不表示前面的正文生成被略過。結果分開計算生成與移動數。
並行控制
代表性測試成功前保持 batchConcurrency: 1。部分路徑還需 enableBatchParallelism 才會平行;資料夾翻譯直接使用並行設定。增加並行會提高 provider、記憶體和伺服器壓力,不保證更快。
API 間隔和批次群組延遲可降低突發,但不能保證避開請求/token 配額、帳號限制或其他共用端點客戶端。
設定
| 設定 | 預設 | 作用 |
|---|---|---|
batchConcurrency | 1 | 適用批次路徑的要求並行數 |
enableBatchParallelism | false | 支援時啟用平行調度 |
batchSize | 50 | 分組調度使用的群組大小 |
batchInterDelayMs | 1000 | 適用群組間延遲 |
apiCallIntervalMs | 500 | 並行請求調度間隔 |
folderTaskIncludeSubfoldersMode | legacy | 保留各任務預設子目錄範圍 |
enableStableApiCall | false | 明確穩定請求模式 |
批次中的任務模型
資料夾動作和單檔任務共享 provider/model 選擇,私密工作前核對。本地檢索於批次標題生成開始建立單一快照,執行中編輯不混入後續檢索;要納入改動請啟動新批次。
範例
建立 trial-titles,只放兩篇標題筆記。執行 從標題批次生成,核對正文、trial-titles_complete 和生成/移動/錯誤計數。先診斷失敗檔;重跑原目錄不會精確自動續跑未完成部分。
取消與復原
取消停止新增調度,傳播至支援請求。外部系統已接受的呼叫/寫入仍可能完成,遠端計費由 provider 決定。等批次收斂,檢查完成檔與復原/衝突路徑;與目前筆記比較前保留復原產物。
建議
- 驗證實際匹配檔案後再使用選取 profile。
- 429 時降低並行並檢查配額。
- 分清取消、失敗和完成。
- 修改既有筆記前保留未變樣本及備份。