メインコンテンツへ移動

バッチ処理

💡TL;DR

フォルダー操作は選択と進捗の仕組みを共有しますが、出力や上書きはタスクごとに異なります。既定の並行数は一つです。専用フォルダーで範囲と出力先を確認してから拡大します。

概要​

サイドバーまたはファイルエクスプローラーの対応メニューから、リンク追加、概念抽出、タイトル生成、翻訳、原文抽出、Mermaid/数式修復を実行できます。汎用フォルダー調査はなく、タイトル生成に任意で調査を追加します。

バッチはフォルダー全体のトランザクションではありません。別ファイルの失敗やキャンセルでも完了出力は残ります。

仕組み​

実行モデル​

  1. タスクとフォルダーを選び、意図したファイルだけか確認。
  2. 拡張子と選択規則を適用し、タスク固有の出力ファイルを除外。
  3. タスク別モデルで処理し、進捗、失敗、出力先を報告。
  4. 完了/キャンセル後に報告とファイルを確認して再試行。

リンク、概念、タイトル生成、原文抽出、Mermaid/数式修復は既定でサブフォルダーも対象です。フォルダー翻訳の既定は直下だけです。開発者モードと高度な選択が両方有効ならプロファイルで変更できます。すべてが同じ再帰範囲とは限りません。

上書き​

タスク再実行前の確認
リンク追加既定は別ファイル。接尾辞、出力先、原文移動を確認
概念抽出有効なら既存概念へ出典リンクを追加。重複判定は別操作
タイトル生成元ノートに生成し、空いていれば complete フォルダーへ移動
翻訳同名の訳は上書き可能。既定 _<language>.md
Mermaid/数式修復対象ノートを変更。小さく試しバックアップを保持

全タスク共通の skip/append/replace はありません。complete 先が既存ならタイトル生成後の移動を止めますが、生成そのものをスキップしたとは限りません。結果は生成数と移動数を区別します。

並行性​

代表例が成功するまでは batchConcurrency: 1 を保ちます。一部経路は enableBatchParallelism も必要で、フォルダー翻訳は並行数を直接使います。増加はモデル、メモリー、サーバーへの負荷を上げ、速くなる保証はありません。

API 間隔とバッチ間隔は集中を和らげますが、要求/token 割当量や同じサービスを使う別クライアントの影響は防げません。

設定​

設定既定値意味
batchConcurrency1該当経路で要求する並行数
enableBatchParallelismfalse対応経路の並行スケジューリング
batchSize50グループ化処理のサイズ
batchInterDelayMs1000該当するグループ間の遅延
apiCallIntervalMs500並行 API 要求の間隔
folderTaskIncludeSubfoldersModelegacy各タスクの従来のサブフォルダー範囲
enableStableApiCallfalse明示的な安定要求モード

タスク別モデル​

単独ファイルと同じモデル設定を使うため、非公開内容では先に確認します。タイトル一括生成のローカル検索は開始時に一つのスナップショットを構築し、実行中の編集を後続結果へ混ぜません。編集を含めるなら新しいバッチを開始します。

例​

trial-titles にタイトルノート二つだけを入れ、タイトルから一括生成 を実行します。本文、trial-titles_complete、生成/移動/失敗数を確認します。失敗ファイルを先に調査してください。元フォルダー再実行は未完了分だけの厳密な再開ではありません。

キャンセルと復旧​

新しい予定作業を止め、対応要求へキャンセルを伝えます。外部が受理済みの呼び出し/書き込みは完了し得て、課金はサービス側で管理します。停止処理を待ち、完了ファイルと復旧競合を確認します。現在のノートと比較するまで復旧出力を保管します。

ヒント​

  • プロファイルは実際に一致するファイルを確認して使う。
  • 429 では並行数と割当量を調べる。
  • キャンセル、失敗、完了を区別する。
  • 既存ノート変更前に未加工サンプルとバックアップを残す。

次に読む​