LLM プロバイダー
36 のプリセットは OpenAI-compatible、Anthropic、Google、Azure OpenAI、Ollama の五系列をカバーします。配信プロトコルに合わせて選び、認証情報と実際のモデルを短いノートで確認します。プリセットは変更できる開始値で、上流モデルの提供保証ではありません。
プロバイダー分類
以下は登録値です。URL のスキームとパスを維持し、プレースホルダーは実配備の値に置き換えます。利用権、料金、退役予定はサービス側が管理します。
クラウド
| プロバイダー | 既定モデル | 基本 URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | 自身の Azure リソース URL を設定 |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
ゲートウェイ/プロキシ
| プロバイダー | 既定モデル | 基本 URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
ローカル
| プロバイダー | 既定モデル | 基本 URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
中国地域のプロバイダー
DeepSeek、Qwen、Doubao、Moonshot、GLM 等は地域向け設定を参照します。この区分は地域での利用可能性や中国語品質の保証ではありません。アカウント地域、URL、モデル権限を一致させます。
タスク別モデル
useMultiModelSettings を有効にすると個別 provider とモデル上書きを選べます。無効時は activeProvider、空の上書きは指定 provider のモデルを使います。保存済みの無効な provider は読み込み時に active provider と整合させます。
| タスク | プロバイダー設定 | モデル上書き |
|---|---|---|
| リンク追加 | addLinksProvider | addLinksModel |
| タイトル生成 | generateTitleProvider | generateTitleModel |
| 調査要約 | researchProvider | researchModel |
| 翻訳 | translateProvider | translateModel |
| 概念抽出 | extractConceptsProvider | extractConceptsModel |
| Mermaid 要約 | summarizeToMermaidProvider | summarizeToMermaidModel |
| 原文抽出 | extractOriginalTextProvider | extractOriginalTextModel |
既定の active/タスク provider は DeepSeek です。非公開資料ではすべての有効なタスク設定を調べます。active provider の変更だけでは個別指定は置換されません。
API 呼び出しの仕組み
通信層
Obsidian のリクエスト機能とプロトコル対応の代替経路を使用します。デスクトップでは Node HTTP ストリーム、他では fetch を使えます。モデルのプロトコルと転送方法は別概念です。ゲートウェイの Claude には Anthropic ネイティブ設定を使いません。
再試行
安定リクエストモードは既定で無効です。適用される再試行設定は三回、五秒間隔。通信の一時的失敗は共有経路で回復し得ますが、認証やモデル設定は修正が必要です。長い要求は遠隔タイムアウト、上限、割当量で失敗し得ます。
応答キャッシュ
成功応答は上限付きメモリーキャッシュで再利用する場合があります。URL、モデル、生成条件、プロンプト、内容が識別に含まれます。永続化や料金計量ではなく、再実行が無料になる保証もありません。
推論モデル
対応プリセットとモデル規則に応じて reasoning/thinking を設定します。他プロトコルのパラメーターを流用しないでください。会話可能でも推論、token、sampling の全組合せは保証しません。
Token の見積もり
文字長と設定上限は実際の provider token 数とは異なります。課金は実使用量を確認してください。汎用の費用見積もりは提供しません。
モデルの発見
対応する場合 Fetch models を使えます。一部は手動 model/deployment 指定が必要です。一覧権限と生成権限は独立しています。
接続をテスト は models-then-chat なら一覧だけで成功し得ます。chat-only は短い生成を行います。正確なモデルと出力形式は小さな実タスクで検証してください。
- Anthropic/Google はネイティブ一覧プロトコル。
- Ollama は取得済み tag、LM Studio はサーバー公開モデルを一覧化。
- Azure は deployment と API version が必要で、一般一覧では代用できない。
- ゲートウェイは特定モデルで生成可能でも一覧を制限し得る。
クイックスタート
- 対応プリセットを選択。
- URL、認証情報、実際のモデル/deployment を指定。
- 接続テスト後に破棄可能なノートを処理。
- 出力と進捗を確認してからバッチや個別モデルを有効化。
ローカル利用は事前のモデル取得/読み込みとサーバー起動が必要です。Ollama はキー不要。LM Studio は任意で、プリセットは EMPTY ですがサーバーが認証を求めるなら実 token を指定します。Web 検索等は引き続き通信します。