メインコンテンツへ移動

LLM プロバイダー

💡TL;DR

Notemdは、4種類の転送方式を通じて36のLLMプロバイダをサポートしています。 すべてのAPI呼び出しでは生のHTTPが使用され(SDKは不要)、自動再試行、転送方式のフォールバック、および5分間のレスポンスキャッシングが実施されます。タスクごとのモデル選択により、概念抽出には安価なモデルを、研究には高性能なモデルを使用できます。ローカルプロバイダ(Ollama、LMStudio)の場合、APIキーは不要です。

これはObsidian AI知識管理ガイドの一部です。

プロバイダーカテゴリ

クラウドプロバイダー

プロバイダーデフォルトベース URLデフォルトモデル温度
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

ゲートウェイ/プロキシプロバイダー

プロバイダーデフォルトベース URLデフォルトモデルメモ
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetHTTP-Referer + X-Title ヘッダーを追加する
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniX-GitHub-Api-Versionヘッダーを追加します
AIHubMixaihubmix.com/v1gpt-4o-miniAPP-Codeヘッダーを追加します
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelオプションのAPIキー
新しい APIlocalhost:3000/v1gpt-4.1オプションのAPIキー
OpenAI Compatible(ユーザー設定済み)your-model-idカスタムエンドポイント

中国のプロバイダー

プロバイダーデフォルトベース URLデフォルトモデルメモ
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusコーディングに特化した
Doubaoark.cn-beijing.volces.com/api/v3(エンドポイントIDが必要です)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-preview
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5中国のZhipuエンドポイント
Z AIapi.z.ai/api/paas/v4glm-5Zhipu、国際エンドポイント
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32Bモデルホスティングプラットフォーム
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao には Ark エンドポイント ID が必要です(形式:ep-xxxxxxxx-xxxx-xxxx)。デフォルトのプレースホルダーは必ず置き換える必要があります。

ローカルプロバイダー

プロバイダーデフォルトベース URLデフォルトモデルメモ
Ollamalocalhost:11434/apillama3APIキーがありません。NDJSONストリーミング。/api/tagsを介したモデル検出
LMStudiolocalhost:1234/v1local-model"EMPTY"をベアラートークンとして送信します。OpenAI対応のディスカバリ
OVMSlocalhost:8000/v3openvino-modelOpenVINOモデルサーバー
Azure OpenAI(ユーザー設定済み)gpt-4oURL内のデプロイメント名。api-keyヘッダー

タスクごとのモデル選択

Notemdは、各タスクごとに独立したプロバイダーとモデルをサポートしています。useMultiModelSettings: trueを使用して有効にします。

利用可能なタスク

タスク設定キーデフォルトプロバイダー
リンクの追加(ウィキリンクの挿入)addLinksProvider / addLinksModelDeepSeek
調査(ウェブ検索+要約)researchProvider / researchModelDeepSeek
タイトルから生成するgenerateTitleProvider / generateTitleModelDeepSeek
翻訳translateProvider / translateModelDeepSeek
図の生成summarizeToMermaidProvider / ModelDeepSeek
概念抽出extractConceptsProvider / ModelDeepSeek
元のテキスト抽出extractOriginalTextProvider / ModelDeepSeek

解像度順序

  1. useMultiModelSettingsが有効な場合は、タスク専用のプロバイダーとモデルを使用する
  2. タスクモデルのオーバーライドが空の場合 → プロバイダーのデフォルトモデルに戻る
  3. タスクプロバイダーが無効な場合 → グローバルなactiveProviderにフォールバックする
  4. useMultiModelSettingsがオフの場合 → すべてのタスクでグローバルなactiveProviderが使用されます

推奨設定

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API コールアーキテクチャ

トランスポート層

  1. Obsidian requestUrl — プライマリ(組み込みで、すべてのプラットフォームで動作)
  2. デスクトップ HTTP — Node.js http/https モジュール(ストリーミング+長時間のリクエスト)
  3. Web fetch — Node.jsモジュールが利用できない場合のフォールバック

このプラグインは、一時的なネットワークエラーが発生した際に自動的にトランスポート間で切り替えを行います。

再試行ロジック

  • 通常モード (enableStableApiCall: false): 1回の試行のみ。一時的な失敗が発生した場合、自動的に安定した再試行に切り替わります。
  • 安定した再試行モード (enableStableApiCall: true): 5秒間隔で最大4回の試行(1回の初回試行+3回の再試行)。
  • 再試行をトリガーする一時的なエラー: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • 再試行不可: HTTP 400, 401, 403, 404

レスポンスキャッシング

provider + model + temperature + prompt + contentでキー付けされた、5分間有効なメモリ内LRUキャッシュ。5分以内に同じリクエストが再び行われると、キャッシュされた結果が即座に返されます。

推論モデルの処理

systemロール(DeepSeek R1、OpenAI o1/o3/o4/gpt-5)をサポートしていないモデルでは、システムプロンプトとユーザープロンプトが自動的に1つのユーザーメッセージに統合されます。

DeepSeek-specific: thinkingEnabledはリクエストに { thinking: { type: 'enabled' } }を追加します。レベルreasoningEffort(低/中/高)はreasoning_effortとして渡されます。思考モードが有効な場合、最大出力トークン数が8000以上であることを検証します。

トークン推定

estimateTokens(text): Math.ceil(text.length / 4) — 1トークンあたり4文字のヒューリスティック。LLMに送信する前にmaxResearchContentTokensを適用するために使用されます。

コスト追跡機能は実装されていません。

モデル検出

モードプロバイダーエンドポイント
ollama-tagsOllama/api/tags
google-modelsGoogleモデル一覧 API
anthropic-modelsAnthropicモデル一覧 API
openai-compatible-modelsDeepSeek、Qwen、Mistralなど。/v1/models
openrouter-modelsOpenRouterモデル一覧 API
github-modelsGitHub Models推論 API
noneAzure OpenAI無効(デプロイメント名が必要)

クイックスタート

  1. プロバイダの選択 — DeepSeek(中国)、OpenAI(国際)、または Ollama(ローカル/無料)
  2. APIキーを入力してください — 設定 → Notemd → プロバイダー → APIキー
  3. 接続テスト — テストボタンをクリックしてください
  4. オプション:タスクごとのモデルuseMultiModelSettingsを有効にして個別に設定します

Ollamaの場合:APIキーは不要です。ollama serveが動作していることを確認してください。


次のステップ

  • 📝 Concept Notes — タスクごとの抽出モデルを使用
  • 🎨 Diagrams — タスクごとの図モデルを使用
  • 🔍 Research — 研究専用モデルを使用
  • ⚙️ 設定 — 全ての設定リファレンス