Skip to main content

LLM 提供服務商

💡TL;DR

Notemd 支持 4 種傳輸類型下的 36 個 LLM 提供商。 所有的 API 呼叫皆使用原始的 HTTP(無需 SDK),並具備自動重試、傳輸路徑備用以及 5 分鐘的回應快取功能。透過依任務選擇模型,您可以使用低成本的模型進行概念抽取,或使用強大的模型進行研究。對於本地提供商(Ollama、LMStudio),不需要 API 金鑰。

這是Obsidian AI知識管理指南的一部分。

供應商類別

雲端服務供應商

供應商預設基準 URL預設模型溫度
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

網關/代理伺服器供應商

供應商預設基準 URL預設模型備註
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnet新增 HTTP-Referer + X-Title 標頭
GitHub Modelsmodels.github.ai/inferencegpt-4o-mini新增 X-GitHub-Api-Version 標頭
AIHubMixaihubmix.com/v1gpt-4o-mini新增 APP-Code 標頭
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-model可選的 API 金鑰
全新 APIlocalhost:3000/v1gpt-4.1可選的 API 金鑰
OpenAI Compatible(使用者自訂)your-model-id自訂端點

中國供應商

供應商預設基準 URL預設模型備註
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plus以編程為核心
Doubaoark.cn-beijing.volces.com/api/v3(需要端點 ID)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5中國的支浦端點
Z AIapi.z.ai/api/paas/v4glm-5Zhipu,國際端點
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32B模型託管平台
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao 需要一個 Ark 終點 ID(格式:ep-xxxxxxxx-xxxx-xxxx)。預設的佔位符必須被替換。

本地供應商

供應商預設基準 URL預設模型備註
Ollamalocalhost:11434/apillama3沒有 API 金鑰。正在進行 NDJSON 流式傳輸。透過 /api/tags 進行模型探索
LMStudiolocalhost:1234/v1local-model傳送 "EMPTY" 作為承載令牌。支援 OpenAI 的發現功能
OVMSlocalhost:8000/v3openvino-modelOpenVINO 模型伺服器
Azure OpenAI(使用者自訂)gpt-4o部署名稱位於 URL 中。api-key 標頭

每任務模型選擇

Notemd 支持為每個任務配置獨立的供應商與模型。可透過 useMultiModelSettings: true 啟用。

可用的任務

任務設定金鑰預設供應商
新增連結(維基連結插入)addLinksProvider / addLinksModelDeepSeek
研究(網路搜尋 + 總結)researchProvider / researchModelDeepSeek
根據標題產生generateTitleProvider / generateTitleModelDeepSeek
翻譯translateProvider / translateModelDeepSeek
圖表產生summarizeToMermaidProvider / ModelDeepSeek
概念抽取extractConceptsProvider / ModelDeepSeek
原始文字提取extractOriginalTextProvider / ModelDeepSeek

解析順序

  1. 如果 useMultiModelSettings 為開啟狀態 → 使用該任務專用的提供者與模型
  2. 如果任務模型覆寫值為空 → 回退至提供者的預設模型
  3. 如果任務提供者無效 → 回退至全局 activeProvider
  4. 如果 useMultiModelSettings 關閉 → 所有任務都會使用全局的 activeProvider

推薦的設定方案

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API 呼叫架構

傳輸層

  1. Obsidian requestUrl — 主要版本(內建,適用於所有平台)
  2. 桌面版 HTTP — Node.js http/https 模組(串流處理 + 長時間請求)
  3. Web fetch — 當 Node.js 模組無法使用時的備用方案

當網路出現暫時性錯誤時,此外掛程式會自動在不同的傳輸方式之間切換。

重試邏輯

  • 正常模式 (enableStableApiCall: false):僅嘗試一次。若出現暫時性失敗,會自動升級為穩定的重試機制。
  • 穩定重試模式 (enableStableApiCall: true):最多進行 4 次嘗試(1 次初次嘗試 + 3 次重試),每次間隔 5 秒。
  • 會觸發重試的暫時性錯誤err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • 無法重試:HTTP 400、401、403、404

回應快取

以供應商 + 模型 + 温度 + 提示詞 + 內容作為鍵值,建立5分鐘內存的LRU快取。在5分鐘內的後續相同請求可立即返回快取中的結果。

推理模型處理

不支援 system 角色(DeepSeek R1、OpenAI o1/o3/o4/gpt-5)的模型,會自動將系統提示與使用者提示合併為一則單一的用戶訊息。

DeepSeek-specific: thinkingEnabled 會在請求中加入 { thinking: { type: 'enabled' } }reasoningEffort(低/中/高)會以 reasoning_effort 的形式傳遞。當開啟思考模式時,會驗證最大輸出代碼數量是否 ≥ 8000。

令牌估計

estimateTokens(text): Math.ceil(text.length / 4) — 每個代碼片為 4 個字元的規則。用於在傳送至 LLM 之前強制符合 maxResearchContentTokens 的要求。

尚未實作成本追蹤功能。

模型探索

模式供應商端點
ollama-tagsOllama/api/tags
google-modelsGoogle型號列表 API
anthropic-modelsAnthropic型號列表 API
openai-compatible-modelsDeepSeek、Qwen、Mistral 等等。/v1/models
openrouter-modelsOpenRouter型號列表 API
github-modelsGitHub Models推論 API
noneAzure OpenAI已停用(需要部署名)

快速入門

  1. 選擇供應商 — DeepSeek(中國),OpenAI(國際),或 Ollama(本地/免費)
  2. 輸入 API 金鑰 — 設定 → Notemd → 提供者 → API 金鑰
  3. 測試連線 — 按下測試按鈕
  4. 可選:單任務模型 — 啟用 useMultiModelSettings 並分別進行設定

對於 Ollama:不需要 API 金鑰。只要確保 ollama serve 正在運作即可。


接下來的步驟

  • 📝 概念說明 — 使用任務別抽取模型
  • 🎨 圖表 — 使用每任務圖表模型
  • 🔍 研究 — 使用專為研究設計的模型
  • ⚙️ Configuration — 完整設定參考手冊