LLM 提供方
Notemd 的 36 個 provider 預設涵蓋 OpenAI-compatible、Anthropic、Google、Azure OpenAI 與 Ollama 五類協定。匹配端點協定、填寫必要憑證,用短筆記驗證。預設值可修改,不保證上游模型目前可用。
Provider 分類
下表取自 provider 登錄表,須保留 URL 協定與完整路徑。將模型/端點佔位值替換為實際部署。雲端權限、定價與退役安排由 provider 決定。
雲端 Provider
| Provider | 預設模型 | 基礎 URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | 設定自己的 Azure 資源端點 |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
閘道/代理 Provider
| Provider | 預設模型 | 基礎 URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
本地 Provider
| Provider | 預設模型 | 基礎 URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
中國地區 Provider
DeepSeek、Qwen、Doubao、Moonshot、GLM 等詳見地區設定。分類不是地域可用性或中文品質保證;需匹配帳號地區、端點與模型權限。
任務專用模型
啟用 useMultiModelSettings 可指定不同 provider 和模型覆寫;否則用 activeProvider。空覆寫用該 provider 模型;無效已存 provider 於設定載入時與活動 provider 協調。
| 任務 | Provider 設定 | 模型覆寫 |
|---|---|---|
| 添加連結 | addLinksProvider | addLinksModel |
| 標題生成 | generateTitleProvider | generateTitleModel |
| 研究摘要 | researchProvider | researchModel |
| 翻譯 | translateProvider | translateModel |
| 概念擷取 | extractConceptsProvider | extractConceptsModel |
| Mermaid 摘要 | summarizeToMermaidProvider | summarizeToMermaidModel |
| 原文擷取 | extractOriginalTextProvider | extractOriginalTextModel |
預設活動與各任務 provider 均為 DeepSeek。處理私密材料前逐項檢查,僅改活動 provider 不覆蓋已啟用的專用路由。
API 呼叫架構
傳輸層
使用 Obsidian 請求能力與協定感知回退。桌面可用 Node HTTP 串流,其他環境可用 fetch。Provider 協定與執行時傳輸不同;閘道的 Claude 模型應用閘道預設,不是原生 Anthropic。
重試
穩定請求模式預設關閉,適用時預設重試三次、間隔五秒。暫時性傳輸錯誤可進入共享重試/回退;認證與無效模型需修正。遠端逾時、模型或配額限制仍可讓長請求失敗。
回應快取
成功回應可由有界記憶體快取重用,身份包含端點、模型、生成設定、提示詞和內容。快取不是持久儲存、費用計量或重跑免付費保證。
推理模型處理
預設與模型規則支援時提供 reasoning/thinking 控制。勿跨 provider 搬用協定參數;能聊天不表示所有推理、token 或取樣組合有效。
Token 估算
文字長度估算及輸出上限不等於 provider 精確 token 數,計費應看實際用量,沒有通用成本估計。
模型探索
支援時 取得模型 探索模型,部分部署需手動填 model/deployment。列表權限與生成權限獨立。
測試連線 依預設模式;models-then-chat 可只憑清單端點成功,chat-only 執行短生成。請再用小型實際任務驗證模型與所需輸出。
- Anthropic、Google 使用原生清單協定。
- Ollama 列已拉取標籤;LM Studio 列伺服器暴露模型。
- Azure OpenAI 需 deployment 和 API version,通用列表無法替代。
- 閘道可能限制探索但允許特定模型聊天。
快速開始
- 在設定選匹配預設。
- 填入端點、憑證和帳號可用 model/deployment。
- 測試連線並處理可捨棄筆記。
- 核對輸出與進度後再啟用批次或任務路由。
本地需先下載/載入模型並啟動服務。Ollama 無須 API key;LM Studio 金鑰可選,預設 EMPTY,需要認證時填實際 token。本地 LLM 不會使網路搜尋及其他連網任務離線。