跳到主要内容

LLM 提供商

💡TL;DR

Notemd 支持 4 种传输类型下的 36 家 LLM 提供商。 所有的 API 调用都直接使用原始的 HTTP(无需 SDK),并具备自动重试、传输方式回退以及 5 分钟的响应缓存功能。通过按任务选择模型,您可以使用低成本模型进行概念提取,也可以使用高性能模型进行研究。对于本地提供商(Ollama、LMStudio),无需 API 密钥。

这是Obsidian AI知识管理指南的一部分。

提供商类别

云服务提供商

服务提供商默认基础 URL默认模型温度
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

网关/代理服务提供商

服务提供商默认基础 URL默认模型备注
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnet添加 HTTP-Referer + X-Title 标头
GitHub Modelsmodels.github.ai/inferencegpt-4o-mini添加 X-GitHub-Api-Version 标头
AIHubMixaihubmix.com/v1gpt-4o-mini添加 APP-Code 标头
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-model可选的 API 键
新的 APIlocalhost:3000/v1gpt-4.1可选的 API 键
OpenAI Compatible(用户配置)your-model-id自定义端点

中国供应商

服务提供商默认基础 URL默认模型备注
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22b阿里巴巴 DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plus以编程为重点
Doubaoark.cn-beijing.volces.com/api/v3(需要端点 ID)字节跳动 Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5中国浙江的端点
Z AIapi.z.ai/api/paas/v4glm-5Zhipu,国际端点
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32B模型托管平台
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao 需要一个 Ark 端点 ID(格式:ep-xxxxxxxx-xxxx-xxxx)。默认的占位符必须被替换。

本地提供商

服务提供商默认基础 URL默认模型备注
Ollamalocalhost:11434/apillama3没有 API 键。正在使用 NDJSON 流式传输。通过 /api/tags 进行模型发现。
LMStudiolocalhost:1234/v1local-model"EMPTY" 作为承载令牌发送。兼容 OpenAI 的发现机制
OVMSlocalhost:8000/v3openvino-modelOpenVINO 模型服务器
Azure OpenAI(用户配置)gpt-4o在 URL 中的部署名称。api-key 标头

按任务选择模型

Notemd 支持为每个任务单独配置提供者和模型。可通过 useMultiModelSettings: true 启用该功能。

可用任务

任务设置键默认提供方
添加链接(维基链接插入)addLinksProvider / addLinksModelDeepSeek
研究(网络搜索+总结)researchProvider / researchModelDeepSeek
根据标题生成generateTitleProvider / generateTitleModelDeepSeek
翻译translateProvider / translateModelDeepSeek
图表生成summarizeToMermaidProvider / ModelDeepSeek
概念提取extractConceptsProvider / ModelDeepSeek
原始文本提取extractOriginalTextProvider / ModelDeepSeek

分辨率顺序

  1. 如果 useMultiModelSettings 处于开启状态 → 使用该任务专用的提供者及模型
  2. 如果任务模型覆盖值为空,则回退到提供者的默认模型。
  3. 如果任务提供者无效,则回退到全局 activeProvider
  4. 如果 useMultiModelSettings 关闭 → 所有任务将使用全局 activeProvider

推荐配置

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API 调用架构

传输层

  1. Obsidian requestUrl — 主版本(内置,适用于所有平台)
  2. 桌面版 HTTP — Node.js http/https 模块(流式处理 + 长请求)
  3. Web fetch — 当 Node.js 模块不可用时的备用方案

当网络出现临时故障时,该插件会自动在不同的传输方式之间切换。

重试逻辑

  • 普通模式 (enableStableApiCall: false):仅尝试一次。若出现短暂故障,会自动升级为稳定的重试机制。
  • 稳定重试模式 (enableStableApiCall: true):最多进行4次尝试(1次初始尝试 + 3次重试),每次尝试间隔5秒。
  • 触发重试的临时错误err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • 不可重试:HTTP 400、401、403、404

响应缓存

基于提供方+模型+温度值+提示词+内容生成的5分钟内存LRU缓存。5分钟内的相同请求可立即返回缓存结果。

推理模型处理

不支持 system 角色(DeepSeek R1、OpenAI o1/o3/o4/gpt-5)的模型会自动将系统提示与用户提示合并为一条完整的用户消息。

DeepSeek-特定模式:thinkingEnabled会向请求中添加{ thinking: { type: 'enabled' } }。级别reasoningEffort(低/中/高)会作为reasoning_effort传递。当开启思考功能时,会验证最大输出token数是否≥8000。

令牌估算

estimateTokens(text): Math.ceil(text.length / 4) — 每个标记4个字符的启发式规则。用于在发送到 LLM 之前确保符合 maxResearchContentTokens 的要求。

尚未实现成本跟踪功能。

模型发现

模式提供商端点
ollama-tagsOllama/api/tags
google-modelsGoogle模型列表 API
anthropic-modelsAnthropic模型列表 API
openai-compatible-modelsDeepSeek、Qwen、Mistral 等。/v1/models
openrouter-modelsOpenRouter模型列表 API
github-modelsGitHub Models推理 API
noneAzure OpenAI已禁用(需要部署名称)

快速入门

  1. 选择提供商 — DeepSeek(中国),OpenAI(国际),或 Ollama(本地/免费)
  2. 输入 API 密钥 — 设置 → Notemd → 提供商 → API 密钥
  3. 测试连接 — 点击测试按钮
  4. 可选:任务专用模型 — 启用 useMultiModelSettings 并进行单独配置

对于 Ollama:不需要 API 键。只需确保 ollama serve 正在运行即可。


后续步骤

  • 📝 概念说明 — 使用任务级提取模型
  • 🎨 图表 — 使用任务级图表模型
  • 🔍 研究 — 使用专为研究设计的模型
  • ⚙️ 配置 — 完整设置参考