LLM 提供商
Notemd 支持 4 种传输类型下的 36 家 LLM 提供商。 所有的 API 调用都直接使用原始的 HTTP(无需 SDK),并具备自动重试、传输方式回退以及 5 分钟的响应缓存功能。通过按任务选择模型,您可以使用低成本模型进行概念提取,也可以使用高性能模型进行研究。对于本地提供商(Ollama、LMStudio),无需 API 密钥。
这是Obsidian AI知识管理指南的一部分。
提供商类别
云服务提供商
| 服务提供商 | 默认基础 URL | 默认模型 | 温度 |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
网关/代理服务提供商
| 服务提供商 | 默认基础 URL | 默认模型 | 备注 |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | 添加 HTTP-Referer + X-Title 标头 |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | 添加 X-GitHub-Api-Version 标头 |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | 添加 APP-Code 标头 |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | 可选的 API 键 |
| 新的 API | localhost:3000/v1 | gpt-4.1 | 可选的 API 键 |
| OpenAI Compatible | (用户配置) | your-model-id | 自定义端点 |
中国供应商
| 服务提供商 | 默认基础 URL | 默认模型 | 备注 |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | 阿里巴巴 DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | 以编程为重点 |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (需要端点 ID) | 字节跳动 Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | 中国浙江的端点 |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Zhipu,国际端点 |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | 模型托管平台 |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao 需要一个 Ark 端点 ID(格式:ep-xxxxxxxx-xxxx-xxxx)。默认的占位符必须被替换。
本地提供商
| 服务提供商 | 默认基础 URL | 默认模型 | 备注 |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | 没有 API 键。正在使用 NDJSON 流式传输。通过 /api/tags 进行模型发现。 |
| LMStudio | localhost:1234/v1 | local-model | 将 "EMPTY" 作为承载令牌发送。兼容 OpenAI 的发现机制 |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO 模型服务器 |
| Azure OpenAI | (用户配置) | gpt-4o | 在 URL 中的部署名称。api-key 标头 |
按任务选择模型
Notemd 支持为每个任务单独配置提供者和模型。可通过 useMultiModelSettings: true 启用该功能。
可用任务
| 任务 | 设置键 | 默认提供方 |
|---|---|---|
| 添加链接(维基链接插入) | addLinksProvider / addLinksModel | DeepSeek |
| 研究(网络搜索+总结) | researchProvider / researchModel | DeepSeek |
| 根据标题生成 | generateTitleProvider / generateTitleModel | DeepSeek |
| 翻译 | translateProvider / translateModel | DeepSeek |
| 图表生成 | summarizeToMermaidProvider / Model | DeepSeek |
| 概念提取 | extractConceptsProvider / Model | DeepSeek |
| 原始文本提取 | extractOriginalTextProvider / Model | DeepSeek |
分辨率顺序
- 如果
useMultiModelSettings处于开启状态 → 使用该任务专用的提供者及模型 - 如果任务模型覆盖值为空,则回退到提供者的默认模型。
- 如果任务提供者无效,则回退到全局
activeProvider - 如果
useMultiModelSettings关闭 → 所有任务将使用全局activeProvider
推荐配置
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
API 调用架构
传输层
- Obsidian
requestUrl— 主版本(内置,适用于所有平台) - 桌面版 HTTP — Node.js
http/https模块(流式处理 + 长请求) - Web
fetch— 当 Node.js 模块不可用时的备用方案
当网络出现临时故障时,该插件会自动在不同的传输方式之间切换。
重试逻辑
- 普通模式 (
enableStableApiCall: false):仅尝试一次。若出现短暂故障,会自动升级为稳定的重试机制。 - 稳定重试模式 (
enableStableApiCall: true):最多进行4次尝试(1次初始尝试 + 3次重试),每次尝试间隔5秒。 - 触发重试的临时错误:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - 不可重试:HTTP 400、401、403、404
响应缓存
基于提供方+模型+温度值+提示词+内容生成的5分钟内存LRU缓存。5分钟内的相同请求可立即返回缓存结果。
推理模型处理
不支持 system 角色(DeepSeek R1、OpenAI o1/o3/o4/gpt-5)的模型会自动将系统提示与用户提示合并为一条完整的用户消息。
DeepSeek-特定模式:thinkingEnabled会向请求中添加{ thinking: { type: 'enabled' } }。级别reasoningEffort(低/中/高)会作为reasoning_effort传递。当开启思考功能时,会验证最大输出token数是否≥8000。
令牌估算
estimateTokens(text): Math.ceil(text.length / 4) — 每个标记4个字符的启发式规则。用于在发送到 LLM 之前确保符合 maxResearchContentTokens 的要求。
尚未实现成本跟踪功能。
模型发现
| 模式 | 提供商 | 端点 |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | 模型列表 API | |
anthropic-models | Anthropic | 模型列表 API |
openai-compatible-models | DeepSeek、Qwen、Mistral 等。 | /v1/models |
openrouter-models | OpenRouter | 模型列表 API |
github-models | GitHub Models | 推理 API |
none | Azure OpenAI | 已禁用(需要部署名称) |
快速入门
- 选择提供商 — DeepSeek(中国),OpenAI(国际),或 Ollama(本地/免费)
- 输入 API 密钥 — 设置 → Notemd → 提供商 → API 密钥
- 测试连接 — 点击测试按钮
- 可选:任务专用模型 — 启用
useMultiModelSettings并进行单独配置
对于 Ollama:不需要 API 键。只需确保 ollama serve 正在运行即可。