LLM Provider
Notemd 有 36 个 provider 预设,覆盖 OpenAI-compatible、Anthropic、Google、Azure OpenAI 和 Ollama 五类协议。选择与端点协议匹配的预设,填写凭据,用小笔记验证可访问模型。默认值是可修改的起点,不保证上游模型当前仍可用。
Provider 分类
下列值来自 provider 注册表。保留完整 URL 协议与路径,模型或端点占位符必须替换为实际部署值。托管访问权、定价和退役安排由 provider 决定。
云端 Provider
| Provider | 预设模型 | 预设基础 URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | 配置自己的 Azure 资源端点 |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
网关/代理 Provider
| Provider | 预设模型 | 预设基础 URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
本地 Provider
| Provider | 预设模型 | 预设基础 URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
中国地区 Provider
DeepSeek、Qwen、Doubao、Moonshot、GLM 等见地区 Provider 设置。分类说明配置方式,不保证地域可用性或中文质量;需匹配账户区域、端点和模型权限。
任务专用模型
启用 useMultiModelSettings 后可分别选择 provider 与模型覆盖值,否则使用 activeProvider。空模型覆盖使用该 provider 的配置模型;已保存但无效的 provider 会在设置加载时与活动 provider 协调。
| 任务 | Provider 设置 | 模型覆盖 |
|---|---|---|
| 添加链接 | addLinksProvider | addLinksModel |
| 标题生成 | generateTitleProvider | generateTitleModel |
| 研究摘要 | researchProvider | researchModel |
| 翻译 | translateProvider | translateModel |
| 概念提取 | extractConceptsProvider | extractConceptsModel |
| Mermaid 摘要 | summarizeToMermaidProvider | summarizeToMermaidModel |
| 原文提取 | extractOriginalTextProvider | extractOriginalTextModel |
默认活动 provider 和已保存的任务 provider 均为 DeepSeek。私密任务前逐项核对;仅修改活动 provider 不会覆盖已启用的任务专用选择。
API 调用架构
传输层
插件使用 Obsidian 请求能力及协议感知回退。桌面回退可使用 Node HTTP 流,其他环境可使用 fetch。Provider 协议与运行时传输方式不同:OpenAI-compatible 网关提供的 Claude 应选择网关预设,而非原生 Anthropic。
重试
稳定请求模式默认关闭,适用路径的重试默认值为三次、间隔五秒。临时传输失败可进入共享重试/回退流程;认证和无效模型必须修正,不能依赖重试。远端超时、模型限制或配额耗尽仍可导致长请求失败。
响应缓存
成功响应可由有界内存缓存复用,请求身份包含端点、模型、生成参数、提示词和内容。缓存不是持久存储、费用计量器,也不保证重复操作免除新付费请求。
推理模型
预设与模型规则支持时会提供 reasoning/thinking 控制。不要在 provider 间照搬协议参数。用实际任务验证;能够聊天不表示接受所有推理、token 或采样设置。
Token 估算
文本长度估算与输出上限不等于 provider 精确 token 数。费用以实际账户用量为准,插件没有通用费用估计。
模型发现
获取模型 仅在预设支持时发现模型,有些部署要求手动输入模型或 deployment 名。列表权限与生成权限独立。
测试连接 遵循预设测试模式:models-then-chat 可仅凭列表端点成功,chat-only 执行短生成请求。始终用小型实际任务验证工作流所需模型与输出结构。
- Anthropic、Google 有原生模型列表协议。
- Ollama 列出本地已拉取标签,LM Studio 列出服务暴露模型。
- Azure OpenAI 需要 deployment 配置和 API version,通用模型列表不能替代。
- 网关可能允许特定模型聊天,却限制模型发现。
快速开始
- 在设置 → Notemd选择匹配预设。
- 填写端点、凭据和实际可用模型/deployment。
- 测试连接,再处理一篇可丢弃笔记。
- 检查输出和进度后再开启批量或任务专用路由。
本地使用前先下载/加载模型并启动服务。Ollama 不要求 API key;LM Studio 密钥可选,预设为 EMPTY,若服务要求认证则填真实 token。本地 LLM 不会使网络搜索或其他联网任务离线。