Provedores LLM
Notemd suporta 36 provedores LLM em 4 tipos de transporte. Todas as chamadas API utilizam HTTP bruto (sem SDKs), com tentativa automática, fallback de transporte e cache de resposta de 5 minutos. A seleção de modelo por tarefa permite usar modelos baratos para extração de conceitos e modelos poderosos para pesquisa. Não é necessário nenhum campo API para provedores locais (Ollama, LMStudio).
Isso faz parte do Obsidian Guia de Gestão de Conhecimento de IA.
Categorias de Provedor
Provedores em Nuvem
| Fornecedor | Base padrão URL | Modelo Padrão | Temperatura |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Provedores Gateway/Proxy
| Fornecedor | Base padrão URL | Modelo Padrão | Observações |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Adiciona cabeçalhos HTTP-Referer + X-Title |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Adiciona cabeçalho X-GitHub-Api-Version |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Adiciona cabeçalho APP-Code |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Campo API opcional |
| Novo API | localhost:3000/v1 | gpt-4.1 | Campo API opcional |
| OpenAI Compatible | (configurado pelo usuário) | your-model-id | Endpoint personalizado |
Fornecedores da China
| Fornecedor | Base padrão URL | Modelo Padrão | Observações |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Focado em programação |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (ID do endpoint necessário) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Endpoint de Zhipu, China |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Endpoint internacional de Zhipu |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Plataforma de hospedagem de modelos |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao requer um ID de endpoint Ark (formato: ep-xxxxxxxx-xxxx-xxxx). O placeholder padrão deve ser substituído.
Fornecedores locais
| Fornecedor | Base padrão URL | Modelo Padrão | Observações |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Sem chave API. Transmissão em fluxo NDJSON. Descoberta de modelos por meio de /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Envia "EMPTY" como token de autenticação. Descoberta compatível com OpenAI |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (configurado pelo usuário) | gpt-4o | Nome da implantação em URL. Cabeçalho api-key |
Seleção de Modelo por Tarefa
Notemd suporta provedor e modelo independentes para cada tarefa. Ative com useMultiModelSettings: true.
Tarefas Disponíveis
| Tarefa | Chave de Configurações | Provedor Padrão |
|---|---|---|
| Adicionar Links (inserção de link da wiki) | addLinksProvider / addLinksModel | DeepSeek |
| Pesquisa (busca na web + resumo) | researchProvider / researchModel | DeepSeek |
| Gerar a partir do Título | generateTitleProvider / generateTitleModel | DeepSeek |
| Tradução | translateProvider / translateModel | DeepSeek |
| Geração de Diagramas | summarizeToMermaidProvider / Model | DeepSeek |
| Extração de Conceitos | extractConceptsProvider / Model | DeepSeek |
| Extração de Texto Original | extractOriginalTextProvider / Model | DeepSeek |
Ordem de Resolução
- Se
useMultiModelSettingsestiver ativado → use o provedor e modelo específicos da tarefa - Se a sobrescrita do modelo da tarefa estiver vazia → recorra ao modelo padrão do provedor
- Se o provedor da tarefa for inválido → recorra ao
activeProviderglobal - Se
useMultiModelSettingsestiver desligado → todas as tarefas usam o globalactiveProvider
Configurações recomendadas
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
Arquitetura de Chamada API
Camadas de Transporte
- Obsidian
requestUrl— primária (integrada, funciona em todas as plataformas) - Desktop HTTP — módulos Node.js
http/https(transmissão em fluxo + solicitações longas) - Web
fetch— fallback quando os módulos Node.js não estiverem disponíveis
O plugin alterna automaticamente entre os transportes em caso de erros temporários de rede.
Lógica de Tentativa
- Modo normal (
enableStableApiCall: false): Uma única tentativa. Em caso de falha temporária, há escalonamento automático para uma tentativa estável. - Modo de tentativa estável (
enableStableApiCall: true): Até 4 tentativas (1 + 3 repetições) com intervalos de 5 segundos. - Erros temporários que acionam a tentativa:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Não reutilizáveis: HTTP 400, 401, 403, 404
Armazenamento em Cache de Respostas
Cache LRU em memória de 5 minutos, indexado por provedor + modelo + temperatura + prompt + conteúdo. Solicitações idênticas subsequentes dentro de 5 minutos retornam os resultados em cache instantaneamente.
Tratamento do Modelo de Raciocínio
Modelos que não suportam o papel system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) têm automaticamente os prompts do sistema e do usuário combinados em uma única mensagem do usuário.
DeepSeek-específico: thinkingEnabled adiciona { thinking: { type: 'enabled' } } à solicitação. reasoningEffort (baixo/médio/alto) é passado como reasoning_effort. Valida que o número máximo de tokens de saída seja ≥ 8000 quando o modo de raciocínio está ativado.
Estimativa de Tokens
estimateTokens(text): Math.ceil(text.length / 4) — heurística de 4 caracteres por token. Usada para garantir maxResearchContentTokens antes de enviar para LLM.
Nenhum rastreamento de custos é implementado.
Descoberta de modelos
| Modo | Provedores | Ponto Final |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Lista de Modelos API | |
anthropic-models | Anthropic | Lista de Modelos API |
openai-compatible-models | DeepSeek, Qwen, Mistral, etc. | /v1/models |
openrouter-models | OpenRouter | Lista de Modelos API |
github-models | GitHub Models | Infereção API |
none | Azure OpenAI | Desativado (requer nome de implantação) |
Início Rápido
- Escolha um provedor — DeepSeek (China), OpenAI (Internacional) ou Ollama (Local/Livre)
- Insira a chave API — Configurações → Notemd → Provedor → Chave API
- Testar conexão — Clique no botão de teste
- Opcional: Modelos por tarefa — Ative
useMultiModelSettingse configure individualmente
Para Ollama: não é necessária a chave API. Apenas certifique‑se de que ollama serve esteja em execução.
Próximos passos
- 📝 Notas conceituais — Utiliza o modelo de extração por tarefa
- 🎨 Diagramas — Utiliza o modelo de diagrama por tarefa
- 🔍 Pesquisa — Utiliza o modelo específico para pesquisa
- ⚙️ Configuração — Referência completa de ajustes