Skip to main content

Provedores LLM

💡TL;DR

Notemd suporta 36 provedores LLM em 4 tipos de transporte. Todas as chamadas API utilizam HTTP bruto (sem SDKs), com tentativa automática, fallback de transporte e cache de resposta de 5 minutos. A seleção de modelo por tarefa permite usar modelos baratos para extração de conceitos e modelos poderosos para pesquisa. Não é necessário nenhum campo API para provedores locais (Ollama, LMStudio).

Isso faz parte do Obsidian Guia de Gestão de Conhecimento de IA.

Categorias de Provedor

Provedores em Nuvem

FornecedorBase padrão URLModelo PadrãoTemperatura
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Provedores Gateway/Proxy

FornecedorBase padrão URLModelo PadrãoObservações
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetAdiciona cabeçalhos HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniAdiciona cabeçalho X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniAdiciona cabeçalho APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelCampo API opcional
Novo APIlocalhost:3000/v1gpt-4.1Campo API opcional
OpenAI Compatible(configurado pelo usuário)your-model-idEndpoint personalizado

Fornecedores da China

FornecedorBase padrão URLModelo PadrãoObservações
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusFocado em programação
Doubaoark.cn-beijing.volces.com/api/v3(ID do endpoint necessário)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Endpoint de Zhipu, China
Z AIapi.z.ai/api/paas/v4glm-5Endpoint internacional de Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlataforma de hospedagem de modelos
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao requer um ID de endpoint Ark (formato: ep-xxxxxxxx-xxxx-xxxx). O placeholder padrão deve ser substituído.

Fornecedores locais

FornecedorBase padrão URLModelo PadrãoObservações
Ollamalocalhost:11434/apillama3Sem chave API. Transmissão em fluxo NDJSON. Descoberta de modelos por meio de /api/tags
LMStudiolocalhost:1234/v1local-modelEnvia "EMPTY" como token de autenticação. Descoberta compatível com OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(configurado pelo usuário)gpt-4oNome da implantação em URL. Cabeçalho api-key

Seleção de Modelo por Tarefa

Notemd suporta provedor e modelo independentes para cada tarefa. Ative com useMultiModelSettings: true.

Tarefas Disponíveis

TarefaChave de ConfiguraçõesProvedor Padrão
Adicionar Links (inserção de link da wiki)addLinksProvider / addLinksModelDeepSeek
Pesquisa (busca na web + resumo)researchProvider / researchModelDeepSeek
Gerar a partir do TítulogenerateTitleProvider / generateTitleModelDeepSeek
TraduçãotranslateProvider / translateModelDeepSeek
Geração de DiagramassummarizeToMermaidProvider / ModelDeepSeek
Extração de ConceitosextractConceptsProvider / ModelDeepSeek
Extração de Texto OriginalextractOriginalTextProvider / ModelDeepSeek

Ordem de Resolução

  1. Se useMultiModelSettings estiver ativado → use o provedor e modelo específicos da tarefa
  2. Se a sobrescrita do modelo da tarefa estiver vazia → recorra ao modelo padrão do provedor
  3. Se o provedor da tarefa for inválido → recorra ao activeProvider global
  4. Se useMultiModelSettings estiver desligado → todas as tarefas usam o global activeProvider

Configurações recomendadas

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Arquitetura de Chamada API

Camadas de Transporte

  1. Obsidian requestUrl — primária (integrada, funciona em todas as plataformas)
  2. Desktop HTTP — módulos Node.js http/https (transmissão em fluxo + solicitações longas)
  3. Web fetch — fallback quando os módulos Node.js não estiverem disponíveis

O plugin alterna automaticamente entre os transportes em caso de erros temporários de rede.

Lógica de Tentativa

  • Modo normal (enableStableApiCall: false): Uma única tentativa. Em caso de falha temporária, há escalonamento automático para uma tentativa estável.
  • Modo de tentativa estável (enableStableApiCall: true): Até 4 tentativas (1 + 3 repetições) com intervalos de 5 segundos.
  • Erros temporários que acionam a tentativa: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Não reutilizáveis: HTTP 400, 401, 403, 404

Armazenamento em Cache de Respostas

Cache LRU em memória de 5 minutos, indexado por provedor + modelo + temperatura + prompt + conteúdo. Solicitações idênticas subsequentes dentro de 5 minutos retornam os resultados em cache instantaneamente.

Tratamento do Modelo de Raciocínio

Modelos que não suportam o papel system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) têm automaticamente os prompts do sistema e do usuário combinados em uma única mensagem do usuário.

DeepSeek-específico: thinkingEnabled adiciona { thinking: { type: 'enabled' } } à solicitação. reasoningEffort (baixo/médio/alto) é passado como reasoning_effort. Valida que o número máximo de tokens de saída seja ≥ 8000 quando o modo de raciocínio está ativado.

Estimativa de Tokens

estimateTokens(text): Math.ceil(text.length / 4) — heurística de 4 caracteres por token. Usada para garantir maxResearchContentTokens antes de enviar para LLM.

Nenhum rastreamento de custos é implementado.

Descoberta de modelos

ModoProvedoresPonto Final
ollama-tagsOllama/api/tags
google-modelsGoogleLista de Modelos API
anthropic-modelsAnthropicLista de Modelos API
openai-compatible-modelsDeepSeek, Qwen, Mistral, etc./v1/models
openrouter-modelsOpenRouterLista de Modelos API
github-modelsGitHub ModelsInfereção API
noneAzure OpenAIDesativado (requer nome de implantação)

Início Rápido

  1. Escolha um provedor — DeepSeek (China), OpenAI (Internacional) ou Ollama (Local/Livre)
  2. Insira a chave API — Configurações → Notemd → Provedor → Chave API
  3. Testar conexão — Clique no botão de teste
  4. Opcional: Modelos por tarefa — Ative useMultiModelSettings e configure individualmente

Para Ollama: não é necessária a chave API. Apenas certifique‑se de que ollama serve esteja em execução.


Próximos passos

  • 📝 Notas conceituais — Utiliza o modelo de extração por tarefa
  • 🎨 Diagramas — Utiliza o modelo de diagrama por tarefa
  • 🔍 Pesquisa — Utiliza o modelo específico para pesquisa
  • ⚙️ Configuração — Referência completa de ajustes