Pular para o conteúdo principal

Fornecedores LLM

💡TL;DR

Notemd oferece 36 perfis para OpenAI-compatible, Anthropic, Google, Azure OpenAI e Ollama. Escolher protocolo, credenciais e modelo corretos e testar uma nota. Valores iniciais são configuráveis, não promessa de disponibilidade atual.

Categorias​

As tabelas vêm do registo. Conservar esquema e caminho completos das URLs e substituir exemplos pelo deployment real. Acesso, preços e retirada de modelos pertencem ao fornecedor.

Serviços cloud​

FornecedorModelo inicialURL base inicial
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oConfigurar o endpoint do recurso Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateways e proxies​

FornecedorModelo inicialURL base inicial
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Servidores locais​

FornecedorModelo inicialURL base inicial
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Fornecedores chineses​

Ver preparação regional para DeepSeek, Qwen, Doubao, Moonshot, GLM e outros. Categoria não garante disponibilidade geográfica nem qualidade de idioma. Conta, endpoint e direitos devem corresponder.

Modelos por tarefa​

useMultiModelSettings ativa rotas separadas; caso contrário vale activeProvider. Modelo específico vazio usa o do fornecedor. Ao carregar ajustes, fornecedores inválidos são reconciliados com o ativo.

TarefaAjuste de fornecedorModelo específico
LinksaddLinksProvideraddLinksModel
TítulosgenerateTitleProvidergenerateTitleModel
PesquisaresearchProviderresearchModel
TraduçãotranslateProvidertranslateModel
ConceitosextractConceptsProviderextractConceptsModel
Resumo MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Texto originalextractOriginalTextProviderextractOriginalTextModel

DeepSeek é o padrão ativo e por tarefa. Alterar apenas o ativo não substitui rotas específicas habilitadas. Rever todas antes de conteúdos privados.

Arquitetura de chamadas​

Transportes​

Pedidos Obsidian têm alternativas conscientes do protocolo: fluxos HTTP Node no desktop e fetch noutros ambientes. Protocolo e transporte são conceitos diferentes. Claude num gateway OpenAI-compatible usa o perfil desse gateway, não Anthropic nativo.

Novas tentativas​

Modo estável desligado por padrão; três repetições e cinco segundos de intervalo quando aplicável. Falhas transitórias podem seguir recuperação partilhada. Credenciais e modelos inválidos exigem correção. Limites, quotas e tempos remotos ainda podem interromper tarefas longas.

Cache​

Cache limitada em memória pode reutilizar respostas corretas. Endpoint, modelo, parâmetros, prompt e conteúdo definem identidade. Não é persistência, contador de custos ou garantia de evitar nova chamada paga.

Raciocínio​

Controlos reasoning/thinking dependem do perfil e regras do modelo. Não copiar parâmetros entre protocolos. Chat funcional não prova todas as combinações de amostragem, raciocínio e tokens.

Tokens​

Estimativas de comprimento e limites de saída não são contagens exatas do fornecedor. Consultar uso real para cobrança; não existe estimativa universal de custo.

Descoberta​

Fetch models depende do perfil. Alguns deployments exigem nome manual. Permissões de listagem e geração são independentes.

Testar conexão segue o modo: models-then-chat pode aprovar só pela lista; chat-only produz resposta curta. Executar depois uma tarefa real.

  • Anthropic e Google têm protocolos nativos de lista.
  • Ollama lista tags obtidas; LM Studio expõe modelos do servidor.
  • Azure exige deployment e versão API.
  • Gateways podem restringir lista e permitir modelo explícito.

Primeiros passos​

  1. Selecionar perfil em Settings → Notemd.
  2. Introduzir endereço, credenciais e modelo/deployment real.
  3. Testar conexão e nota descartável.
  4. Rever resultado e relatório antes de lotes ou rotas específicas.

Localmente, preparar modelo e servidor. Ollama não exige chave; LM Studio aceita chave opcional e define EMPTY inicialmente. Usar token real quando o servidor exigir. Pesquisa Web continua online.

Próximos passos​