Fornecedores LLM
Notemd oferece 36 perfis para OpenAI-compatible, Anthropic, Google, Azure OpenAI e Ollama. Escolher protocolo, credenciais e modelo corretos e testar uma nota. Valores iniciais são configuráveis, não promessa de disponibilidade atual.
Categorias
As tabelas vêm do registo. Conservar esquema e caminho completos das URLs e substituir exemplos pelo deployment real. Acesso, preços e retirada de modelos pertencem ao fornecedor.
Serviços cloud
| Fornecedor | Modelo inicial | URL base inicial |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Configurar o endpoint do recurso Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateways e proxies
| Fornecedor | Modelo inicial | URL base inicial |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Servidores locais
| Fornecedor | Modelo inicial | URL base inicial |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Fornecedores chineses
Ver preparação regional para DeepSeek, Qwen, Doubao, Moonshot, GLM e outros. Categoria não garante disponibilidade geográfica nem qualidade de idioma. Conta, endpoint e direitos devem corresponder.
Modelos por tarefa
useMultiModelSettings ativa rotas separadas; caso contrário vale activeProvider. Modelo específico vazio usa o do fornecedor. Ao carregar ajustes, fornecedores inválidos são reconciliados com o ativo.
| Tarefa | Ajuste de fornecedor | Modelo específico |
|---|---|---|
| Links | addLinksProvider | addLinksModel |
| Títulos | generateTitleProvider | generateTitleModel |
| Pesquisa | researchProvider | researchModel |
| Tradução | translateProvider | translateModel |
| Conceitos | extractConceptsProvider | extractConceptsModel |
| Resumo Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Texto original | extractOriginalTextProvider | extractOriginalTextModel |
DeepSeek é o padrão ativo e por tarefa. Alterar apenas o ativo não substitui rotas específicas habilitadas. Rever todas antes de conteúdos privados.
Arquitetura de chamadas
Transportes
Pedidos Obsidian têm alternativas conscientes do protocolo: fluxos HTTP Node no desktop e fetch noutros ambientes. Protocolo e transporte são conceitos diferentes. Claude num gateway OpenAI-compatible usa o perfil desse gateway, não Anthropic nativo.
Novas tentativas
Modo estável desligado por padrão; três repetições e cinco segundos de intervalo quando aplicável. Falhas transitórias podem seguir recuperação partilhada. Credenciais e modelos inválidos exigem correção. Limites, quotas e tempos remotos ainda podem interromper tarefas longas.
Cache
Cache limitada em memória pode reutilizar respostas corretas. Endpoint, modelo, parâmetros, prompt e conteúdo definem identidade. Não é persistência, contador de custos ou garantia de evitar nova chamada paga.
Raciocínio
Controlos reasoning/thinking dependem do perfil e regras do modelo. Não copiar parâmetros entre protocolos. Chat funcional não prova todas as combinações de amostragem, raciocínio e tokens.
Tokens
Estimativas de comprimento e limites de saída não são contagens exatas do fornecedor. Consultar uso real para cobrança; não existe estimativa universal de custo.
Descoberta
Fetch models depende do perfil. Alguns deployments exigem nome manual. Permissões de listagem e geração são independentes.
Testar conexão segue o modo: models-then-chat pode aprovar só pela lista; chat-only produz resposta curta. Executar depois uma tarefa real.
- Anthropic e Google têm protocolos nativos de lista.
- Ollama lista tags obtidas; LM Studio expõe modelos do servidor.
- Azure exige deployment e versão API.
- Gateways podem restringir lista e permitir modelo explícito.
Primeiros passos
- Selecionar perfil em Settings → Notemd.
- Introduzir endereço, credenciais e modelo/deployment real.
- Testar conexão e nota descartável.
- Rever resultado e relatório antes de lotes ou rotas específicas.
Localmente, preparar modelo e servidor. Ollama não exige chave; LM Studio aceita chave opcional e define EMPTY inicialmente. Usar token real quando o servidor exigir. Pesquisa Web continua online.