Proveedores LLM
Notemd ofrece 36 perfiles para OpenAI-compatible, Anthropic, Google, Azure OpenAI y Ollama. Elige protocolo, credenciales y modelo correctos y prueba una nota. Los valores iniciales son configurables, no promesas de disponibilidad actual.
Categorías
Las tablas proceden del registro. Conserva esquema y ruta completos de las URL; sustituye ejemplos por datos reales del despliegue. Acceso, precios y retirada de modelos dependen del proveedor.
Servicios cloud
| Proveedor | Modelo inicial | URL base inicial |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Configurar el endpoint del recurso Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Pasarelas y proxies
| Proveedor | Modelo inicial | URL base inicial |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Servidores locales
| Proveedor | Modelo inicial | URL base inicial |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Proveedores chinos
Consulta configuración regional para DeepSeek, Qwen, Doubao, Moonshot, GLM y otros. La categoría no garantiza acceso geográfico ni calidad del chino. Cuenta, endpoint y permisos deben coincidir.
Modelos por tarea
useMultiModelSettings habilita rutas separadas. En otro caso rige activeProvider. Un modelo específico vacío usa el del proveedor. Al cargar ajustes, las selecciones de proveedor inválidas se reconcilian con el activo.
| Tarea | Ajuste de proveedor | Modelo específico |
|---|---|---|
| Enlaces | addLinksProvider | addLinksModel |
| Títulos | generateTitleProvider | generateTitleModel |
| Investigación | researchProvider | researchModel |
| Traducción | translateProvider | translateModel |
| Conceptos | extractConceptsProvider | extractConceptsModel |
| Resumen Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Texto original | extractOriginalTextProvider | extractOriginalTextModel |
DeepSeek es el valor inicial activo y por tarea. Cambiar solo el proveedor activo no reemplaza rutas específicas habilitadas; revisa todas antes de contenido privado.
Arquitectura de llamadas
Transportes
Las peticiones de Obsidian tienen alternativas conscientes del protocolo: flujos HTTP Node en escritorio y fetch en otros entornos. Protocolo y transporte son distintos. Claude servido por una pasarela OpenAI-compatible utiliza su perfil, no Anthropic nativo.
Reintentos
Modo estable apagado por defecto; tres reintentos e intervalo de cinco segundos cuando aplica. Los errores transitorios pueden entrar en la ruta compartida de recuperación. Credenciales o modelo inválidos requieren corrección; límites, cuotas y tiempos remotos aún pueden abortar tareas largas.
Caché
Una caché en memoria acotada puede reutilizar respuestas correctas. Endpoint, modelo, ajustes, prompt y contenido determinan identidad. No es persistencia, contador de costes ni garantía de evitar otra llamada pagada.
Modelos de razonamiento
Controles reasoning/thinking dependen del perfil y las reglas del modelo. No copies parámetros entre protocolos. Un chat correcto no acredita cualquier combinación de muestreo, razonamiento o tokens.
Tokens
Estimaciones de longitud y límites de salida no equivalen a tokens exactos del proveedor. Consulta consumo real para facturación; no hay estimador universal de coste.
Descubrimiento
Fetch models depende del perfil. Algunos despliegues requieren nombre manual. Permisos de listado y generación son independientes.
Probar conexión sigue el modo del perfil: models-then-chat puede aprobar con la lista, chat-only genera una respuesta breve. Ejecuta después una tarea real.
- Anthropic y Google tienen protocolos de lista nativos.
- Ollama lista tags descargados; LM Studio, modelos del servidor.
- Azure necesita despliegue y versión API.
- Las pasarelas pueden restringir listado y permitir un modelo explícito.
Primeros pasos
- Seleccionar perfil en Settings → Notemd.
- Introducir dirección, acceso y modelo/despliegue real.
- Probar conexión y nota desechable.
- Revisar archivo e informe antes de lotes o rutas específicas.
En local, preparar modelo y servidor. Ollama no exige clave; LM Studio acepta una opcional y predefine EMPTY. Si tu servidor exige token real, úsalo. La búsqueda web sigue conectada.