Ir al contenido principal

LLM Proveedores

💡TL;DR

Notemd admite 36 proveedores LLM en 4 tipos de transporte. Todas las llamadas API utilizan HTTP en formato raw (sin SDKs), con reintentos automáticos, fallback de transporte y caché de respuestas de 5 minutos. La selección de modelos por tarea permite usar modelos económicos para la extracción de conceptos y modelos potentes para la investigación. No se necesita ninguna clave API para los proveedores locales (Ollama, LMStudio).

Esto forma parte de la Obsidian Guía de Gestión del Conocimiento de IA.

Categorías de proveedores

Proveedores de nube

ProveedorBase predeterminada URLModelo predeterminadoTemperatura
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Proveedores de gateway/proxy

ProveedorBase predeterminada URLModelo predeterminadoNotas
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetAñade los encabezados HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniAñade el encabezado X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniAñade el encabezado APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelClave opcional API
Nuevo APIlocalhost:3000/v1gpt-4.1Clave opcional API
OpenAI Compatible(configurado por el usuario)your-model-idPunto de extremo personalizado

Proveedores de China

ProveedorBase predeterminada URLModelo predeterminadoNotas
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusEnfocado en programación
Doubaoark.cn-beijing.volces.com/api/v3(Se requiere el ID del endpoint)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Punto final en Zhipu, China
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, punto de extremo internacional
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlataforma de alojamiento de modelos
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao requiere un ID de endpoint de Ark (formato: ep-xxxxxxxx-xxxx-xxxx). El marcador de posición predeterminado debe ser reemplazado.

Proveedores locales

ProveedorBase predeterminada URLModelo predeterminadoNotas
Ollamalocalhost:11434/apillama3No hay clave API. Transmisión en vivo NDJSON. Descubrimiento de modelos a través de /api/tags
LMStudiolocalhost:1234/v1local-modelEnvía "EMPTY" como token de portador. Descubrimiento compatible con OpenAI
OVMSlocalhost:8000/v3openvino-modelServidor de modelos OpenVINO
Azure OpenAI(configurado por el usuario)gpt-4oNombre de despliegue en URL. Encabezado api-key

Selección de modelo por tarea

Notemd admite un proveedor y un modelo independientes para cada tarea. Actívalo con useMultiModelSettings: true.

Tareas disponibles

TareaClave de configuraciónProveedor predeterminado
Añadir enlaces (inserción de enlace wiki)addLinksProvider / addLinksModelDeepSeek
Investigación (búsqueda en la web + resumen)researchProvider / researchModelDeepSeek
Generar a partir del títulogenerateTitleProvider / generateTitleModelDeepSeek
TraduccióntranslateProvider / translateModelDeepSeek
Generación de diagramassummarizeToMermaidProvider / ModelDeepSeek
Extracción de conceptosextractConceptsProvider / ModelDeepSeek
Extracción de texto originalextractOriginalTextProvider / ModelDeepSeek

Orden de resolución

  1. Si useMultiModelSettings está activo → usar el proveedor y modelo específicos de la tarea
  2. Si la sobrescritura del modelo de tarea está vacía → recurrir al modelo predeterminado del proveedor
  3. Si el proveedor de tareas es inválido → recurrir al activeProvider global
  4. Si useMultiModelSettings está apagado → todas las tareas utilizan el activeProvider global

Configuraciones recomendadas

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Arquitectura de llamadas

Capas de transporte

  1. Obsidian requestUrl — principal (integrado, funciona en todas las plataformas)
  2. Escritorio HTTP — Módulos de Node.js http/https (transmisión en flujo + solicitudes largas)
  3. Web fetch — solución de respaldo cuando los módulos de Node.js no están disponibles

El complemento cambia automáticamente entre transportes ante errores temporales de red.

Lógica de reintentos

  • Modo normal (enableStableApiCall: false): Un solo intento. En caso de fallo temporal, se escala automáticamente a un intento de reintentado estable.
  • Modo de reintentos estable (enableStableApiCall: true): Hasta 4 intentos (1 + 3 reintentos) con intervalos de 5 segundos.
  • Errores transitorios que provocan la reintentación: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • No reintentable: HTTP 400, 401, 403, 404

Almacenamiento en caché de respuestas

Cache LRU en memoria de 5 minutos, indexado por proveedor + modelo + temperatura + prompt + contenido. Las solicitudes idénticas posteriores dentro de los 5 minutos devuelven los resultados almacenados en caché al instante.

Manejo del modelo de razonamiento

Los modelos que no soportan el rol system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) combinan automáticamente las instrucciones del sistema y las del usuario en un único mensaje de usuario.

DeepSeek-específico: thinkingEnabled agrega { thinking: { type: 'enabled' } } a la solicitud. reasoningEffort (bajo/medio/alto) se pasa como reasoning_effort. Valida que los tokens máximos de salida sean ≥ 8000 cuando está activo el modo de razonamiento.

Estimación de tokenes

estimateTokens(text): Math.ceil(text.length / 4) — heurística de 4 caracteres por token. Se utiliza para aplicar maxResearchContentTokens antes de enviarlo a LLM.

No se ha implementado el seguimiento de costos.

Descubrimiento de modelos

ModoProveedoresPunto de extremo
ollama-tagsOllama/api/tags
google-modelsGoogleLista de modelos API
anthropic-modelsAnthropicLista de modelos API
openai-compatible-modelsDeepSeek, Qwen, Mistral, etc./v1/models
openrouter-modelsOpenRouterLista de modelos API
github-modelsGitHub ModelsInférencia API
noneAzure OpenAIDesactivado (requiere nombre de despliegue)

Inicio rápido

  1. Elige un proveedor: DeepSeek (China), OpenAI (Internacional) o Ollama (Local/Gratis)
  2. Introduce la tecla API — Ajustes → Notemd → Proveedor → Clave API
  3. Prueba de conexión — Haga clic en el botón de prueba
  4. Opcional: Modelos por tarea — Habilita useMultiModelSettings y configúralos individualmente

Para Ollama: no se necesita la clave API. Asegúrese solo de que ollama serve esté en ejecución.


Próximos pasos