LLM Proveedores
Notemd admite 36 proveedores LLM en 4 tipos de transporte. Todas las llamadas API utilizan HTTP en formato raw (sin SDKs), con reintentos automáticos, fallback de transporte y caché de respuestas de 5 minutos. La selección de modelos por tarea permite usar modelos económicos para la extracción de conceptos y modelos potentes para la investigación. No se necesita ninguna clave API para los proveedores locales (Ollama, LMStudio).
Esto forma parte de la Obsidian Guía de Gestión del Conocimiento de IA.
Categorías de proveedores
Proveedores de nube
| Proveedor | Base predeterminada URL | Modelo predeterminado | Temperatura |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Proveedores de gateway/proxy
| Proveedor | Base predeterminada URL | Modelo predeterminado | Notas |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Añade los encabezados HTTP-Referer + X-Title |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Añade el encabezado X-GitHub-Api-Version |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Añade el encabezado APP-Code |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Clave opcional API |
| Nuevo API | localhost:3000/v1 | gpt-4.1 | Clave opcional API |
| OpenAI Compatible | (configurado por el usuario) | your-model-id | Punto de extremo personalizado |
Proveedores de China
| Proveedor | Base predeterminada URL | Modelo predeterminado | Notas |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Enfocado en programación |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (Se requiere el ID del endpoint) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Punto final en Zhipu, China |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Zhipu, punto de extremo internacional |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Plataforma de alojamiento de modelos |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao requiere un ID de endpoint de Ark (formato: ep-xxxxxxxx-xxxx-xxxx). El marcador de posición predeterminado debe ser reemplazado.
Proveedores locales
| Proveedor | Base predeterminada URL | Modelo predeterminado | Notas |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | No hay clave API. Transmisión en vivo NDJSON. Descubrimiento de modelos a través de /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Envía "EMPTY" como token de portador. Descubrimiento compatible con OpenAI |
| OVMS | localhost:8000/v3 | openvino-model | Servidor de modelos OpenVINO |
| Azure OpenAI | (configurado por el usuario) | gpt-4o | Nombre de despliegue en URL. Encabezado api-key |
Selección de modelo por tarea
Notemd admite un proveedor y un modelo independientes para cada tarea. Actívalo con useMultiModelSettings: true.
Tareas disponibles
| Tarea | Clave de configuración | Proveedor predeterminado |
|---|---|---|
| Añadir enlaces (inserción de enlace wiki) | addLinksProvider / addLinksModel | DeepSeek |
| Investigación (búsqueda en la web + resumen) | researchProvider / researchModel | DeepSeek |
| Generar a partir del título | generateTitleProvider / generateTitleModel | DeepSeek |
| Traducción | translateProvider / translateModel | DeepSeek |
| Generación de diagramas | summarizeToMermaidProvider / Model | DeepSeek |
| Extracción de conceptos | extractConceptsProvider / Model | DeepSeek |
| Extracción de texto original | extractOriginalTextProvider / Model | DeepSeek |
Orden de resolución
- Si
useMultiModelSettingsestá activo → usar el proveedor y modelo específicos de la tarea - Si la sobrescritura del modelo de tarea está vacía → recurrir al modelo predeterminado del proveedor
- Si el proveedor de tareas es inválido → recurrir al
activeProviderglobal - Si
useMultiModelSettingsestá apagado → todas las tareas utilizan elactiveProviderglobal
Configuraciones recomendadas
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
API Arquitectura de llamadas
Capas de transporte
- Obsidian
requestUrl— principal (integrado, funciona en todas las plataformas) - Escritorio HTTP — Módulos de Node.js
http/https(transmisión en flujo + solicitudes largas) - Web
fetch— solución de respaldo cuando los módulos de Node.js no están disponibles
El complemento cambia automáticamente entre transportes ante errores temporales de red.
Lógica de reintentos
- Modo normal (
enableStableApiCall: false): Un solo intento. En caso de fallo temporal, se escala automáticamente a un intento de reintentado estable. - Modo de reintentos estable (
enableStableApiCall: true): Hasta 4 intentos (1 + 3 reintentos) con intervalos de 5 segundos. - Errores transitorios que provocan la reintentación:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - No reintentable: HTTP 400, 401, 403, 404
Almacenamiento en caché de respuestas
Cache LRU en memoria de 5 minutos, indexado por proveedor + modelo + temperatura + prompt + contenido. Las solicitudes idénticas posteriores dentro de los 5 minutos devuelven los resultados almacenados en caché al instante.
Manejo del modelo de razonamiento
Los modelos que no soportan el rol system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) combinan automáticamente las instrucciones del sistema y las del usuario en un único mensaje de usuario.
DeepSeek-específico: thinkingEnabled agrega { thinking: { type: 'enabled' } } a la solicitud. reasoningEffort (bajo/medio/alto) se pasa como reasoning_effort. Valida que los tokens máximos de salida sean ≥ 8000 cuando está activo el modo de razonamiento.
Estimación de tokenes
estimateTokens(text): Math.ceil(text.length / 4) — heurística de 4 caracteres por token. Se utiliza para aplicar maxResearchContentTokens antes de enviarlo a LLM.
No se ha implementado el seguimiento de costos.
Descubrimiento de modelos
| Modo | Proveedores | Punto de extremo |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Lista de modelos API | |
anthropic-models | Anthropic | Lista de modelos API |
openai-compatible-models | DeepSeek, Qwen, Mistral, etc. | /v1/models |
openrouter-models | OpenRouter | Lista de modelos API |
github-models | GitHub Models | Inférencia API |
none | Azure OpenAI | Desactivado (requiere nombre de despliegue) |
Inicio rápido
- Elige un proveedor: DeepSeek (China), OpenAI (Internacional) o Ollama (Local/Gratis)
- Introduce la tecla API — Ajustes → Notemd → Proveedor → Clave API
- Prueba de conexión — Haga clic en el botón de prueba
- Opcional: Modelos por tarea — Habilita
useMultiModelSettingsy configúralos individualmente
Para Ollama: no se necesita la clave API. Asegúrese solo de que ollama serve esté en ejecución.
Próximos pasos
- 📝 Notas de concepto — Utiliza el modelo de extracción por tarea
- 🎨 Diagramas — Utiliza el modelo de diagrama por tarea
- 🔍 Investigación — Utiliza modelo específico para investigación
- ⚙️ Configuración — Referencia completa de ajustes