Aller au contenu principal

LLM Fournisseurs

💡TL;DR

Notemd prend en charge 36 fournisseurs LLM sur 4 types de transport. Toutes les appels API utilisent du HTTP brut (sans SDK) avec des tentatives automatiques, un fallback de transport et un cache des réponses sur 5 minutes. Le choix du modèle par tâche vous permet d’utiliser des modèles économiques pour l’extraction de concepts et des modèles puissants pour la recherche. Aucune clé API n’est nécessaire pour les fournisseurs locaux (Ollama, LMStudio).

Ceci fait partie du Obsidian Guide de gestion des connaissances IA.

Catégories de fournisseurs

Fournisseurs de services cloud

FournisseurBase par défaut URLModèle par défautTempérature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Fournisseurs de passerelles / de proxys

FournisseurBase par défaut URLModèle par défautNotes
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetAjoute les en-têtes HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniAjoute l’en-tête X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniAjoute l’en-tête APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelClé API optionnelle
Nouveau APIlocalhost:3000/v1gpt-4.1Clé API optionnelle
OpenAI Compatible(configuré par l’utilisateur)your-model-idPoint de terminaison personnalisé

Fournisseurs en Chine

FournisseurBase par défaut URLModèle par défautNotes
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusAxé sur la programmation
Doubaoark.cn-beijing.volces.com/api/v3(ID d’endpoint requis)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Point de terminaison à Zhipu, en Chine
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, point de terminaison international
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlateforme d’hébergement de modèles
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao nécessite un identifiant d’endpoint Ark (format : ep-xxxxxxxx-xxxx-xxxx). Le placeholder par défaut doit être remplacé.

Fournisseurs locaux

FournisseurBase par défaut URLModèle par défautNotes
Ollamalocalhost:11434/apillama3Aucune clé API. Diffusion NDJSON. Découverte de modèles via /api/tags
LMStudiolocalhost:1234/v1local-modelEnvoie "EMPTY" en tant que token porteur. Découverte compatible avec OpenAI
OVMSlocalhost:8000/v3openvino-modelServeur de modèles OpenVINO
Azure OpenAI(configuré par l’utilisateur)gpt-4oNom du déploiement dans URL. En-tête api-key

Sélection du modèle par tâche

Notemd prend en charge un fournisseur et un modèle indépendants pour chaque tâche. Activez-le avec useMultiModelSettings: true.

Tâches disponibles

TâcheClé des paramètresFournisseur par défaut
Ajouter des liens (insertion de lien wiki)addLinksProvider / addLinksModelDeepSeek
Recherche (recherche sur le web + résumé)researchProvider / researchModelDeepSeek
Générer à partir du titregenerateTitleProvider / generateTitleModelDeepSeek
TraductiontranslateProvider / translateModelDeepSeek
Génération de diagrammessummarizeToMermaidProvider / ModelDeepSeek
Extraction de conceptsextractConceptsProvider / ModelDeepSeek
Extraction du texte originalextractOriginalTextProvider / ModelDeepSeek

Ordre de résolution

  1. Si useMultiModelSettings est activé → utilisez le fournisseur et le modèle spécifiques à la tâche
  2. Si la surcharge du modèle de tâche est vide → revenir au modèle par défaut du fournisseur
  3. Si le fournisseur de tâches est invalide → passer par le activeProvider global
  4. Si useMultiModelSettings est désactivé → toutes les tâches utilisent le activeProvider global

Configurations recommandées

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Architecture d’appel

Couches de transport

  1. Obsidian requestUrl — principal (préinstallé, fonctionne sur toutes les plateformes)
  2. Desktop HTTP — Modules Node.js http/https (transmission en flux continu + requêtes longues)
  3. Web fetch — solution de secours en cas d’impossibilité d’utiliser les modules Node.js

Le plugin bascule automatiquement entre les transports en cas d’erreurs de réseau temporaires.

Logique de tentative

  • Mode normal (enableStableApiCall: false) : Une seule tentative. En cas d’échec temporaire, il passe automatiquement à une tentative de récupération stable.
  • Mode de tentative stable (enableStableApiCall: true) : Jusqu’à 4 tentatives (1 + 3 réessais) avec des intervalles de 5 secondes.
  • Erreurs transitoires déclenchant une tentative de réessai : err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Non reproductible : HTTP 400, 401, 403, 404

Mémorisation des réponses

Cache LRU en mémoire de 5 minutes, indexé par fournisseur + modèle + température + prompt + contenu. Les requêtes identiques ultérieures dans les 5 minutes renvoient instantanément les résultats en cache.

Gestion du modèle de raisonnement

Les modèles qui ne prennent pas en charge le rôle system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) combinent automatiquement les prompts système et utilisateur en un seul message utilisateur.

Spécifique à DeepSeek : thinkingEnabled ajoute { thinking: { type: 'enabled' } } à la requête. reasoningEffort (faible/moyen/haut) est transmis sous la forme de reasoning_effort. Vérifie que le nombre maximal de tokens de sortie soit ≥ 8000 lorsque la réflexion est activée.

Estimation de token

estimateTokens(text): Math.ceil(text.length / 4) — heuristique de 4 caractères par token. Utilisée pour appliquer maxResearchContentTokens avant d’envoyer vers LLM.

Aucun suivi des coûts n’est implémenté.

Découverte de modèles

ModeFournisseursPoint d’extrémité
ollama-tagsOllama/api/tags
google-modelsGoogleListe des modèles API
anthropic-modelsAnthropicListe des modèles API
openai-compatible-modelsDeepSeek, Qwen, Mistral, etc./v1/models
openrouter-modelsOpenRouterListe des modèles API
github-modelsGitHub ModelsInférence API
noneAzure OpenAIDésactivé (nécessite un nom de déploiement)

Début rapide

  1. Choisissez un fournisseur — DeepSeek (Chine), OpenAI (International), ou Ollama (Local/Gratuit)
  2. Appuyez sur la touche API — Paramètres → Notemd → Fournisseur → Clé API
  3. Tester la connexion — Cliquez sur le bouton de test
  4. Optionnel : Modèles par tâche — Activer useMultiModelSettings et les configurer individuellement

Pour Ollama : aucune clé API n’est nécessaire. Assurez-vous simplement que ollama serve est en cours d’exécution.


Prochaines étapes

  • 📝 Notes de concept — Utilise un modèle d’extraction par tâche
  • 🎨 Diagrammes — Utilise le modèle de diagramme par tâche
  • 🔍 Recherche — Utilise un modèle spécifique à la recherche
  • ⚙️ Configuration — Référence complète des paramètres