Aller au contenu principal

Fournisseurs LLM

💡TL;DR

Notemd propose 36 préréglages couvrant OpenAI-compatible, Anthropic, Google, Azure OpenAI et Ollama. Choisissez le protocole correspondant à votre serveur, renseignez les identifiants et testez une petite note. Les modèles prédéfinis sont des points de départ modifiables, pas une garantie de disponibilité actuelle.

Catégories​

Ces valeurs proviennent du registre. Conservez schéma et chemin complets des URL. Remplacez les modèles et adresses d’exemple par ceux du déploiement. Accès, tarifs et retrait des modèles relèvent du fournisseur.

Services cloud​

FournisseurModèle prédéfiniURL de base prédéfinie
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oConfigurer l’adresse de votre ressource Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Passerelles et proxys​

FournisseurModèle prédéfiniURL de base prédéfinie
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Serveurs locaux​

FournisseurModèle prédéfiniURL de base prédéfinie
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Fournisseurs chinois​

Le guide régional couvre DeepSeek, Qwen, Doubao, Moonshot, GLM et les autres préréglages concernés. Cette catégorie ne garantit ni accès géographique ni qualité linguistique. Faites correspondre région du compte, adresse et droits du modèle.

Modèles par tâche​

Activez useMultiModelSettings pour choisir les routes séparément. Sinon, activeProvider s’applique. Un modèle spécifique vide reprend celui du fournisseur ; les choix de fournisseur enregistrés devenus invalides sont réconciliés avec le fournisseur actif au chargement.

TâcheFournisseurModèle spécifique
Ajout de liensaddLinksProvideraddLinksModel
Génération depuis les titresgenerateTitleProvidergenerateTitleModel
Synthèse de rechercheresearchProviderresearchModel
TraductiontranslateProvidertranslateModel
ConceptsextractConceptsProviderextractConceptsModel
Synthèse MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Extraction originaleextractOriginalTextProviderextractOriginalTextModel

Le fournisseur actif et les fournisseurs par tâche valent DeepSeek par défaut. Changer seulement le fournisseur actif ne remplace pas les routes spécifiques activées : contrôlez-les avant des notes privées.

Architecture des appels​

Transports​

Les requêtes Obsidian disposent de chemins de repli adaptés au protocole : flux HTTP Node sur ordinateur, fetch dans d’autres environnements. Protocole et transport ne se confondent pas. Un Claude proposé par une passerelle OpenAI-compatible utilise cette passerelle, pas le profil Anthropic natif.

Nouvelles tentatives​

Le mode stable est désactivé par défaut. Les paramètres prévoient trois tentatives supplémentaires espacées de cinq secondes lorsque applicables. Les incidents transitoires peuvent emprunter le repli partagé ; authentification et modèle invalides exigent une correction. Les longs appels restent soumis aux délais et quotas distants.

Cache des réponses​

Un cache mémoire borné peut réutiliser des réponses réussies. Adresse, modèle, paramètres de génération, prompt et contenu participent à l’identité. Ce n’est ni une persistance, ni un compteur de coût, ni une garantie d’éviter un appel payant.

Modèles de raisonnement​

Les contrôles reasoning/thinking dépendent du préréglage et des règles du modèle. Ne recopiez pas les paramètres d’un protocole à un autre. Un modèle capable de dialoguer peut refuser des réglages de raisonnement, de tokens ou d’échantillonnage.

Estimation des tokens​

Estimations textuelles et limites de sortie ne sont pas les comptes exacts du fournisseur. Consultez sa consommation réelle pour la facturation ; aucun coût universel n’est calculé.

Découverte des modèles​

Fetch models est disponible selon le préréglage ; certains déploiements exigent un nom saisi manuellement. Le droit de lister et celui de générer sont distincts.

Tester la connexion suit le mode prévu : models-then-chat peut réussir sur la seule liste, chat-only effectue une petite génération. Testez ensuite une vraie tâche et sa sortie.

  • Anthropic et Google ont des protocoles natifs de liste.
  • Ollama expose les tags téléchargés ; LM Studio les modèles de son serveur.
  • Azure OpenAI exige déploiement et version API.
  • Une passerelle peut refuser la découverte tout en acceptant un modèle explicite.

Premier essai​

  1. Choisissez le bon préréglage dans Settings → Notemd.
  2. Saisissez adresse, identifiants et modèle/déploiement réel.
  3. Testez la connexion puis une note jetable.
  4. Vérifiez fichier et rapport avant lots ou routes par tâche.

En local, chargez le modèle et lancez son serveur. Ollama n’exige pas de clé ; LM Studio accepte une clé facultative, EMPTY dans le préréglage. Utilisez le vrai jeton si requis. La recherche Web reste en ligne.

Pour continuer​