Doorgaan naar de hoofdinhoud

LLM-providers

💡TL;DR
Er zijn 36 profielen in vijf families: OpenAI-compatible, Anthropic, Google, Azure OpenAI en Ollama. Kies het protocol van je endpoint, toegestane gegevens en een beschikbaar model. Beginwaarden zijn aanpasbare voorbeelden, geen belofte van actuele modelbeschikbaarheid.

Categorieën​

De onderstaande waarden komen uit het register. Behoud URL-schema en volledig pad, vervang placeholders door je werkelijke deployment. Rechten, tarieven en modelbeëindiging worden door de provider bepaald.

Cloud​

ProviderBeginmodelBegin-URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oConfigureer het endpoint van je Azure-resource
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateways en proxies​

ProviderBeginmodelBegin-URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Lokaal​

ProviderBeginmodelBegin-URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Chinese providers​

Zie regionale configuratie. De categorie garandeert geen geografische beschikbaarheid of Chinese taalkwaliteit. Stem accountregio, endpoint en modelrechten af.

Per taak kiezen​

Met useMultiModelSettings stel je aparte providers en modeloverrides in; anders geldt activeProvider. Een lege override gebruikt het providermodel. Ongeldige opgeslagen providerkeuzes worden bij het laden met de actieve provider verzoend.

TaakProviderinstellingModeloverride
LinksaddLinksProvideraddLinksModel
TitelgeneratiegenerateTitleProvidergenerateTitleModel
OnderzoekssamenvattingresearchProviderresearchModel
VertalingtranslateProvidertranslateModel
ConceptenextractConceptsProviderextractConceptsModel
Mermaid-samenvattingsummarizeToMermaidProvidersummarizeToMermaidModel
Oorspronkelijke tekstextractOriginalTextProviderextractOriginalTextModel

De actieve en opgeslagen taakproviders beginnen met DeepSeek. Alleen de actieve provider veranderen vervangt ingeschakelde taakroutes niet. Controleer die vóór privé-inhoud.

Aanvraagarchitectuur​

Transportlagen​

Notemd gebruikt Obsidian-aanvragen en protocolbewuste fallback. Desktop kan Node HTTP-streams gebruiken, andere omgevingen fetch. Een Claude-model achter een OpenAI-compatible gateway gebruikt het gatewayprofiel, niet native Anthropic.

Nieuwe pogingen​

Stabiele modus staat uit; toepasselijke standaardwaarden zijn drie herhalingen met vijf seconden ertussen. Tijdelijke fouten kunnen via de gedeelde fallback/herhaling lopen. Autorisatie of modelconfiguratie moet je corrigeren. Lange aanvragen kunnen nog steeds door timeouts, limieten of quota falen.

Antwoordcache​

Een begrensde geheugencache kan succesvolle antwoorden hergebruiken. Endpoint, model, generatieparameters, prompt en inhoud dragen bij aan identiteit. Dit is geen permanente opslag of kostenmeter en garandeert geen gratis herhaling.

Redenerende modellen​

Reasoning/thinking volgen profiel- en modelregels. Kopieer geen protocolspecifieke parameters. Test de exacte taak; een chatmodel kan bepaalde token-, sampling- of redeneerinstellingen weigeren.

Tokens schatten​

Tekstlengte en uitvoerlimieten zijn geen exacte providertokenaantallen. Gebruik werkelijke verbruiksgegevens voor facturering. Er is geen universele kostenschatting.

Modellen vinden​

Fetch models werkt waar het profiel dit ondersteunt. Sommige deployments vereisen een handmatige naam. Lijst- en generatierechten zijn onafhankelijk. Verbinding testen kan bij models-then-chat met alleen een lijst slagen; chat-only voert een korte generatie uit. Controleer een echte taak en uitvoervorm.

  • Anthropic en Google gebruiken native ontdekking.
  • Ollama toont opgehaalde tags; LM Studio de modellen van de server.
  • Azure vereist deployment en API-versie.
  • Gateways kunnen lijsten beperken maar expliciete modelaanvragen toestaan.

Snel starten​

  1. Kies het juiste profiel in Settings → Notemd.
  2. Voer endpoint, sleutel en beschikbaar model/deployment in.
  3. Test verbinding en één wegwerpnotitie.
  4. Controleer output en rapport voordat je batches of taakroutering aanzet.

Lokaal moeten model en server klaarstaan. Ollama vereist geen sleutel; LM Studio accepteert een optionele sleutel en begint met EMPTY. Gebruik een echt token waar nodig. Een lokaal LLM maakt webzoeken niet offline.

Verder​