LLM-providers
Categorieën
De onderstaande waarden komen uit het register. Behoud URL-schema en volledig pad, vervang placeholders door je werkelijke deployment. Rechten, tarieven en modelbeëindiging worden door de provider bepaald.
Cloud
| Provider | Beginmodel | Begin-URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Configureer het endpoint van je Azure-resource |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateways en proxies
| Provider | Beginmodel | Begin-URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Lokaal
| Provider | Beginmodel | Begin-URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Chinese providers
Zie regionale configuratie. De categorie garandeert geen geografische beschikbaarheid of Chinese taalkwaliteit. Stem accountregio, endpoint en modelrechten af.
Per taak kiezen
Met useMultiModelSettings stel je aparte providers en modeloverrides in; anders geldt activeProvider. Een lege override gebruikt het providermodel. Ongeldige opgeslagen providerkeuzes worden bij het laden met de actieve provider verzoend.
| Taak | Providerinstelling | Modeloverride |
|---|---|---|
| Links | addLinksProvider | addLinksModel |
| Titelgeneratie | generateTitleProvider | generateTitleModel |
| Onderzoekssamenvatting | researchProvider | researchModel |
| Vertaling | translateProvider | translateModel |
| Concepten | extractConceptsProvider | extractConceptsModel |
| Mermaid-samenvatting | summarizeToMermaidProvider | summarizeToMermaidModel |
| Oorspronkelijke tekst | extractOriginalTextProvider | extractOriginalTextModel |
De actieve en opgeslagen taakproviders beginnen met DeepSeek. Alleen de actieve provider veranderen vervangt ingeschakelde taakroutes niet. Controleer die vóór privé-inhoud.
Aanvraagarchitectuur
Transportlagen
Notemd gebruikt Obsidian-aanvragen en protocolbewuste fallback. Desktop kan Node HTTP-streams gebruiken, andere omgevingen fetch. Een Claude-model achter een OpenAI-compatible gateway gebruikt het gatewayprofiel, niet native Anthropic.
Nieuwe pogingen
Stabiele modus staat uit; toepasselijke standaardwaarden zijn drie herhalingen met vijf seconden ertussen. Tijdelijke fouten kunnen via de gedeelde fallback/herhaling lopen. Autorisatie of modelconfiguratie moet je corrigeren. Lange aanvragen kunnen nog steeds door timeouts, limieten of quota falen.
Antwoordcache
Een begrensde geheugencache kan succesvolle antwoorden hergebruiken. Endpoint, model, generatieparameters, prompt en inhoud dragen bij aan identiteit. Dit is geen permanente opslag of kostenmeter en garandeert geen gratis herhaling.
Redenerende modellen
Reasoning/thinking volgen profiel- en modelregels. Kopieer geen protocolspecifieke parameters. Test de exacte taak; een chatmodel kan bepaalde token-, sampling- of redeneerinstellingen weigeren.
Tokens schatten
Tekstlengte en uitvoerlimieten zijn geen exacte providertokenaantallen. Gebruik werkelijke verbruiksgegevens voor facturering. Er is geen universele kostenschatting.
Modellen vinden
Fetch models werkt waar het profiel dit ondersteunt. Sommige deployments vereisen een handmatige naam. Lijst- en generatierechten zijn onafhankelijk. Verbinding testen kan bij models-then-chat met alleen een lijst slagen; chat-only voert een korte generatie uit. Controleer een echte taak en uitvoervorm.
- Anthropic en Google gebruiken native ontdekking.
- Ollama toont opgehaalde tags; LM Studio de modellen van de server.
- Azure vereist deployment en API-versie.
- Gateways kunnen lijsten beperken maar expliciete modelaanvragen toestaan.
Snel starten
- Kies het juiste profiel in Settings → Notemd.
- Voer endpoint, sleutel en beschikbaar model/deployment in.
- Test verbinding en één wegwerpnotitie.
- Controleer output en rapport voordat je batches of taakroutering aanzet.
Lokaal moeten model en server klaarstaan. Ollama vereist geen sleutel; LM Studio accepteert een optionele sleutel en begint met EMPTY. Gebruik een echt token waar nodig. Een lokaal LLM maakt webzoeken niet offline.