LLM Providers
Notemd ondersteunt 36 LLM providers over 4 transporttypen. Alle API oproepen gebruiken ruwe HTTP (geen SDK’s) met automatische herprobering, transportfallback en 5-minuten cache van antwoorden. Modelselectie per taak stelt je in staat om goedkope modellen te gebruiken voor conceptextractie en krachtige modellen voor onderzoek. Er is geen API sleutel nodig voor lokale providers (Ollama, LMStudio).
Dit maakt deel uit van de Obsidian AI Knowledge Management Guide.
Provider Categorieën
Cloud Providers
| Aanbieder | Standaard basis URL | Standaardmodel | Temperature |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Gateway / Proxy Providers
| Aanbieder | Standaard basis URL | Standaardmodel | Opmerkingen |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Voegt HTTP-Referer + X-Title headers toe |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Voegt X-GitHub-Api-Version header toe |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Voegt APP-Code header toe |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Optionele API sleutel |
| Nieuwe API | localhost:3000/v1 | gpt-4.1 | Optionele API sleutel |
| OpenAI Compatible | (door gebruiker ingesteld) | your-model-id | Aanpasbare eindpunt |
Chinaanse aanbieders
| Aanbieder | Standaard Basis URL | Standaardmodel | Opmerkingen |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Gericht op programmeren |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (endpoint ID vereist) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Zhipu, China eindpunt |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Zhipu, internationaal eindpunt |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Platform voor het hosten van modellen |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao vereist een Ark eindpunt-ID (formaat: ep-xxxxxxxx-xxxx-xxxx). De standaardplaceholder moet worden vervangen.
Lokale providers
| Aanbieder | Standaard Basis URL | Standaardmodel | Opmerkingen |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Geen API sleutel. NDJSON streaming. Ontdekking van modellen via /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Stuurt "EMPTY" als bearer token. OpenAI-compatibele ontdekking |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (door de gebruiker ingesteld) | gpt-4o | Naam van de deploy in URL. api-key header |
Modelselectie per taak
Notemd ondersteunt een onafhankelijke provider en model voor elke taak. Schakel in met useMultiModelSettings: true.
Beschikbare taken
| Taak | Instellingssleutel | Standaardprovider |
|---|---|---|
| Links toevoegen (invoeging van wiki-link) | addLinksProvider / addLinksModel | DeepSeek |
| Onderzoek (webzoekopdracht + samenvatting) | researchProvider / researchModel | DeepSeek |
| Genereren op basis van titel | generateTitleProvider / generateTitleModel | DeepSeek |
| Vertaling | translateProvider / translateModel | DeepSeek |
| Diagramgeneratie | summarizeToMermaidProvider / Model | DeepSeek |
| Conceptuitwinning | extractConceptsProvider / Model | DeepSeek |
| Uitwinning oorspronkelijke tekst | extractOriginalTextProvider / Model | DeepSeek |
Resolutieladder
- Als
useMultiModelSettingsis ingeschakeld → gebruik de provider en het model specifiek voor de taak - Als de taakmodeloverriding leeg is → ga terug naar het standaardmodel van de provider
- Als de taakprovider ongeldig is → ga terug naar de globale
activeProvider - Als
useMultiModelSettingsuitstaat → worden alle taken uitgevoerd met de globaleactiveProvider
Aanbevolen configuraties
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
API Oproeparchitectuur
Transportlagen
- Obsidian
requestUrl— primair (ingebouwd, werkt op alle platforms) - Desktop HTTP — Node.js
http/httpsmodules (streaming + lange verzoeken) - Web
fetch— fallback wanneer Node.js modules niet beschikbaar zijn
De plugin schakelt automatisch over tussen transportmethoden bij tijdelijke netwerkproblemen.
Herhalingslogica
- Normale modus (
enableStableApiCall: false): Eén poging. Bij tijdelijk falen wordt automatisch overgegaan op een stabiele herhaling. - Stabiele herhalingsmodus (
enableStableApiCall: true): Tot 4 pogingen (1 + 3 herhalingen) met intervallen van 5 seconden. - Tijdelijke fouten die een herhaling triggeren:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Niet herhaalbaar: HTTP 400, 401, 403, 404
Responscaching
5-minuten LRU-cache in geheugen, gecodeerd op basis van provider + model + temperatuur + prompt + inhoud. Volgende identieke verzoeken binnen 5 minuten leveren onmiddellijk de opgeslagen resultaten op.
Behandeling van redeneringsmodellen
Modellen die de system rol niet ondersteunen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) hebben automatisch systemen + gebruikersprompts gecombineerd tot één enkele gebruikersbericht.
DeepSeek-specifiek: thinkingEnabled voegt { thinking: { type: 'enabled' } } toe aan de verzoek. reasoningEffort (laag/middel hoog) wordt doorgegeven als reasoning_effort. Controleert of het maximale aantal uitvoertokens ≥ 8000 is wanneer denken is geactiveerd.
Token Schatting
estimateTokens(text): Math.ceil(text.length / 4) — heuristiek van 4 tekens per token. Wordt gebruikt om maxResearchContentTokens af te dwingen voordat het naar LLM wordt gestuurd.
Er wordt geen kostenvolging geïmplementeerd.
Modelontdekking
| Modus | Providers | Eindpunt |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Lijst met modellen API | |
anthropic-models | Anthropic | Lijst met modellen API |
openai-compatible-models | DeepSeek, Qwen, Mistral, enzovoort. | /v1/models |
openrouter-models | OpenRouter | Lijst met modellen API |
github-models | GitHub Models | Inferentie API |
none | Azure OpenAI | Uitgeschakeld (vereist naam van implementatie) |
Snel Starten
- Kies een provider — DeepSeek (China), OpenAI (Internationaal) of Ollama (Lokal/Vrij)
- Voer API sleutel in — Instellingen → Notemd → Provider → API Sleutel
- Test verbinding — Klik op de testknop
- Optioneel: Modellen per taak — Schakel
useMultiModelSettingsin en configureer ze afzonderlijk
Voor Ollama: er is geen API‑sleutel nodig. Zorg er alleen voor dat ollama serve draait.
Volgende stappen
- 📝 Conceptnotities — Gebruikt het extractiemodel per taak
- 🎨 Diagrammen — Gebruikt het diagrammodel per taak
- 🔍 Onderzoek — Gebruikt het onderzoeksgerichte model
- ⚙️ Configuratie — Volledige referentie van instellingen