Skip to main content

LLM Providers

💡TL;DR

Notemd ondersteunt 36 LLM providers over 4 transporttypen. Alle API oproepen gebruiken ruwe HTTP (geen SDK’s) met automatische herprobering, transportfallback en 5-minuten cache van antwoorden. Modelselectie per taak stelt je in staat om goedkope modellen te gebruiken voor conceptextractie en krachtige modellen voor onderzoek. Er is geen API sleutel nodig voor lokale providers (Ollama, LMStudio).

Dit maakt deel uit van de Obsidian AI Knowledge Management Guide.

Provider Categorieën

Cloud Providers

AanbiederStandaard basis URLStandaardmodelTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Gateway / Proxy Providers

AanbiederStandaard basis URLStandaardmodelOpmerkingen
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetVoegt HTTP-Referer + X-Title headers toe
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniVoegt X-GitHub-Api-Version header toe
AIHubMixaihubmix.com/v1gpt-4o-miniVoegt APP-Code header toe
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelOptionele API sleutel
Nieuwe APIlocalhost:3000/v1gpt-4.1Optionele API sleutel
OpenAI Compatible(door gebruiker ingesteld)your-model-idAanpasbare eindpunt

Chinaanse aanbieders

AanbiederStandaard Basis URLStandaardmodelOpmerkingen
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusGericht op programmeren
Doubaoark.cn-beijing.volces.com/api/v3(endpoint ID vereist)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, China eindpunt
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, internationaal eindpunt
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatform voor het hosten van modellen
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao vereist een Ark eindpunt-ID (formaat: ep-xxxxxxxx-xxxx-xxxx). De standaardplaceholder moet worden vervangen.

Lokale providers

AanbiederStandaard Basis URLStandaardmodelOpmerkingen
Ollamalocalhost:11434/apillama3Geen API sleutel. NDJSON streaming. Ontdekking van modellen via /api/tags
LMStudiolocalhost:1234/v1local-modelStuurt "EMPTY" als bearer token. OpenAI-compatibele ontdekking
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(door de gebruiker ingesteld)gpt-4oNaam van de deploy in URL. api-key header

Modelselectie per taak

Notemd ondersteunt een onafhankelijke provider en model voor elke taak. Schakel in met useMultiModelSettings: true.

Beschikbare taken

TaakInstellingssleutelStandaardprovider
Links toevoegen (invoeging van wiki-link)addLinksProvider / addLinksModelDeepSeek
Onderzoek (webzoekopdracht + samenvatting)researchProvider / researchModelDeepSeek
Genereren op basis van titelgenerateTitleProvider / generateTitleModelDeepSeek
VertalingtranslateProvider / translateModelDeepSeek
DiagramgeneratiesummarizeToMermaidProvider / ModelDeepSeek
ConceptuitwinningextractConceptsProvider / ModelDeepSeek
Uitwinning oorspronkelijke tekstextractOriginalTextProvider / ModelDeepSeek

Resolutieladder

  1. Als useMultiModelSettings is ingeschakeld → gebruik de provider en het model specifiek voor de taak
  2. Als de taakmodeloverriding leeg is → ga terug naar het standaardmodel van de provider
  3. Als de taakprovider ongeldig is → ga terug naar de globale activeProvider
  4. Als useMultiModelSettings uitstaat → worden alle taken uitgevoerd met de globale activeProvider

Aanbevolen configuraties

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Oproeparchitectuur

Transportlagen

  1. Obsidian requestUrl — primair (ingebouwd, werkt op alle platforms)
  2. Desktop HTTP — Node.js http/https modules (streaming + lange verzoeken)
  3. Web fetch — fallback wanneer Node.js modules niet beschikbaar zijn

De plugin schakelt automatisch over tussen transportmethoden bij tijdelijke netwerkproblemen.

Herhalingslogica

  • Normale modus (enableStableApiCall: false): Eén poging. Bij tijdelijk falen wordt automatisch overgegaan op een stabiele herhaling.
  • Stabiele herhalingsmodus (enableStableApiCall: true): Tot 4 pogingen (1 + 3 herhalingen) met intervallen van 5 seconden.
  • Tijdelijke fouten die een herhaling triggeren: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Niet herhaalbaar: HTTP 400, 401, 403, 404

Responscaching

5-minuten LRU-cache in geheugen, gecodeerd op basis van provider + model + temperatuur + prompt + inhoud. Volgende identieke verzoeken binnen 5 minuten leveren onmiddellijk de opgeslagen resultaten op.

Behandeling van redeneringsmodellen

Modellen die de system rol niet ondersteunen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) hebben automatisch systemen + gebruikersprompts gecombineerd tot één enkele gebruikersbericht.

DeepSeek-specifiek: thinkingEnabled voegt { thinking: { type: 'enabled' } } toe aan de verzoek. reasoningEffort (laag/middel hoog) wordt doorgegeven als reasoning_effort. Controleert of het maximale aantal uitvoertokens ≥ 8000 is wanneer denken is geactiveerd.

Token Schatting

estimateTokens(text): Math.ceil(text.length / 4) — heuristiek van 4 tekens per token. Wordt gebruikt om maxResearchContentTokens af te dwingen voordat het naar LLM wordt gestuurd.

Er wordt geen kostenvolging geïmplementeerd.

Modelontdekking

ModusProvidersEindpunt
ollama-tagsOllama/api/tags
google-modelsGoogleLijst met modellen API
anthropic-modelsAnthropicLijst met modellen API
openai-compatible-modelsDeepSeek, Qwen, Mistral, enzovoort./v1/models
openrouter-modelsOpenRouterLijst met modellen API
github-modelsGitHub ModelsInferentie API
noneAzure OpenAIUitgeschakeld (vereist naam van implementatie)

Snel Starten

  1. Kies een provider — DeepSeek (China), OpenAI (Internationaal) of Ollama (Lokal/Vrij)
  2. Voer API sleutel in — Instellingen → Notemd → Provider → API Sleutel
  3. Test verbinding — Klik op de testknop
  4. Optioneel: Modellen per taak — Schakel useMultiModelSettings in en configureer ze afzonderlijk

Voor Ollama: er is geen API‑sleutel nodig. Zorg er alleen voor dat ollama serve draait.


Volgende stappen

  • 📝 Conceptnotities — Gebruikt het extractiemodel per taak
  • 🎨 Diagrammen — Gebruikt het diagrammodel per taak
  • 🔍 Onderzoek — Gebruikt het onderzoeksgerichte model
  • ⚙️ Configuratie — Volledige referentie van instellingen