Skip to main content

LLM Tjänsteleverantörer

💡TL;DR

Notemd stöder 36 LLM tjänsteleverantörer över 4 transporttyper. Alla API anrop använder rå HTTP (inga SDK:er) med automatisk återförsök, transportfallback och 5-minuters cache för svar. Val av modell per uppgift gör att du kan använda billiga modeller för konceptextraktion och kraftfulla modeller för forskning. Ingen API nyckel behövs för lokala leverantörer (Ollama, LMStudio).

Detta ingår i Obsidian AI Knowledge Management Guide.

Kategorier för tjänsteleverantörer

Molntjänsteleverantörer

LeverantörStandardbas URLStandardmodellTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Gateway-/Proxy-tjänsteleverantörer

LeverantörStandardbas URLStandardmodellNoter
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetLägger till HTTP-Referer + X-Title-header
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniLägger till X-GitHub-Api-Version-header
AIHubMixaihubmix.com/v1gpt-4o-miniLägger till APP-Code-header
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelValfri API-nyckel
Nytt APIlocalhost:3000/v1gpt-4.1Valfri API-nyckel
OpenAI Compatible(användarkonfigurerat)your-model-idCustom endpoint

Kinesiska leverantörer

LeverantörDefault Base URLStandardmodellNoter
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusInriktat på kodning
Doubaoark.cn-beijing.volces.com/api/v3(krävs slutpunkts-ID)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, Kinas endpoint
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, internationell endpoint
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlattform för modellhosting
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao kräver en Ark-endpoint-ID (format: ep-xxxxxxxx-xxxx-xxxx). Den standardmässiga placeringen måste ersättas.

Lokala leverantörer

LeverantörDefault Base URLStandardmodellNoter
Ollamalocalhost:11434/apillama3Ingen API-nyckel. NDJSON-strömning. Modellupptäckt via /api/tags
LMStudiolocalhost:1234/v1local-modelSkickar "EMPTY" som bearer-token. OpenAI-kompatibel upptäckt
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(anpassat av användaren)gpt-4oNamnet på distributionen i URL. api-key-header

Modellval per uppgift

Notemd stöder en oberoende leverantör och modell för varje uppgift. Aktivera med useMultiModelSettings: true.

Tillgängliga uppgifter

UppgiftInställningsnyckelStandardleverantör
Lägg till länkar (insering av wiki-länkar)addLinksProvider / addLinksModelDeepSeek
Forskning (webbsökning + sammanfattning)researchProvider / researchModelDeepSeek
Generera från titelgenerateTitleProvider / generateTitleModelDeepSeek
ÖversättningtranslateProvider / translateModelDeepSeek
DiagramgenereringsummarizeToMermaidProvider / ModelDeepSeek
KonceptextraktionextractConceptsProvider / ModelDeepSeek
UrsprungstextextraktionextractOriginalTextProvider / ModelDeepSeek

Lösningsordning

  1. Om useMultiModelSettings är aktiverat → använd den uppgiftsspecifika leverantören + modellen
  2. Om överskrivningen av uppgiftsmodellen är tom → fall tillbaka till leverantörens standardmodell
  3. Om uppgiftsleverantören är ogiltig → fall tillbaka till den globala activeProvider
  4. Om useMultiModelSettings är avstängt → alla uppgifter använder den globala activeProvider

Rekommenderade konfigurationer

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Call Architecture

Transportlagrar

  1. Obsidian requestUrl — primär (inbyggd, fungerar på alla plattformar)
  2. Desktop HTTP — Node.js http/https-moduler (strömning + långa förfrågningar)
  3. Web fetch — fallback när Node.js-moduler inte är tillgängliga

Pluginen kaskaderas automatiskt mellan transportlagrar vid tillfälliga nätverksfel.

Återförsökslogik

  • Normalläge (enableStableApiCall: false): En enda försök. Vid tillfällig misslyckande eskaleras det automatiskt till ett stabilt återförsök.
  • Stabilt återförsöksläge (enableStableApiCall: true): Upp till 4 försök (1 + 3 återförsök) med 5 sekunders intervallar.
  • Tillfälliga fel som utlöser återförsök: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Inte återförsökbara: HTTP 400, 401, 403, 404

Svarcaching

5-minuters LRU-cache i minnet med nycklar baserade på leverantör + modell + temperatur + prompt + innehåll. Efterföljande identiska förfrågningar inom 5 minuter returnerar omedelbart cacherade resultat.

Hantering av resonemangsmodeller

Modeller som inte stöder system-rollen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) har automatiskt system- och användarprompts sammanfogade till en enda användarmeddelande.

DeepSeek-specifik: thinkingEnabled lägger till { thinking: { type: 'enabled' } } i förfrågan. reasoningEffort (låg/mellanlig/hög) skickas som reasoning_effort. Kontrollerar att maximal utdataantal token är ≥ 8000 när tänkning är aktiverad.

Tokenuppskattning

estimateTokens(text): Math.ceil(text.length / 4) — heuristik med 4 tecken per token. Används för att upprätthålla maxResearchContentTokens innan det skickas till LLM.

Ingen kostnadsförfoljning är implementerad.

Modellupptäckt

ModusTillhandahållareEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleModelllista API
anthropic-modelsAnthropicModelllista API
openai-compatible-modelsDeepSeek, Qwen, Mistral, osv./v1/models
openrouter-modelsOpenRouterModelllista API
github-modelsGitHub ModelsInférsion API
noneAzure OpenAIInaktiverat (kräver distributionsnamn)

Snabbstart

  1. Välj en tillhandahållare — DeepSeek (Kina), OpenAI (Internationellt) eller Ollama (Lokal/Gratis)
  2. Ange API-nyckeln — Inställningar → Notemd → Tillhandahållare → API-nyckel
  3. Testa anslutningen — Klicka på testknappen
  4. Valfritt: Modeller per uppgift — Aktivera useMultiModelSettings och konfigurera separat

För Ollama: inget API-nyckel behövs. Se bara till att ollama serve körs.


Nästa steg

  • 📝 Konceptnoter — Använder modell för extraktion per uppgift
  • 🎨 Diagram — Använder diagrammodell per uppgift
  • 🔍 Forskning — Använder modell specifik för forskning
  • ⚙️ Konfiguration — Fullständig referens för inställningar