Skip to main content

LLM Tjänsteudbydere

💡TL;DR

Notemd støder 36 LLM tjänsteudbydere over 4 transporttyper. Alle API anrop bruger rå HTTP (ingen SDK:er) med automatisk forsøg igen, transportfallback og 5-minutters cache for svar. Val af modell per opgave giver dig mulighed for at bruge billige modeller til konceptuddragelse og kraftfulde modeller til forskning. Ingen API-nyckel er nødvendig for lokale tjänsteudbydere (Ollama, LMStudio).

Dette er en del af Obsidian AI Knowledge Management Guide.

Kategorier for tjänsteudbydere

Molnet-tjänsteudbydere

LeverandørStandardbasen URLStandardmodellTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Gateway-/Proxy-tjänsteudbydere

LeverandørStandardbasen URLStandardmodellOpmerkninger
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetLægger til HTTP-Referer + X-Title-heder
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniLægger til X-GitHub-Api-Version-heder
AIHubMixaihubmix.com/v1gpt-4o-miniLægger til APP-Code-heder
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelValgfri API-nyckel
Ny APIlocalhost:3000/v1gpt-4.1Valgfri API-nyckel
OpenAI Compatible(anvenderekonfigureret)your-model-idEgen endpoint

Kinesiske leverandører

LeverandørStandard base URLStandardmodellOpmerkninger
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusFokuseret på kodning
Doubaoark.cn-beijing.volces.com/api/v3(kræves endpoint ID)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, Kinas endpoint
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, international endpoint
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlattform for modellhosting
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao kræver en Ark endpoint ID (format: ep-xxxxxxxx-xxxx-xxxx). Den standardmæssige placeringen må erstattes.

Lokale leverandører

LeverandørStandard base URLStandardmodellOpmerkninger
Ollamalocalhost:11434/apillama3Ingen API-klave. NDJSON-strømning. Modelludvikling gennem /api/tags
LMStudiolocalhost:1234/v1local-modelSendes "EMPTY" som bearer-token. OpenAI-kompatibel udvikling
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(anvenderekonfigureret)gpt-4oDeployment-navn i URL. api-key header

Modellval per opgave

Notemd understøtter en uafhængig leverandør og modell for hver opgave. Aktiver med useMultiModelSettings: true.

Tilgængelige opgaver

OpgaveIndstillingssleutelStandardleverandør
Føj links (wiki-link-indsætning)addLinksProvider / addLinksModelDeepSeek
Forskning (websearch + sammanfattelse)researchProvider / researchModelDeepSeek
Generer fra titelgenerateTitleProvider / generateTitleModelDeepSeek
OversætningtranslateProvider / translateModelDeepSeek
DiagramgenereringsummarizeToMermaidProvider / ModelDeepSeek
KonceptuddragelseextractConceptsProvider / ModelDeepSeek
UrsprungstekstuddragelseextractOriginalTextProvider / ModelDeepSeek

Løsningsordning

  1. Hvis useMultiModelSettings er aktiveret → brug den opgavespecifikke leverandør + modell
  2. Hvis overraskelse af opgavemodellen er tom → falde tilbake til leverandørens standardmodell
  3. Hvis opgaveleverandøren er ugyldig → falde tilbake til den globale activeProvider
  4. Hvis useMultiModelSettings er slukket → bruger alle opgaver det globale activeProvider

Anbefalede konfigurationer

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Kaldarkitektur

Transportlag

  1. Obsidian requestUrl — primært (indbygget, virker på alle platforme)
  2. Desktop HTTP — Node.js http/https moduler (strømning + lange anmodninger)
  3. Web fetch — fallback når Node.js moduler er utilgængelige

Pluginen eskalerer automatisk mellem transportlag på tidsvarende netværksfejl.

Gennemføringslogik

  • Normalt mode (enableStableApiCall: false): En enkelt forsøg. Ved tidsvarende fejl eskaleres det automatisk til et stabilt gennemførsel.
  • Stabilt gennemføringsmode (enableStableApiCall: true): Op til 4 forsøg (1 + 3 gennemførelser) med 5 sekunders intervalle.
  • Tidsvarende fejl, der utløser gennemførsel: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Udgivelsesfri: HTTP 400, 401, 403, 404

Svarcaching

5-minutters LRU-cache i minnet, keydet af leverandør + modell + temperatur + prompt + indhold. Folgende identiske anmodninger indenfor 5 minutter returnerer cacheede resultater omedelbart.

Hantering af resonemangsmodeller

Modeller, der ikke understøtter system-rollen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), har automatisk system- og brugerprompter kombineret til en enkelt brugermeddelelse.

DeepSeek-specifik: thinkingEnabled tilføjer { thinking: { type: 'enabled' } } til anmodningen. reasoningEffort (lave/midlere/høje) sendes som reasoning_effort. Kontrollerer, at maksimal udgangstal af token er ≥ 8000, når tænkning er aktiveret.

Token-estimering

estimateTokens(text): Math.ceil(text.length / 4) — heuristik med 4 tegn per token. Bruges til at sikre maxResearchContentTokens før sendelse til LLM.

Der er ingen kostholdning implementeret.

Modelludvikling

ModusTilbydereEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleModellliste API
anthropic-modelsAnthropicModellliste API
openai-compatible-modelsDeepSeek, Qwen, Mistral, osv./v1/models
openrouter-modelsOpenRouterModellliste API
github-modelsGitHub ModelsInferenc API
noneAzure OpenAIUdfyldt (kræver udviklingsnavn)

Snabb start

  1. Vælg en tilbyder — DeepSeek (Kina), OpenAI (Internationelt) eller Ollama (Lokal/Frit)
  2. Indtast API-koden — Indstillinger → Notemd → Tilbyder → API-kode
  3. Prøv forbindelsen — Klik på prøv-knappen
  4. Valgfrit: Modeller per opgave — Aktiver useMultiModelSettings og konfigurér dem individuelt

For Ollama: der er ingen API-klæde nødvendig. Sikre dig bare for at ollama serve er i gang.


Næste trin

  • 📝 Konceptnoter — Bruger modellen til extraction per opgave
  • 🎨 Diagrammer — Bruger diagrammodellen per opgave
  • 🔍 Forskning — Bruger modellen specifikt for forskning
  • ⚙️ Konfiguration — Fuld referens over indstillinger