Skip to main content

LLM Tjenerleverandører

💡TL;DR

Notemd støtter 36 LLM leverandører over 4 transporttyper. Alle API kaller bruker rå HTTP (ingen SDK:er) med automatisk gjentakelse, fallback til transport og 5-minutters cache for svar. Valg av modell per oppgave gjør at du kan bruke billige modeller for konseptutvinning og kraftige modeller for forskning. Ingen API-klave er nødvendig for lokale leverandører (Ollama, LMStudio).

Dette er en del av Obsidian AI Knowledge Management Guide.

Kategorier for leverandører

Cloud-tjenerleverandører

LeverandørStandardbasen URLStandardmodellTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Gateway-/Proxy-tjenerleverandører

LeverandørStandardbasen URLStandardmodellNotater
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetLegger til HTTP-Referer + X-Title-headerer
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniLegger til X-GitHub-Api-Version-header
AIHubMixaihubmix.com/v1gpt-4o-miniLegger til APP-Code-header
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelValgfri API-klave
Nytt APIlocalhost:3000/v1gpt-4.1Valgfri API-klave
OpenAI Compatible(brukerkonfigurert)your-model-idEgen endpoint

Kinesiske leverandører

LeverandørStandardbasen URLStandardmodellNotater
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusFokusert på kodning
Doubaoark.cn-beijing.volces.com/api/v3(endpoint-ID er nødvendig)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, kinesisk endpoint
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, internasjonal endpoint
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlattform for modellhosting
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao krever en Ark-endpoint-ID (format: ep-xxxxxxxx-xxxx-xxxx). Standardplaceholderen må erstattes.

Lokale leverandører

LeverandørStandardbasen URLStandardmodellNotater
Ollamalocalhost:11434/apillama3Ingen API-klave. NDJSON-strømming. Modelloppdagelse gjennom /api/tags
LMStudiolocalhost:1234/v1local-modelSendes "EMPTY" som bearer-token. OpenAI-kompatibel oppdagelse
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(brukerkonfigurert)gpt-4oDeployment-navn i URL. api-key header

Modellval per oppgave

Notemd støtter uavhengig leverandør og modell for hver oppgave. Aktiver med useMultiModelSettings: true.

Tilgjengelige oppgaver

OppgaveInnstillingssleutelStandardleverandør
Legg til lenker (wiki-lenke-innsatt)addLinksProvider / addLinksModelDeepSeek
Forskning (websearch + sammanfattelse)researchProvider / researchModelDeepSeek
Generer fra titelgenerateTitleProvider / generateTitleModelDeepSeek
OversettelsetranslateProvider / translateModelDeepSeek
DiagramgenereringsummarizeToMermaidProvider / ModelDeepSeek
KonseptutdragextractConceptsProvider / ModelDeepSeek
UrsprungstekstutdragextractOriginalTextProvider / ModelDeepSeek

Løsningsordning

  1. Dersom useMultiModelSettings er aktivert → bruk oppgavespesifikk leverandør + modell
  2. Dersom oppgavemodell-overridelse er tom → fall back til leverandørens standardmodell
  3. Dersom oppgavleverandøren er ugyldig → fall back til den globale activeProvider
  4. Dersom useMultiModelSettings er slått av → bruker alle oppgaver det globale activeProvider

Anbefalte konfigurasjoner

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Kallarkitektur

Transportlag

  1. Obsidian requestUrl — primær (innbygd, fungerer på alle platformer)
  2. Desktop HTTP — Node.js http/https moduler (strømmering + lange forespørsler)
  3. Web fetch — fallback når Node.js-moduler er utilgjengelige

Pluginet eskalerer automatisk mellom transportlag på tidsvis nettverksfeil.

Gjenprøvelogik

  • Normalmodus (enableStableApiCall: false): En enkelt prøve. Ved tidsvis feil eskaleres det automatisk til stabil gjenprøve.
  • Stabil gjenprøvelmodus (enableStableApiCall: true): Opp til 4 prøver (1 + 3 gjenprøver) med 5 sekunders mellomrom.
  • Tidsvis feil som utløser gjenprøve: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Ugjenprøvelig: HTTP 400, 401, 403, 404

Svarcache

5-minutters LRU-cache i minnet, keyert av leverandør + modell + temperatur + prompt + innhold. Slike identiske forespørsler innen 5 minutter returnerer cache-de resultater umiddelbart.

Hantering av resonansmodeller

Modeller som ikke støtter system-rollen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) har automatisk system- og brukerprompter kombinert til en enkelt brukermeddelelse.

DeepSeek-specific: thinkingEnabled legger til { thinking: { type: 'enabled' } } i forespørselen. reasoningEffort (lav/middel/høy) sendes som reasoning_effort. Kontrollerer at maks utdataantall token er ≥ 8000 når tænkning er aktiveret.

Token Estimasjon

estimateTokens(text): Math.ceil(text.length / 4) — heuristik med 4 tegn per token. Brukes for å sikre maxResearchContentTokens før sending til LLM.

Ingen kostholdstilgang er implementert.

Modelloppdagelse

ModusTilbydereEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleModellliste API
anthropic-modelsAnthropicModellliste API
openai-compatible-modelsDeepSeek, Qwen, Mistral, osv./v1/models
openrouter-modelsOpenRouterModellliste API
github-modelsGitHub ModelsInferens API
noneAzure OpenAIUaktiveret (kræver deployment-navn)

Snabb start

  1. Vælg en tilbyder — DeepSeek (Kina), OpenAI (Internasjonal), eller Ollama (Lokal/Fri)
  2. Indtast API-koden — Innstillinger → Notemd → Tilbyder → API-kode
  3. Prøv forbindelsen — Klikk på prøv-knappen
  4. Valgfritt: Modeller per oppgave — Aktiver useMultiModelSettings og konfigurere hver for seg

For Ollama: ingen API-klucz nødvendig. Sikre bare at ollama serve er i gang.


Neste trinn

  • 📝 Konseptnotater — Bruker modell for extraksjon per oppgave
  • 🎨 Diagrammer — Bruker modell for diagrammer per oppgave
  • 🔍 Forskning — Bruker modell spesifikt for forskning
  • ⚙️ Konfigurasjon — Full referanse til innstillinger