LLM Tjenerleverandører
Notemd støtter 36 LLM leverandører over 4 transporttyper. Alle API kaller bruker rå HTTP (ingen SDK:er) med automatisk gjentakelse, fallback til transport og 5-minutters cache for svar. Valg av modell per oppgave gjør at du kan bruke billige modeller for konseptutvinning og kraftige modeller for forskning. Ingen API-klave er nødvendig for lokale leverandører (Ollama, LMStudio).
Dette er en del av Obsidian AI Knowledge Management Guide.
Kategorier for leverandører
Cloud-tjenerleverandører
| Leverandør | Standardbasen URL | Standardmodell | Temperature |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Gateway-/Proxy-tjenerleverandører
| Leverandør | Standardbasen URL | Standardmodell | Notater |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Legger til HTTP-Referer + X-Title-headerer |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Legger til X-GitHub-Api-Version-header |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Legger til APP-Code-header |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Valgfri API-klave |
| Nytt API | localhost:3000/v1 | gpt-4.1 | Valgfri API-klave |
| OpenAI Compatible | (brukerkonfigurert) | your-model-id | Egen endpoint |
Kinesiske leverandører
| Leverandør | Standardbasen URL | Standardmodell | Notater |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Fokusert på kodning |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (endpoint-ID er nødvendig) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Zhipu, kinesisk endpoint |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Zhipu, internasjonal endpoint |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Plattform for modellhosting |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao krever en Ark-endpoint-ID (format: ep-xxxxxxxx-xxxx-xxxx). Standardplaceholderen må erstattes.
Lokale leverandører
| Leverandør | Standardbasen URL | Standardmodell | Notater |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Ingen API-klave. NDJSON-strømming. Modelloppdagelse gjennom /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Sendes "EMPTY" som bearer-token. OpenAI-kompatibel oppdagelse |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (brukerkonfigurert) | gpt-4o | Deployment-navn i URL. api-key header |
Modellval per oppgave
Notemd støtter uavhengig leverandør og modell for hver oppgave. Aktiver med useMultiModelSettings: true.
Tilgjengelige oppgaver
| Oppgave | Innstillingssleutel | Standardleverandør |
|---|---|---|
| Legg til lenker (wiki-lenke-innsatt) | addLinksProvider / addLinksModel | DeepSeek |
| Forskning (websearch + sammanfattelse) | researchProvider / researchModel | DeepSeek |
| Generer fra titel | generateTitleProvider / generateTitleModel | DeepSeek |
| Oversettelse | translateProvider / translateModel | DeepSeek |
| Diagramgenerering | summarizeToMermaidProvider / Model | DeepSeek |
| Konseptutdrag | extractConceptsProvider / Model | DeepSeek |
| Ursprungstekstutdrag | extractOriginalTextProvider / Model | DeepSeek |
Løsningsordning
- Dersom
useMultiModelSettingser aktivert → bruk oppgavespesifikk leverandør + modell - Dersom oppgavemodell-overridelse er tom → fall back til leverandørens standardmodell
- Dersom oppgavleverandøren er ugyldig → fall back til den globale
activeProvider - Dersom
useMultiModelSettingser slått av → bruker alle oppgaver det globaleactiveProvider
Anbefalte konfigurasjoner
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
API Kallarkitektur
Transportlag
- Obsidian
requestUrl— primær (innbygd, fungerer på alle platformer) - Desktop HTTP — Node.js
http/httpsmoduler (strømmering + lange forespørsler) - Web
fetch— fallback når Node.js-moduler er utilgjengelige
Pluginet eskalerer automatisk mellom transportlag på tidsvis nettverksfeil.
Gjenprøvelogik
- Normalmodus (
enableStableApiCall: false): En enkelt prøve. Ved tidsvis feil eskaleres det automatisk til stabil gjenprøve. - Stabil gjenprøvelmodus (
enableStableApiCall: true): Opp til 4 prøver (1 + 3 gjenprøver) med 5 sekunders mellomrom. - Tidsvis feil som utløser gjenprøve:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Ugjenprøvelig: HTTP 400, 401, 403, 404
Svarcache
5-minutters LRU-cache i minnet, keyert av leverandør + modell + temperatur + prompt + innhold. Slike identiske forespørsler innen 5 minutter returnerer cache-de resultater umiddelbart.
Hantering av resonansmodeller
Modeller som ikke støtter system-rollen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) har automatisk system- og brukerprompter kombinert til en enkelt brukermeddelelse.
DeepSeek-specific: thinkingEnabled legger til { thinking: { type: 'enabled' } } i forespørselen. reasoningEffort (lav/middel/høy) sendes som reasoning_effort. Kontrollerer at maks utdataantall token er ≥ 8000 når tænkning er aktiveret.
Token Estimasjon
estimateTokens(text): Math.ceil(text.length / 4) — heuristik med 4 tegn per token. Brukes for å sikre maxResearchContentTokens før sending til LLM.
Ingen kostholdstilgang er implementert.
Modelloppdagelse
| Modus | Tilbydere | Endpoint |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Modellliste API | |
anthropic-models | Anthropic | Modellliste API |
openai-compatible-models | DeepSeek, Qwen, Mistral, osv. | /v1/models |
openrouter-models | OpenRouter | Modellliste API |
github-models | GitHub Models | Inferens API |
none | Azure OpenAI | Uaktiveret (kræver deployment-navn) |
Snabb start
- Vælg en tilbyder — DeepSeek (Kina), OpenAI (Internasjonal), eller Ollama (Lokal/Fri)
- Indtast API-koden — Innstillinger → Notemd → Tilbyder → API-kode
- Prøv forbindelsen — Klikk på prøv-knappen
- Valgfritt: Modeller per oppgave — Aktiver
useMultiModelSettingsog konfigurere hver for seg
For Ollama: ingen API-klucz nødvendig. Sikre bare at ollama serve er i gang.
Neste trinn
- 📝 Konseptnotater — Bruker modell for extraksjon per oppgave
- 🎨 Diagrammer — Bruker modell for diagrammer per oppgave
- 🔍 Forskning — Bruker modell spesifikt for forskning
- ⚙️ Konfigurasjon — Full referanse til innstillinger