Skip til hovedinnholdet

LLM-leverandører

💡TL;DR
Det finnes 36 profiler i fem familier: OpenAI-compatible, Anthropic, Google, Azure OpenAI og Ollama. Velg endepunktets protokoll, tillatt innhold og tilgjengelig modell. Startverdier er redigerbare eksempler, ikke løfter om dagens modelltilgang.

Kategorier​

Tabellene gjengir registeret. Behold URL-skjema og full sti, og erstatt plassholdere med faktisk deployment. Leverandøren bestemmer rettigheter, priser og avvikling av modeller.

Sky​

LeverandørStartmodellBasis-URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oAngi endepunktet for Azure-ressursen din
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gatewayer og proxyer​

LeverandørStartmodellBasis-URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Lokalt​

LeverandørStartmodellBasis-URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Kinesiske leverandører​

Se regionalt oppsett. Kategorien garanterer ikke geografisk tilgang eller kinesisk språkkvalitet. Samordne kontoregion, endepunkt og modellrettigheter.

Velg per oppgave​

useMultiModelSettings gir egne leverandører/modelloverstyringer; ellers gjelder activeProvider. Tom overstyring bruker leverandørens modell. Ugyldige lagrede valg justeres mot aktiv leverandør ved innlasting.

OppgaveLeverandørinnstillingModelloverstyring
LenkeraddLinksProvideraddLinksModel
TittelgenereringgenerateTitleProvidergenerateTitleModel
UndersøkelsesoppsummeringresearchProviderresearchModel
OversettelsetranslateProvidertranslateModel
BegreperextractConceptsProviderextractConceptsModel
Mermaid-oppsummeringsummarizeToMermaidProvidersummarizeToMermaidModel
OriginaltekstextractOriginalTextProviderextractOriginalTextModel

Aktiv og lagrede oppgaveleverandører starter som DeepSeek. Å bytte aktiv leverandør erstatter ikke aktiverte oppgaveruter. Kontroller dem før privat materiale.

Forespørselsarkitektur​

Transportlag​

Notemd bruker Obsidian-forespørsler og protokollbevisst fallback. Skrivebord kan bruke Node HTTP-strømmer, andre miljøer fetch. Claude bak en OpenAI-kompatibel gateway bruker gatewayprofilen, ikke native Anthropic.

Nye forsøk​

Stabil modus er av; relevante standardverdier er tre nye forsøk med fem sekunders mellomrom. Midlertidige feil kan bruke felles fallback/gjentakelse. Rett tilgang og modellkonfigurasjon separat. Lange kall kan fortsatt nå tidsavbrudd, grenser og kvoter.

Svarcache​

En avgrenset minnecache kan gjenbruke vellykkede svar. Endepunkt, modell, genereringsparametere, instruksjon og innhold inngår i identiteten. Dette er ikke permanent lagring eller kostnadsmåling og garanterer ikke gratis gjentakelse.

Resonnerende modeller​

Reasoning/thinking følger profil- og modellregler. Ikke kopier protokollspesifikke parametere mellom tjenester. Test den aktuelle oppgaven; modeller kan avvise token-, sampling- eller resonneringsvalg.

Tokenanslag​

Tekstlengde og svargrenser er ikke eksakte leverandørtokens. Bruk faktisk forbruk til kostnadsvurdering. Ingen universell prisberegning finnes.

Finn modeller​

Fetch models virker der profilen støtter det. Enkelte deployments krever manuelt ID. Liste- og genereringsrettigheter er forskjellige. Test connection kan lykkes med listen alene ved models-then-chat; chat-only genererer kort. Test en virkelig oppgave og svarform.

  • Anthropic og Google bruker native modelloppdagelse.
  • Ollama viser hentede tagger, LM Studio servermodeller.
  • Azure krever deployment og API-versjon.
  • Gatewayer kan sperre lister, men tillate kall med eksplisitt modell-ID.

Kom i gang​

  1. Velg rett profil i Settings → Notemd.
  2. Angi endepunkt, nøkkel og tilgjengelig modell/deployment.
  3. Test forbindelse og et engangsnotat.
  4. Se resultat/rapport før batcher eller oppgaveruting.

Lokal server/modell må være klar. Ollama krever ingen nøkkel; LM Studio har valgfri nøkkel med startverdi EMPTY. Bruk reell token når serveren krever det. Lokal LLM gjør ikke nettsøk frakoblet.

Neste trinn​