LLM-leverandører
Kategorier
Tabellene gjengir registeret. Behold URL-skjema og full sti, og erstatt plassholdere med faktisk deployment. Leverandøren bestemmer rettigheter, priser og avvikling av modeller.
Sky
| Leverandør | Startmodell | Basis-URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Angi endepunktet for Azure-ressursen din |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gatewayer og proxyer
| Leverandør | Startmodell | Basis-URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Lokalt
| Leverandør | Startmodell | Basis-URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Kinesiske leverandører
Se regionalt oppsett. Kategorien garanterer ikke geografisk tilgang eller kinesisk språkkvalitet. Samordne kontoregion, endepunkt og modellrettigheter.
Velg per oppgave
useMultiModelSettings gir egne leverandører/modelloverstyringer; ellers gjelder activeProvider. Tom overstyring bruker leverandørens modell. Ugyldige lagrede valg justeres mot aktiv leverandør ved innlasting.
| Oppgave | Leverandørinnstilling | Modelloverstyring |
|---|---|---|
| Lenker | addLinksProvider | addLinksModel |
| Tittelgenerering | generateTitleProvider | generateTitleModel |
| Undersøkelsesoppsummering | researchProvider | researchModel |
| Oversettelse | translateProvider | translateModel |
| Begreper | extractConceptsProvider | extractConceptsModel |
| Mermaid-oppsummering | summarizeToMermaidProvider | summarizeToMermaidModel |
| Originaltekst | extractOriginalTextProvider | extractOriginalTextModel |
Aktiv og lagrede oppgaveleverandører starter som DeepSeek. Å bytte aktiv leverandør erstatter ikke aktiverte oppgaveruter. Kontroller dem før privat materiale.
Forespørselsarkitektur
Transportlag
Notemd bruker Obsidian-forespørsler og protokollbevisst fallback. Skrivebord kan bruke Node HTTP-strømmer, andre miljøer fetch. Claude bak en OpenAI-kompatibel gateway bruker gatewayprofilen, ikke native Anthropic.
Nye forsøk
Stabil modus er av; relevante standardverdier er tre nye forsøk med fem sekunders mellomrom. Midlertidige feil kan bruke felles fallback/gjentakelse. Rett tilgang og modellkonfigurasjon separat. Lange kall kan fortsatt nå tidsavbrudd, grenser og kvoter.
Svarcache
En avgrenset minnecache kan gjenbruke vellykkede svar. Endepunkt, modell, genereringsparametere, instruksjon og innhold inngår i identiteten. Dette er ikke permanent lagring eller kostnadsmåling og garanterer ikke gratis gjentakelse.
Resonnerende modeller
Reasoning/thinking følger profil- og modellregler. Ikke kopier protokollspesifikke parametere mellom tjenester. Test den aktuelle oppgaven; modeller kan avvise token-, sampling- eller resonneringsvalg.
Tokenanslag
Tekstlengde og svargrenser er ikke eksakte leverandørtokens. Bruk faktisk forbruk til kostnadsvurdering. Ingen universell prisberegning finnes.
Finn modeller
Fetch models virker der profilen støtter det. Enkelte deployments krever manuelt ID. Liste- og genereringsrettigheter er forskjellige. Test connection kan lykkes med listen alene ved models-then-chat; chat-only genererer kort. Test en virkelig oppgave og svarform.
- Anthropic og Google bruker native modelloppdagelse.
- Ollama viser hentede tagger, LM Studio servermodeller.
- Azure krever deployment og API-versjon.
- Gatewayer kan sperre lister, men tillate kall med eksplisitt modell-ID.
Kom i gang
- Velg rett profil i Settings → Notemd.
- Angi endepunkt, nøkkel og tilgjengelig modell/deployment.
- Test forbindelse og et engangsnotat.
- Se resultat/rapport før batcher eller oppgaveruting.
Lokal server/modell må være klar. Ollama krever ingen nøkkel; LM Studio har valgfri nøkkel med startverdi EMPTY. Bruk reell token når serveren krever det. Lokal LLM gjør ikke nettsøk frakoblet.