LLM-leverantörer
Kategorier
Tabellerna återger registret. Behåll URL-schema och full sökväg, ersätt platshållare med verklig deployment. Leverantören styr rättigheter, priser och modellavveckling.
Moln
| Leverantör | Standardmodell | Bas-URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Ange endpointen för din Azure-resurs |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateways och proxyservrar
| Leverantör | Standardmodell | Bas-URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Lokalt
| Leverantör | Standardmodell | Bas-URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Kinesiska leverantörer
Se regional konfiguration. Kategorin garanterar inte geografisk åtkomst eller kvalitet på kinesiska. Matcha kontoregion, endpoint och modellbehörighet.
Val per uppgift
useMultiModelSettings aktiverar separata leverantörer/modeller, annars används activeProvider. Tom modelloverride använder leverantörens modell. Ogiltiga sparade leverantörsval justeras mot aktiv leverantör vid inläsning.
| Uppgift | Leverantörsinställning | Modelloverride |
|---|---|---|
| Länkar | addLinksProvider | addLinksModel |
| Titelgenerering | generateTitleProvider | generateTitleModel |
| Forskningssammanfattning | researchProvider | researchModel |
| Översättning | translateProvider | translateModel |
| Begrepp | extractConceptsProvider | extractConceptsModel |
| Mermaid-sammanfattning | summarizeToMermaidProvider | summarizeToMermaidModel |
| Originaltext | extractOriginalTextProvider | extractOriginalTextModel |
Aktiv och sparade uppgiftsleverantörer börjar som DeepSeek. Byte av aktiv leverantör ersätter inte aktiverade uppgiftsvägar. Kontrollera dem före privat material.
Anropsarkitektur
Transportlager
Obsidian-anrop kombineras med protokollmedveten fallback. Skrivbord kan använda Node HTTP-strömmar, andra miljöer fetch. Claude bakom en OpenAI-kompatibel gateway använder gatewayprofilen, inte native Anthropic.
Omförsök
Stabilt läge är av; tillämpliga standardvärden är tre omförsök med fem sekunders intervall. Tillfälliga fel kan använda delad fallback/omförsök. Rätta behörighet och modellkonfiguration separat. Långa anrop kan fortfarande nå timeout, gränser eller kvoter.
Svarscache
En begränsad minnescache kan återanvända lyckade svar. Endpoint, modell, genereringsparametrar, prompt och innehåll bidrar till identiteten. Det är ingen permanent lagring eller kostnadsmätare och garanterar inte gratis omkörning.
Resonerande modeller
Reasoning/thinking följer profil-/modellregler. Kopiera inte protokollspecifika parametrar mellan tjänster. Testa uppgiften; vissa modeller avvisar token-, sampling- eller resonemangsinställningar.
Tokenuppskattning
Textlängd och utdataövergränser är inga exakta providertoken. Använd faktisk förbrukning vid kostnadsbedömning; ingen universell kostnadskalkyl finns.
Hitta modeller
Fetch models fungerar där profilen stöder det. Vissa deployments kräver manuell identifierare. List- och genereringsrättigheter är separata. Test connection kan lyckas på en lista för models-then-chat; chat-only gör kort generering. Kontrollera riktig uppgift och format.
- Anthropic/Google använder native upptäckt.
- Ollama listar hämtade taggar, LM Studio servermodeller.
- Azure kräver deployment och API-version.
- Gateways kan blockera listning men tillåta uttryckligt modell-ID.
Kom igång
- Välj rätt profil i Settings → Notemd.
- Ange endpoint, nyckel och tillgänglig modell/deployment.
- Testa anslutning och en testanteckning.
- Granska utdata och rapport före batcher eller uppgiftsstyrning.
Lokalt måste server och modell vara förberedda. Ollama kräver ingen nyckel; LM Studios nyckel är valfri och börjar som EMPTY. Ange verklig token när servern kräver det. Lokal LLM gör inte webbsökning offline.