Skifte til hovedindhold

LLM-udbydere

💡TL;DR
Der er 36 profiler i fem familier: OpenAI-compatible, Anthropic, Google, Azure OpenAI og Ollama. Vælg endpointets protokol, tilladt indhold og tilgængelig model. Startværdier er redigerbare eksempler, ikke løfter om aktuel modeladgang.

Kategorier​

Tabellerne kommer fra registret. Bevar URL-skema og fuld sti; erstat pladsholdere med din faktiske deployment. Udbyderen bestemmer adgang, priser og udfasning af modeller.

Cloud​

UdbyderStartmodelBasis-URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oAngiv endpointet for din Azure-ressource
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateways og proxyer​

UdbyderStartmodelBasis-URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Lokalt​

UdbyderStartmodelBasis-URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Kinesiske udbydere​

Se regional konfiguration. Kategorien garanterer ikke geografisk adgang eller kinesisk sprogkvalitet. Afstem kontoregion, endpoint og modelrettigheder.

Valg pr. opgave​

useMultiModelSettings giver separate udbydere/modeloverrides; ellers bruges activeProvider. Tom override bruger udbyderens model. Ugyldige gemte udbydervalg afstemmes med den aktive udbyder ved indlæsning.

OpgaveUdbyderindstillingModeloverride
LinksaddLinksProvideraddLinksModel
TitelgenereringgenerateTitleProvidergenerateTitleModel
ResearchopsummeringresearchProviderresearchModel
OversættelsetranslateProvidertranslateModel
BegreberextractConceptsProviderextractConceptsModel
Mermaid-opsummeringsummarizeToMermaidProvidersummarizeToMermaidModel
OriginaltekstextractOriginalTextProviderextractOriginalTextModel

Aktiv og gemte opgaveudbydere starter som DeepSeek. Ændring af aktiv udbyder erstatter ikke aktiverede opgaveruter. Kontrollér dem før privat indhold.

Anmodningsarkitektur​

Transportlag​

Notemd bruger Obsidian-anmodninger og protokolbevidst fallback. Desktop kan bruge Node HTTP-strømme, andre miljøer fetch. Claude bag en OpenAI-kompatibel gateway bruger gatewayprofilen, ikke native Anthropic.

Nye forsøg​

Stabil tilstand er fra; relevante standarder er tre gentagelser med fem sekunders mellemrum. Midlertidige fejl kan bruge fælles fallback/gentagelse. Ret adgang og modelkonfiguration særskilt. Lange anmodninger kan stadig ramme timeout, grænser og kvoter.

Svarcache​

En begrænset hukommelsescache kan genbruge vellykkede svar. Endpoint, model, genereringsparametre, prompt og indhold indgår i identiteten. Det er hverken varig lagring eller en prismåler og garanterer ikke gratis gentagelse.

Ræsonnerende modeller​

Reasoning/thinking følger profil- og modelregler. Kopiér ikke protokolspecifikke parametre mellem tjenester. Test opgaven; modeller kan afvise token-, sampling- og ræsonnementsindstillinger.

Tokenestimat​

Tekstlængde og outputgrænser er ikke præcise udbydertokenantal. Brug faktisk forbrug til prisberegning. Der findes ingen universel omkostningsgaranti.

Find modeller​

Fetch models virker, hvor profilen understøtter det. Visse deployments kræver manuelt ID. Liste- og genereringsrettigheder er uafhængige. Test connection kan bestås med liste alene ved models-then-chat; chat-only genererer kort. Verificér en rigtig opgave og outputformat.

  • Anthropic og Google bruger native modelopdagelse.
  • Ollama viser hentede tags, LM Studio servermodeller.
  • Azure kræver deployment og API-version.
  • Gateways kan blokere lister, men tillade generering med præcist ID.

Kom i gang​

  1. Vælg korrekt profil i Settings → Notemd.
  2. Angiv endpoint, nøgle og tilgængelig model/deployment.
  3. Test forbindelse og en testnote.
  4. Kontrollér output/rapport før batcher eller opgaverouting.

Lokal server/model skal være klar. Ollama kræver ingen nøgle; LM Studios nøgle er valgfri og starter som EMPTY. Brug en rigtig token, hvor serveren kræver den. Lokal LLM gør ikke websøgning offline.

Næste trin​