Hoppa till huvudinnehållet

LLM-leverantörer

💡TL;DR
Notemd har 36 profiler i fem familjer: OpenAI-compatible, Anthropic, Google, Azure OpenAI och Ollama. Välj endpointens protokoll, tillåtet datainnehåll och tillgänglig modell. Standardvärden är redigerbara exempel, inga löften om aktuell modelltillgång.

Kategorier​

Tabellerna återger registret. Behåll URL-schema och full sökväg, ersätt platshållare med verklig deployment. Leverantören styr rättigheter, priser och modellavveckling.

Moln​

LeverantörStandardmodellBas-URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oAnge endpointen för din Azure-resurs
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateways och proxyservrar​

LeverantörStandardmodellBas-URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Lokalt​

LeverantörStandardmodellBas-URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Kinesiska leverantörer​

Se regional konfiguration. Kategorin garanterar inte geografisk åtkomst eller kvalitet på kinesiska. Matcha kontoregion, endpoint och modellbehörighet.

Val per uppgift​

useMultiModelSettings aktiverar separata leverantörer/modeller, annars används activeProvider. Tom modelloverride använder leverantörens modell. Ogiltiga sparade leverantörsval justeras mot aktiv leverantör vid inläsning.

UppgiftLeverantörsinställningModelloverride
LänkaraddLinksProvideraddLinksModel
TitelgenereringgenerateTitleProvidergenerateTitleModel
ForskningssammanfattningresearchProviderresearchModel
ÖversättningtranslateProvidertranslateModel
BegreppextractConceptsProviderextractConceptsModel
Mermaid-sammanfattningsummarizeToMermaidProvidersummarizeToMermaidModel
OriginaltextextractOriginalTextProviderextractOriginalTextModel

Aktiv och sparade uppgiftsleverantörer börjar som DeepSeek. Byte av aktiv leverantör ersätter inte aktiverade uppgiftsvägar. Kontrollera dem före privat material.

Anropsarkitektur​

Transportlager​

Obsidian-anrop kombineras med protokollmedveten fallback. Skrivbord kan använda Node HTTP-strömmar, andra miljöer fetch. Claude bakom en OpenAI-kompatibel gateway använder gatewayprofilen, inte native Anthropic.

Omförsök​

Stabilt läge är av; tillämpliga standardvärden är tre omförsök med fem sekunders intervall. Tillfälliga fel kan använda delad fallback/omförsök. Rätta behörighet och modellkonfiguration separat. Långa anrop kan fortfarande nå timeout, gränser eller kvoter.

Svarscache​

En begränsad minnescache kan återanvända lyckade svar. Endpoint, modell, genereringsparametrar, prompt och innehåll bidrar till identiteten. Det är ingen permanent lagring eller kostnadsmätare och garanterar inte gratis omkörning.

Resonerande modeller​

Reasoning/thinking följer profil-/modellregler. Kopiera inte protokollspecifika parametrar mellan tjänster. Testa uppgiften; vissa modeller avvisar token-, sampling- eller resonemangsinställningar.

Tokenuppskattning​

Textlängd och utdataövergränser är inga exakta providertoken. Använd faktisk förbrukning vid kostnadsbedömning; ingen universell kostnadskalkyl finns.

Hitta modeller​

Fetch models fungerar där profilen stöder det. Vissa deployments kräver manuell identifierare. List- och genereringsrättigheter är separata. Test connection kan lyckas på en lista för models-then-chat; chat-only gör kort generering. Kontrollera riktig uppgift och format.

  • Anthropic/Google använder native upptäckt.
  • Ollama listar hämtade taggar, LM Studio servermodeller.
  • Azure kräver deployment och API-version.
  • Gateways kan blockera listning men tillåta uttryckligt modell-ID.

Kom igång​

  1. Välj rätt profil i Settings → Notemd.
  2. Ange endpoint, nyckel och tillgänglig modell/deployment.
  3. Testa anslutning och en testanteckning.
  4. Granska utdata och rapport före batcher eller uppgiftsstyrning.

Lokalt måste server och modell vara förberedda. Ollama kräver ingen nyckel; LM Studios nyckel är valfri och börjar som EMPTY. Ange verklig token när servern kräver det. Lokal LLM gör inte webbsökning offline.

Nästa steg​