Pääse pääsisään

LLM-palveluntarjoajat

💡TL;DR
Profiileja on 36 viidessä perheessä: OpenAI-compatible, Anthropic, Google, Azure OpenAI ja Ollama. Valitse osoitteesi protokolla, sallittu aineisto ja käytettävä malli. Alkuarvot ovat muokattavia esimerkkejä, eivät lupaus mallien nykyisestä saatavuudesta.

Luokat​

Taulukoiden arvot tulevat rekisteristä. Säilytä URL-skeema ja koko polku, korvaa paikkamerkit oikealla käyttöönotolla. Tarjoaja määrää oikeudet, hinnat ja mallien poistumisen.

Pilvipalvelut​

TarjoajaAlkumalliPerusosoite
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oMääritä Azure-resurssisi osoite
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Yhdyskäytävät ja välityspalvelimet​

TarjoajaAlkumalliPerusosoite
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Paikalliset​

TarjoajaAlkumalliPerusosoite
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Kiinalaiset tarjoajat​

Katso alueellinen määritys. Luokka ei takaa maantieteellistä saatavuutta tai kiinan kielen laatua. Sovita tilialue, osoite ja mallioikeudet yhteen.

Tehtäväkohtainen valinta​

useMultiModelSettings ottaa erilliset tarjoajat/malliohitukset käyttöön; muuten käytetään activeProvider-asetusta. Tyhjä ohitus käyttää tarjoajan mallia. Virheelliset tallennetut tarjoajavalinnat sovitetaan aktiiviseen tarjoajaan ladattaessa.

TehtäväTarjoaja-asetusMalliohitus
LinkitaddLinksProvideraddLinksModel
OtsikkogenerointigenerateTitleProvidergenerateTitleModel
TutkimusyhteenvetoresearchProviderresearchModel
KäännöstranslateProvidertranslateModel
KäsitteetextractConceptsProviderextractConceptsModel
Mermaid-yhteenvetosummarizeToMermaidProvidersummarizeToMermaidModel
AlkuperäistekstiextractOriginalTextProviderextractOriginalTextModel

Aktiivinen ja tallennetut tehtävätarjoajat alkavat DeepSeekistä. Pelkkä aktiivisen tarjoajan vaihto ei korvaa käytössä olevia tehtäväreittejä. Tarkista ne ennen yksityistä aineistoa.

Pyyntöarkkitehtuuri​

Siirtokerrokset​

Notemd käyttää Obsidian-pyyntöjä ja protokollatietoista varareittiä. Työpöydällä voidaan käyttää Node HTTP -virtoja, muualla fetchiä. OpenAI-yhteensopivan yhdyskäytävän Claude käyttää yhdyskäytäväprofiilia, ei natiivia Anthropicia.

Uusintayritykset​

Vakaa tila on pois; soveltuvat oletukset ovat kolme uusintaa viiden sekunnin välein. Tilapäisvirheet voivat käyttää yhteistä fallback-/uusintapolkua. Korjaa oikeus- ja malliasetukset erikseen. Pitkä pyyntö voi silti ylittää aikakatkaisun, rajan tai kiintiön.

Vastausvälimuisti​

Rajattu muistivälimuisti voi käyttää onnistuneita vastauksia uudelleen. Osoite, malli, generointiparametrit, kehote ja sisältö vaikuttavat identiteettiin. Tämä ei ole pysyvä tallennus tai kustannusmittari eikä takaa maksutonta uusintaa.

Päättelymallit​

Reasoning/thinking noudattaa profiili- ja mallisääntöjä. Älä kopioi protokollakohtaisia parametreja palvelusta toiseen. Testaa sama tehtävä: malli voi hylätä token-, otanta- tai päättelyasetuksia.

Tokenien arviointi​

Tekstipituus ja vastauksen rajat eivät ole tarkkoja tarjoajan tokenmääriä. Käytä todellista kulutusta laskutuksen arviointiin. Yleistä kustannustakuuta ei ole.

Mallien löytäminen​

Fetch models toimii tuetuissa profiileissa. Jotkin käyttöönotot vaativat käsin annetun tunnisteen. Luettelointi- ja generointioikeudet ovat eri asia. Test connection voi onnistua listalla tilassa models-then-chat; chat-only generoi lyhyesti. Tarkista oikea tehtävä ja tulosmuoto.

  • Anthropic ja Google käyttävät natiivia mallihakua.
  • Ollama näyttää noudetut tagit, LM Studio palvelinmallit.
  • Azure tarvitsee deploymentin ja API-version.
  • Yhdyskäytävä voi estää listan mutta sallia pyynnön tarkalla mallilla.

Alkuun​

  1. Valitse oikea profiili Settings → Notemd -näkymässä.
  2. Anna osoite, avain ja saatavilla oleva malli/deployment.
  3. Testaa yhteys ja testimuistiinpano.
  4. Tarkista tulos ja raportti ennen eräajoa tai tehtäväreititystä.

Paikallinen palvelin ja malli valmistellaan ensin. Ollama ei vaadi avainta; LM Studion avain on valinnainen, alkuarvo EMPTY. Käytä oikeaa tunnistetta palvelimen sitä vaatiessa. Paikallinen LLM ei tee verkkohakua offline-toiminnoksi.

Seuraavaksi​