LLM-palveluntarjoajat
Luokat
Taulukoiden arvot tulevat rekisteristä. Säilytä URL-skeema ja koko polku, korvaa paikkamerkit oikealla käyttöönotolla. Tarjoaja määrää oikeudet, hinnat ja mallien poistumisen.
Pilvipalvelut
| Tarjoaja | Alkumalli | Perusosoite |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Määritä Azure-resurssisi osoite |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Yhdyskäytävät ja välityspalvelimet
| Tarjoaja | Alkumalli | Perusosoite |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Paikalliset
| Tarjoaja | Alkumalli | Perusosoite |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Kiinalaiset tarjoajat
Katso alueellinen määritys. Luokka ei takaa maantieteellistä saatavuutta tai kiinan kielen laatua. Sovita tilialue, osoite ja mallioikeudet yhteen.
Tehtäväkohtainen valinta
useMultiModelSettings ottaa erilliset tarjoajat/malliohitukset käyttöön; muuten käytetään activeProvider-asetusta. Tyhjä ohitus käyttää tarjoajan mallia. Virheelliset tallennetut tarjoajavalinnat sovitetaan aktiiviseen tarjoajaan ladattaessa.
| Tehtävä | Tarjoaja-asetus | Malliohitus |
|---|---|---|
| Linkit | addLinksProvider | addLinksModel |
| Otsikkogenerointi | generateTitleProvider | generateTitleModel |
| Tutkimusyhteenveto | researchProvider | researchModel |
| Käännös | translateProvider | translateModel |
| Käsitteet | extractConceptsProvider | extractConceptsModel |
| Mermaid-yhteenveto | summarizeToMermaidProvider | summarizeToMermaidModel |
| Alkuperäisteksti | extractOriginalTextProvider | extractOriginalTextModel |
Aktiivinen ja tallennetut tehtävätarjoajat alkavat DeepSeekistä. Pelkkä aktiivisen tarjoajan vaihto ei korvaa käytössä olevia tehtäväreittejä. Tarkista ne ennen yksityistä aineistoa.
Pyyntöarkkitehtuuri
Siirtokerrokset
Notemd käyttää Obsidian-pyyntöjä ja protokollatietoista varareittiä. Työpöydällä voidaan käyttää Node HTTP -virtoja, muualla fetchiä. OpenAI-yhteensopivan yhdyskäytävän Claude käyttää yhdyskäytäväprofiilia, ei natiivia Anthropicia.
Uusintayritykset
Vakaa tila on pois; soveltuvat oletukset ovat kolme uusintaa viiden sekunnin välein. Tilapäisvirheet voivat käyttää yhteistä fallback-/uusintapolkua. Korjaa oikeus- ja malliasetukset erikseen. Pitkä pyyntö voi silti ylittää aikakatkaisun, rajan tai kiintiön.
Vastausvälimuisti
Rajattu muistivälimuisti voi käyttää onnistuneita vastauksia uudelleen. Osoite, malli, generointiparametrit, kehote ja sisältö vaikuttavat identiteettiin. Tämä ei ole pysyvä tallennus tai kustannusmittari eikä takaa maksutonta uusintaa.
Päättelymallit
Reasoning/thinking noudattaa profiili- ja mallisääntöjä. Älä kopioi protokollakohtaisia parametreja palvelusta toiseen. Testaa sama tehtävä: malli voi hylätä token-, otanta- tai päättelyasetuksia.
Tokenien arviointi
Tekstipituus ja vastauksen rajat eivät ole tarkkoja tarjoajan tokenmääriä. Käytä todellista kulutusta laskutuksen arviointiin. Yleistä kustannustakuuta ei ole.
Mallien löytäminen
Fetch models toimii tuetuissa profiileissa. Jotkin käyttöönotot vaativat käsin annetun tunnisteen. Luettelointi- ja generointioikeudet ovat eri asia. Test connection voi onnistua listalla tilassa models-then-chat; chat-only generoi lyhyesti. Tarkista oikea tehtävä ja tulosmuoto.
- Anthropic ja Google käyttävät natiivia mallihakua.
- Ollama näyttää noudetut tagit, LM Studio palvelinmallit.
- Azure tarvitsee deploymentin ja API-version.
- Yhdyskäytävä voi estää listan mutta sallia pyynnön tarkalla mallilla.
Alkuun
- Valitse oikea profiili Settings → Notemd -näkymässä.
- Anna osoite, avain ja saatavilla oleva malli/deployment.
- Testaa yhteys ja testimuistiinpano.
- Tarkista tulos ja raportti ennen eräajoa tai tehtäväreititystä.
Paikallinen palvelin ja malli valmistellaan ensin. Ollama ei vaadi avainta; LM Studion avain on valinnainen, alkuarvo EMPTY. Käytä oikeaa tunnistetta palvelimen sitä vaatiessa. Paikallinen LLM ei tee verkkohakua offline-toiminnoksi.