Poskytovatelé LLM
Kategorie
Tabulky vycházejí z registru. Zachovejte schéma URL a úplnou cestu; příklady nahraďte skutečným nasazením. Oprávnění, ceny i ukončování modelů řídí poskytovatel.
Cloud
| Poskytovatel | Výchozí model | Základní URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Nastavte endpoint svého prostředku Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Brány a proxy
| Poskytovatel | Výchozí model | Základní URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Lokální servery
| Poskytovatel | Výchozí model | Základní URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Čínští poskytovatelé
Viz regionální nastavení. Kategorie nezaručuje dostupnost v určité oblasti ani kvalitu čínštiny. Slaďte region účtu, endpoint a oprávnění modelu.
Volba podle úlohy
useMultiModelSettings povoluje samostatné profily/modely; jinak platí activeProvider. Prázdný model přebírá model poskytovatele. Neplatné uložené volby poskytovatelů úloh se při načtení normalizují na aktivního.
| Úloha | Nastavení poskytovatele | Pole modelu |
|---|---|---|
| Odkazy | addLinksProvider | addLinksModel |
| Generování podle názvů | generateTitleProvider | generateTitleModel |
| Shrnutí rešerše | researchProvider | researchModel |
| Překlad | translateProvider | translateModel |
| Pojmy | extractConceptsProvider | extractConceptsModel |
| Shrnutí Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Původní text | extractOriginalTextProvider | extractOriginalTextModel |
Aktivní i uložené profily úloh začínají jako DeepSeek. Změna pouze aktivního profilu nepřepíše zapnuté směrování úloh. Ověřte je před prací se soukromým materiálem.
Architektura požadavků
Vrstvy transportu
Notemd používá požadavky Obsidianu a fallback se znalostí protokolu. Na desktopu může použít Node HTTP streamy, jinde fetch. Claude za OpenAI-compatible bránou používá profil brány, nikoli nativní Anthropic API.
Opakování
Stabilní režim je vypnutý; související výchozí nastavení jsou tři opakování v pětisekundových intervalech. Přechodné chyby mohou projít společným fallbackem a opakováním. Oprávnění a modelovou konfiguraci opravte zvlášť. Dlouhý požadavek stále může vypršet či překročit kvótu.
Cache odpovědí
Omezená cache v paměti může znovu použít úspěšnou odpověď. Identitu určují endpoint, model, parametry generování, prompt a obsah. Nejde o trvalé úložiště ani měřič nákladů; nezaručuje bezplatné opakování.
Modely s uvažováním
Reasoning/thinking se řídí pravidly profilu a modelu. Nepřenášejte parametry specifické pro protokol mezi službami. Modely mohou odmítat nastavení tokenů, vzorkování či uvažování; ověřte skutečnou úlohu.
Odhad tokenů
Délka textu a výstupní limit nejsou přesným počtem tokenů poskytovatele. Náklady počítejte podle skutečné spotřeby. Obecná záruka odhadu ceny neexistuje.
Zjištění modelů
Fetch models funguje tam, kde je podporováno. Některá nasazení potřebují ruční ID. Oprávnění seznamu a generování jsou nezávislá. Test connection u models-then-chat může uspět pouhým seznamem; chat-only provede krátké generování. Ověřte skutečnou úlohu i formát.
- Anthropic a Google používají vlastní discovery API.
- Ollama vypisuje stažené tagy, LM Studio modely serveru.
- Azure vyžaduje deployment a verzi API.
- Brány mohou zakázat výpis a přitom povolit generování s explicitním ID.
Začátek
- Vyberte odpovídající profil v Settings → Notemd.
- Zadejte endpoint, klíč a dostupný model/deployment.
- Ověřte spojení a zkušební poznámku.
- Před dávkami nebo směrováním úloh zkontrolujte výstup a zprávu.
Lokálně musí být server i model připraveny. Ollama klíč nevyžaduje; LM Studio jej má volitelný, výchozí EMPTY. Pokud nasazení vyžaduje autentizaci, použijte skutečný token. Lokální LLM nedělá webové hledání offline.