Přeskočit k hlavnímu obsahu

Poskytovatelé LLM

💡TL;DR
Registr má 36 profilů pěti rodin: OpenAI-compatible, Anthropic, Google, Azure OpenAI a Ollama. Vyberte protokol endpointu, přípustné zacházení s daty a dostupný model. Výchozí hodnoty jsou měnící se příklady, nikoli záruka aktuální dostupnosti.

Kategorie​

Tabulky vycházejí z registru. Zachovejte schéma URL a úplnou cestu; příklady nahraďte skutečným nasazením. Oprávnění, ceny i ukončování modelů řídí poskytovatel.

Cloud​

PoskytovatelVýchozí modelZákladní URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oNastavte endpoint svého prostředku Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Brány a proxy​

PoskytovatelVýchozí modelZákladní URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Lokální servery​

PoskytovatelVýchozí modelZákladní URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Čínští poskytovatelé​

Viz regionální nastavení. Kategorie nezaručuje dostupnost v určité oblasti ani kvalitu čínštiny. Slaďte region účtu, endpoint a oprávnění modelu.

Volba podle úlohy​

useMultiModelSettings povoluje samostatné profily/modely; jinak platí activeProvider. Prázdný model přebírá model poskytovatele. Neplatné uložené volby poskytovatelů úloh se při načtení normalizují na aktivního.

ÚlohaNastavení poskytovatelePole modelu
OdkazyaddLinksProvideraddLinksModel
Generování podle názvůgenerateTitleProvidergenerateTitleModel
Shrnutí rešeršeresearchProviderresearchModel
PřekladtranslateProvidertranslateModel
PojmyextractConceptsProviderextractConceptsModel
Shrnutí MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Původní textextractOriginalTextProviderextractOriginalTextModel

Aktivní i uložené profily úloh začínají jako DeepSeek. Změna pouze aktivního profilu nepřepíše zapnuté směrování úloh. Ověřte je před prací se soukromým materiálem.

Architektura požadavků​

Vrstvy transportu​

Notemd používá požadavky Obsidianu a fallback se znalostí protokolu. Na desktopu může použít Node HTTP streamy, jinde fetch. Claude za OpenAI-compatible bránou používá profil brány, nikoli nativní Anthropic API.

Opakování​

Stabilní režim je vypnutý; související výchozí nastavení jsou tři opakování v pětisekundových intervalech. Přechodné chyby mohou projít společným fallbackem a opakováním. Oprávnění a modelovou konfiguraci opravte zvlášť. Dlouhý požadavek stále může vypršet či překročit kvótu.

Cache odpovědí​

Omezená cache v paměti může znovu použít úspěšnou odpověď. Identitu určují endpoint, model, parametry generování, prompt a obsah. Nejde o trvalé úložiště ani měřič nákladů; nezaručuje bezplatné opakování.

Modely s uvažováním​

Reasoning/thinking se řídí pravidly profilu a modelu. Nepřenášejte parametry specifické pro protokol mezi službami. Modely mohou odmítat nastavení tokenů, vzorkování či uvažování; ověřte skutečnou úlohu.

Odhad tokenů​

Délka textu a výstupní limit nejsou přesným počtem tokenů poskytovatele. Náklady počítejte podle skutečné spotřeby. Obecná záruka odhadu ceny neexistuje.

Zjištění modelů​

Fetch models funguje tam, kde je podporováno. Některá nasazení potřebují ruční ID. Oprávnění seznamu a generování jsou nezávislá. Test connection u models-then-chat může uspět pouhým seznamem; chat-only provede krátké generování. Ověřte skutečnou úlohu i formát.

  • Anthropic a Google používají vlastní discovery API.
  • Ollama vypisuje stažené tagy, LM Studio modely serveru.
  • Azure vyžaduje deployment a verzi API.
  • Brány mohou zakázat výpis a přitom povolit generování s explicitním ID.

Začátek​

  1. Vyberte odpovídající profil v Settings → Notemd.
  2. Zadejte endpoint, klíč a dostupný model/deployment.
  3. Ověřte spojení a zkušební poznámku.
  4. Před dávkami nebo směrováním úloh zkontrolujte výstup a zprávu.

Lokálně musí být server i model připraveny. Ollama klíč nevyžaduje; LM Studio jej má volitelný, výchozí EMPTY. Pokud nasazení vyžaduje autentizaci, použijte skutečný token. Lokální LLM nedělá webové hledání offline.

Dále​