Перейти до основного контенту

Провайдери LLM

💡TL;DR
Реєстр містить 36 профілів п’яти сімейств: OpenAI-compatible, Anthropic, Google, Azure OpenAI та Ollama. Вибирайте за протоколом endpoint, політикою даних і доступною моделлю. Початкові значення — приклади, що старіють, а не гарантія поточної доступності.

Категорії​

Таблиці походять із реєстру. Збережіть схему URL і повний шлях; замініть приклади своїм розгортанням. Права, ціни й виведення моделей з експлуатації визначає провайдер.

Хмара​

ПровайдерТипова модельБазовий URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oЗадайте endpoint свого ресурсу Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Шлюзи та проксі​

ПровайдерТипова модельБазовий URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Локальні сервери​

ПровайдерТипова модельБазовий URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Китайські провайдери​

Дивіться регіональні налаштування. Категорія не гарантує географічної доступності чи якості китайської мови. Узгодьте регіон облікового запису, endpoint і доступ до моделі.

Вибір для завдання​

useMultiModelSettings дозволяє окремі профілі/моделі; інакше діє activeProvider. Порожня модель бере модель провайдера. Недійсні збережені вибори провайдерів під час завантаження нормалізуються до активного.

ЗавданняПараметр провайдераПоле моделі
ПосиланняaddLinksProvideraddLinksModel
Генерація за назвамиgenerateTitleProvidergenerateTitleModel
Підсумок дослідженняresearchProviderresearchModel
ПерекладtranslateProvidertranslateModel
ПоняттяextractConceptsProviderextractConceptsModel
Mermaid-підсумокsummarizeToMermaidProvidersummarizeToMermaidModel
Оригінальний текстextractOriginalTextProviderextractOriginalTextModel

Активний і збережені провайдери завдань починаються з DeepSeek. Зміна лише активного не замінює ввімкнених маршрутів завдань. Перевірте їх перед приватним матеріалом.

Архітектура запитів​

Транспортні рівні​

Notemd використовує запити Obsidian та fallback із розумінням протоколу. На настільній системі можливі потоки Node HTTP, в інших середовищах fetch. Claude через шлюз OpenAI-compatible потребує профілю шлюзу, не нативного Anthropic API.

Повторні спроби​

Стабільний режим вимкнений; пов’язані початкові параметри — три повтори з інтервалом п’ять секунд. Тимчасові помилки можуть проходити через спільний fallback і повтори. Доступ та конфігурацію моделі виправляйте окремо. Довгі запити все одно можуть перевищити час або квоту.

Кеш відповідей​

Обмежений кеш пам’яті може повторно використати успішну відповідь. Ідентичність визначають endpoint, модель, параметри генерації, інструкція та вміст. Це не постійне сховище й не лічильник вартості, без гарантії безкоштовного повтору.

Моделі міркування​

Reasoning/thinking дотримуються правил профілю й моделі. Не переносіть специфічні параметри між протоколами. Модель може відхилити токени, семплінг чи параметри міркування; перевіряйте справжнє завдання.

Оцінка токенів​

Довжина тексту й ліміт виходу не є точними токенами провайдера. Рахуйте вартість із фактичного споживання. Загальної гарантії оцінки немає.

Пошук моделей​

Fetch models працює там, де підтримується; деякі розгортання потребують ручного ID. Права списку й генерації незалежні. Перевірити підключення у models-then-chat може пройти лише списком; chat-only виконує коротку генерацію. Перевірте справжній формат і завдання.

  • Anthropic і Google мають власні API пошуку моделей.
  • Ollama показує завантажені теги, LM Studio — моделі сервера.
  • Azure потребує deployment і версії API.
  • Шлюз може заборонити список, але дозволити генерацію з явним ID.

Початок​

  1. Виберіть правильний профіль у Settings → Notemd.
  2. Укажіть endpoint, ключ і доступну модель/deployment.
  3. Перевірте з’єднання й тестову нотатку.
  4. До пакетів або маршрутів завдань перегляньте результат і звіт.

Локальні сервер і модель мають бути готові. Ollama не потребує ключа; LM Studio приймає його необов’язково, типово EMPTY. Де потрібна автентифікація, задайте справжній токен. Локальний LLM не робить вебпошук автономним.

Далі​