Провайдери LLM
Категорії
Таблиці походять із реєстру. Збережіть схему URL і повний шлях; замініть приклади своїм розгортанням. Права, ціни й виведення моделей з експлуатації визначає провайдер.
Хмара
| Провайдер | Типова модель | Базовий URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Задайте endpoint свого ресурсу Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Шлюзи та проксі
| Провайдер | Типова модель | Базовий URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Локальні сервери
| Провайдер | Типова модель | Базовий URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Китайські провайдери
Дивіться регіональні налаштування. Категорія не гарантує географічної доступності чи якості китайської мови. Узгодьте регіон облікового запису, endpoint і доступ до моделі.
Вибір для завдання
useMultiModelSettings дозволяє окремі профілі/моделі; інакше діє activeProvider. Порожня модель бере модель провайдера. Недійсні збережені вибори провайдерів під час завантаження нормалізуються до активного.
| Завдання | Параметр провайдера | Поле моделі |
|---|---|---|
| Посилання | addLinksProvider | addLinksModel |
| Генерація за назвами | generateTitleProvider | generateTitleModel |
| Підсумок дослідження | researchProvider | researchModel |
| Переклад | translateProvider | translateModel |
| Поняття | extractConceptsProvider | extractConceptsModel |
| Mermaid-підсумок | summarizeToMermaidProvider | summarizeToMermaidModel |
| Оригінальний текст | extractOriginalTextProvider | extractOriginalTextModel |
Активний і збережені провайдери завдань починаються з DeepSeek. Зміна лише активного не замінює ввімкнених маршрутів завдань. Перевірте їх перед приватним матеріалом.
Архітектура запитів
Транспортні рівні
Notemd використовує запити Obsidian та fallback із розумінням протоколу. На настільній системі можливі потоки Node HTTP, в інших середовищах fetch. Claude через шлюз OpenAI-compatible потребує профілю шлюзу, не нативного Anthropic API.
Повторні спроби
Стабільний режим вимкнений; пов’язані початкові параметри — три повтори з інтервалом п’ять секунд. Тимчасові помилки можуть проходити через спільний fallback і повтори. Доступ та конфігурацію моделі виправляйте окремо. Довгі запити все одно можуть перевищити час або квоту.
Кеш відповідей
Обмежений кеш пам’яті може повторно використати успішну відповідь. Ідентичність визначають endpoint, модель, параметри генерації, інструкція та вміст. Це не постійне сховище й не лічильник вартості, без гарантії безкоштовного повтору.
Моделі міркування
Reasoning/thinking дотримуються правил профілю й моделі. Не переносіть специфічні параметри між протоколами. Модель може відхилити токени, семплінг чи параметри міркування; перевіряйте справжнє завдання.
Оцінка токенів
Довжина тексту й ліміт виходу не є точними токенами провайдера. Рахуйте вартість із фактичного споживання. Загальної гарантії оцінки немає.
Пошук моделей
Fetch models працює там, де підтримується; деякі розгортання потребують ручного ID. Права списку й генерації незалежні. Перевірити підключення у models-then-chat може пройти лише списком; chat-only виконує коротку генерацію. Перевірте справжній формат і завдання.
- Anthropic і Google мають власні API пошуку моделей.
- Ollama показує завантажені теги, LM Studio — моделі сервера.
- Azure потребує deployment і версії API.
- Шлюз може заборонити список, але дозволити генерацію з явним ID.
Початок
- Виберіть правильний профіль у Settings → Notemd.
- Укажіть endpoint, ключ і доступну модель/deployment.
- Перевірте з’єднання й тестову нотатку.
- До пакетів або маршрутів завдань перегляньте результат і звіт.
Локальні сервер і модель мають бути готові. Ollama не потребує ключа; LM Studio приймає його необов’язково, типово EMPTY. Де потрібна автентифікація, задайте справжній токен. Локальний LLM не робить вебпошук автономним.