Провайдеры LLM
Категории
Значения ниже взяты из реестра. Сохраняйте схему и путь URL, заменяйте шаблоны действительными моделями/deployment. Доступ, стоимость и сроки поддержки определяет провайдер.
Облачные
| Провайдер | Начальная модель | Начальный URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Настройте адрес своего ресурса Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Шлюзы и прокси
| Провайдер | Начальная модель | Начальный URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Локальные
| Провайдер | Начальная модель | Начальный URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Китайские провайдеры
См. региональную настройку. Категория не гарантирует географическую доступность или качество китайского языка. Сопоставляйте регион аккаунта, адрес и права модели.
Выбор по задачам
Включите useMultiModelSettings для отдельных профилей и моделей. Иначе используется activeProvider. Пустой override использует настроенную модель провайдера; ошибочный сохранённый профиль согласуется с активным при загрузке.
| Задача | Профиль | Переопределение модели |
|---|---|---|
| Ссылки | addLinksProvider | addLinksModel |
| Генерация заголовка | generateTitleProvider | generateTitleModel |
| Исследовательская сводка | researchProvider | researchModel |
| Перевод | translateProvider | translateModel |
| Понятия | extractConceptsProvider | extractConceptsModel |
| Сводка Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Исходные отрывки | extractOriginalTextProvider | extractOriginalTextModel |
Изначально активный и сохранённые профили задач — DeepSeek. Смена активного не заменяет включённые индивидуальные маршруты. Проверьте каждый до работы с частным текстом.
Архитектура вызовов
Транспорт
Используются запросы Obsidian и fallback с разбором протокола: на desktop возможны Node HTTP streams, в других средах fetch. Claude за OpenAI-compatible шлюзом использует профиль шлюза, не нативный Anthropic.
Повторы
Стабильный режим выключен; применимые начальные параметры — три повтора и интервал пять секунд. Временные сетевые сбои могут включить общий fallback/повтор. Авторизацию и неверную модель надо исправлять. Длинный запрос всё ещё ограничен таймаутами, моделью и квотами.
Кэш ответов
Успешный ответ может повторно использовать ограниченный кэш памяти. Адрес, модель, параметры, prompt и текст входят в идентичность запроса. Это не постоянное хранение, учёт расходов или гарантия отсутствия нового платного вызова.
Рассуждающие модели
Reasoning/thinking зависят от правил профиля и модели. Не переносите параметры между протоколами. Проверяйте точную задачу: поддержка чата не означает поддержку любых настроек токенов/сэмплирования.
Оценка токенов
Длина текста и лимит вывода не равны точному расходу провайдера. Для оплаты смотрите фактическое использование. Универсальной оценки стоимости нет.
Обнаружение моделей
Fetch models доступен по возможностям профиля; некоторым deployment нужно ручное имя. Права списка и генерации независимы. Проверить подключение в режиме models-then-chat может пройти только по списку; chat-only делает короткую генерацию. Проверьте настоящую задачу и её формат.
- Anthropic/Google используют нативные списки.
- Ollama перечисляет полученные теги, LM Studio — модели сервера.
- Azure требует deployment и API-версию.
- Шлюз может запрещать список, но разрешать конкретный chat ID.
Быстрый старт
- Выберите профиль в Settings → Notemd.
- Введите адрес, реквизиты и доступную модель/deployment.
- Проверьте соединение и пробную заметку.
- Изучите результат перед пакетами и индивидуальными маршрутами.
Локально сначала подготовьте модель и сервер. Ollama не требует ключа; LM Studio допускает необязательный ключ, начальный EMPTY. Если сервер защищён, задайте настоящий token. Локальная LLM не отключает сетевые требования веб-поиска.