Перейти к основному содержимому

Провайдеры LLM

💡TL;DR
Notemd содержит 36 профилей пяти семейств: OpenAI-compatible, Anthropic, Google, Azure OpenAI и Ollama. Сопоставьте протокол адреса, учётные данные и доступную модель. Начальные значения редактируются и не обещают текущую доступность модели.

Категории​

Значения ниже взяты из реестра. Сохраняйте схему и путь URL, заменяйте шаблоны действительными моделями/deployment. Доступ, стоимость и сроки поддержки определяет провайдер.

Облачные​

ПровайдерНачальная модельНачальный URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oНастройте адрес своего ресурса Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Шлюзы и прокси​

ПровайдерНачальная модельНачальный URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Локальные​

ПровайдерНачальная модельНачальный URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Китайские провайдеры​

См. региональную настройку. Категория не гарантирует географическую доступность или качество китайского языка. Сопоставляйте регион аккаунта, адрес и права модели.

Выбор по задачам​

Включите useMultiModelSettings для отдельных профилей и моделей. Иначе используется activeProvider. Пустой override использует настроенную модель провайдера; ошибочный сохранённый профиль согласуется с активным при загрузке.

ЗадачаПрофильПереопределение модели
СсылкиaddLinksProvideraddLinksModel
Генерация заголовкаgenerateTitleProvidergenerateTitleModel
Исследовательская сводкаresearchProviderresearchModel
ПереводtranslateProvidertranslateModel
ПонятияextractConceptsProviderextractConceptsModel
Сводка MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Исходные отрывкиextractOriginalTextProviderextractOriginalTextModel

Изначально активный и сохранённые профили задач — DeepSeek. Смена активного не заменяет включённые индивидуальные маршруты. Проверьте каждый до работы с частным текстом.

Архитектура вызовов​

Транспорт​

Используются запросы Obsidian и fallback с разбором протокола: на desktop возможны Node HTTP streams, в других средах fetch. Claude за OpenAI-compatible шлюзом использует профиль шлюза, не нативный Anthropic.

Повторы​

Стабильный режим выключен; применимые начальные параметры — три повтора и интервал пять секунд. Временные сетевые сбои могут включить общий fallback/повтор. Авторизацию и неверную модель надо исправлять. Длинный запрос всё ещё ограничен таймаутами, моделью и квотами.

Кэш ответов​

Успешный ответ может повторно использовать ограниченный кэш памяти. Адрес, модель, параметры, prompt и текст входят в идентичность запроса. Это не постоянное хранение, учёт расходов или гарантия отсутствия нового платного вызова.

Рассуждающие модели​

Reasoning/thinking зависят от правил профиля и модели. Не переносите параметры между протоколами. Проверяйте точную задачу: поддержка чата не означает поддержку любых настроек токенов/сэмплирования.

Оценка токенов​

Длина текста и лимит вывода не равны точному расходу провайдера. Для оплаты смотрите фактическое использование. Универсальной оценки стоимости нет.

Обнаружение моделей​

Fetch models доступен по возможностям профиля; некоторым deployment нужно ручное имя. Права списка и генерации независимы. Проверить подключение в режиме models-then-chat может пройти только по списку; chat-only делает короткую генерацию. Проверьте настоящую задачу и её формат.

  • Anthropic/Google используют нативные списки.
  • Ollama перечисляет полученные теги, LM Studio — модели сервера.
  • Azure требует deployment и API-версию.
  • Шлюз может запрещать список, но разрешать конкретный chat ID.

Быстрый старт​

  1. Выберите профиль в Settings → Notemd.
  2. Введите адрес, реквизиты и доступную модель/deployment.
  3. Проверьте соединение и пробную заметку.
  4. Изучите результат перед пакетами и индивидуальными маршрутами.

Локально сначала подготовьте модель и сервер. Ollama не требует ключа; LM Studio допускает необязательный ключ, начальный EMPTY. Если сервер защищён, задайте настоящий token. Локальная LLM не отключает сетевые требования веб-поиска.

Далее​