Skip to main content

Поставщики LLM

💡TL;DR

Notemd поддерживает 36 поставщиков LLM в 4 типах транспорта. Все вызовы API осуществляются напрямую через HTTP (без SDK), с автоматической попыткой повтора, переключением на альтернативный транспорт и кэшированием ответов в течение 5 минут. Возможность выбора модели для каждой задачи позволяет использовать дешёвые модели для извлечения концепций и мощные модели для исследований. Для локальных поставщиков (Ollama, LMStudio) ключ API не требуется.

Это часть Obsidian Руководства по управлению знаниями с ИИ.

Категории поставщиков

Облачные поставщики

ПоставщикБазовый URL по умолчаниюСтандартная модельТемпература
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Шлюзовые/прокси‑поставщики

ПоставщикБазовый URL по умолчаниюСтандартная модельПримечания
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetДобавляет заголовки HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniДобавляет заголовок X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniДобавляет заголовок APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelНеобязательный ключ API
Новый APIlocalhost:3000/v1gpt-4.1Необязательный ключ API
OpenAI Compatible(настроено пользователем)your-model-idПерсонализированный конечный пункт

Поставщики из Китая

ПоставщикБазовый шаблон URLСтандартная модельПримечания
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusОриентировано на программирование
Doubaoark.cn-beijing.volces.com/api/v3(требуется ID конечной точки)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Конечный пункт Zhipu, Китай
Z AIapi.z.ai/api/paas/v4glm-5Конечный пункт Zhipu, международный
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BПлатформа хостинга моделей
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao требует идентификатора конечного пункта Ark (формат: ep-xxxxxxxx-xxxx-xxxx). По умолчанию этот местоимение необходимо заменить.

Локальные поставщики

ПоставщикБазовый шаблон URLСтандартная модельПримечания
Ollamalocalhost:11434/apillama3Отсутствует ключ API. Стриминг NDJSON. Обнаружение моделей через /api/tags
LMStudiolocalhost:1234/v1local-modelОтправляет "EMPTY" в качестве токена авторизации. Обнаружение совместимое с OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(настроено пользователем)gpt-4oИмя развертывания в URL. Заголовок api-key

Выбор модели для каждой задачи

Notemd поддерживает независимого поставщика и модель для каждой задачи. Включить с помощью useMultiModelSettings: true.

Доступные задачи

ЗадачаКлюч настроекСтандартный поставщик
Добавление ссылок (вставка wiki-ссылки)addLinksProvider / addLinksModelDeepSeek
Исследование (поиск в интернете + краткое изложение)researchProvider / researchModelDeepSeek
Генерация из заголовкаgenerateTitleProvider / generateTitleModelDeepSeek
ПереводtranslateProvider / translateModelDeepSeek
Создание диаграммsummarizeToMermaidProvider / ModelDeepSeek
Извлечение концепцийextractConceptsProvider / ModelDeepSeek
Извлечение оригинального текстаextractOriginalTextProvider / ModelDeepSeek

Порядок разрешения

  1. Если useMultiModelSettings включён → использовать поставщика и модель, специфичные для задачи
  2. Если параметр переопределения модели задачи пуст — вернуться к стандартной модели поставщика
  3. Если поставщик задачи недействителен — вернуться к глобальному activeProvider
  4. Если useMultiModelSettings выключен → все задачи используют глобальный activeProvider

Рекомендуемые конфигурации

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Архитектура вызова API

Слои передачи

  1. Obsidian requestUrl — основной (встроенный, работает на всех платформах)
  2. Desktop HTTP — модули Node.js http/https (стриминг + длинные запросы)
  3. Web fetch — альтернатива при отсутствии модулей Node.js

Плагин автоматически переключается между способами передачи при временных сетевых ошибках.

Логика повторных попыток

  • Обычный режим (enableStableApiCall: false): одна попытка. При временной неудаче автоматически переходит к стабильному повтору.
  • Режим стабильного повтора (enableStableApiCall: true): до 4 попыток (1 + 3 повтора) с интервалом в 5 секунд.
  • Временные ошибки, вызывающие повтор: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Не подлежат повтору: HTTP 400, 401, 403, 404

Кэширование ответов

5-минутный кэш LRU в памяти, ключи формируются из провайдера + модели + температуры + запроса + содержимого. Последующие идентичные запросы в течение 5 минут возвращают результаты из кэша мгновенно.

Обработка моделей рассуждений

Модели, которые не поддерживают роль system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), автоматически объединяют системные и пользовательские запросы в одно сообщение пользователя.

DeepSeek-специфично: thinkingEnabled добавляет { thinking: { type: 'enabled' } } в запрос. reasoningEffort (низкий/средний/высокий) передаётся как reasoning_effort. Проверяется, что максимальное количество токенов вывода ≥ 8000 при включённом режиме размышлений.

Оценка количества токенов

estimateTokens(text): Math.ceil(text.length / 4) — гипотеза 4 символа на токен. Используется для обеспечения maxResearchContentTokens перед отправкой в LLM.

Отслеживание затрат не реализовано.

Обнаружение моделей

РежимПровайдерыКонечная точка
ollama-tagsOllama/api/tags
google-modelsGoogleСписок моделей API
anthropic-modelsAnthropicСписок моделей API
openai-compatible-modelsDeepSeek, Qwen, Mistral и т. д./v1/models
openrouter-modelsOpenRouterСписок моделей API
github-modelsGitHub ModelsИнференс API
noneAzure OpenAIОтключено (требуется имя развертывания)

Быстрый старт

  1. Выберите провайдера — DeepSeek (Китай), OpenAI (Международный) или Ollama (Локальный/бесплатный)
  2. Введите ключ API — Настройки → Notemd → Провайдер → Ключ API
  3. Проверить соединение — Нажмите кнопку теста
  4. Необязательно: модели для каждой задачи — Включите useMultiModelSettings и настройте их отдельно

Для Ollama: ключ API не требуется. Просто убедитесь, что ollama serve работает.


Следующие шаги