Поставщики LLM
Notemd поддерживает 36 поставщиков LLM в 4 типах транспорта. Все вызовы API осуществляются напрямую через HTTP (без SDK), с автоматической попыткой повтора, переключением на альтернативный транспорт и кэшированием ответов в течение 5 минут. Возможность выбора модели для каждой задачи позволяет использовать дешёвые модели для извлечения концепций и мощные модели для исследований. Для локальных поставщиков (Ollama, LMStudio) ключ API не требуется.
Это часть Obsidian Руководства по управлению знаниями с ИИ.
Категории поставщиков
Облачные поставщики
| Поставщик | Базовый URL по умолчанию | Стандартная модель | Температура |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Шлюзовые/прокси‑поставщики
| Поставщик | Базовый URL по умолчанию | Стандартная модель | Примечания |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Добавляет заголовки HTTP-Referer + X-Title |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Добавляет заголовок X-GitHub-Api-Version |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Добавляет заголовок APP-Code |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Необязательный ключ API |
| Новый API | localhost:3000/v1 | gpt-4.1 | Необязательный ключ API |
| OpenAI Compatible | (настроено пользователем) | your-model-id | Персонализированный конечный пункт |
Поставщики из Китая
| Поставщик | Базовый шаблон URL | Стандартная модель | Примечания |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Ориентировано на программирование |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (требуется ID конечной точки) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Конечный пункт Zhipu, Китай |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Конечный пункт Zhipu, международный |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Платформа хостинга моделей |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao требует идентификатора конечного пункта Ark (формат: ep-xxxxxxxx-xxxx-xxxx). По умолчанию этот местоимение необходимо заменить.
Локальные поставщики
| Поставщик | Базовый шаблон URL | Стандартная модель | Примечания |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Отсутствует ключ API. Стриминг NDJSON. Обнаружение моделей через /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Отправляет "EMPTY" в качестве токена авторизации. Обнаружение совместимое с OpenAI |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (настроено пользователем) | gpt-4o | Имя развертывания в URL. Заголовок api-key |
Выбор модели для каждой задачи
Notemd поддерживает независимого поставщика и модель для каждой задачи. Включить с помощью useMultiModelSettings: true.
Доступные задачи
| Задача | Ключ настроек | Стандартный поставщик |
|---|---|---|
| Добавление ссылок (вставка wiki-ссылки) | addLinksProvider / addLinksModel | DeepSeek |
| Исследование (поиск в интернете + краткое изложение) | researchProvider / researchModel | DeepSeek |
| Генерация из заголовка | generateTitleProvider / generateTitleModel | DeepSeek |
| Перевод | translateProvider / translateModel | DeepSeek |
| Создание диаграмм | summarizeToMermaidProvider / Model | DeepSeek |
| Извлечение концепций | extractConceptsProvider / Model | DeepSeek |
| Извлечение оригинального текста | extractOriginalTextProvider / Model | DeepSeek |
Порядок разрешения
- Если
useMultiModelSettingsвключён → использовать поставщика и модель, специфичные для задачи - Если параметр переопределения модели задачи пуст — вернуться к стандартной модели поставщика
- Если поставщик задачи недействителен — вернуться к глобальному
activeProvider - Если
useMultiModelSettingsвыключен → все задачи используют глобальныйactiveProvider
Рекомендуемые конфигурации
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
Архитектура вызова API
Слои передачи
- Obsidian
requestUrl— основной (встроенный, работает на всех платформах) - Desktop HTTP — модули Node.js
http/https(стриминг + длинные запросы) - Web
fetch— альтернатива при отсутствии модулей Node.js
Плагин автоматически переключается между способами передачи при временных сетевых ошибках.
Логика повторных попыток
- Обычный режим (
enableStableApiCall: false): одна попытка. При временной неудаче автоматически переходит к стабильному повтору. - Режим стабильного повтора (
enableStableApiCall: true): до 4 попыток (1 + 3 повтора) с интервалом в 5 секунд. - Временные ошибки, вызывающие повтор:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Не подлежат повтору: HTTP 400, 401, 403, 404
Кэширование ответов
5-минутный кэш LRU в памяти, ключи формируются из провайдера + модели + температуры + запроса + содержимого. Последующие идентичные запросы в течение 5 минут возвращают результаты из кэша мгновенно.
Обработка моделей рассуждений
Модели, которые не поддерживают роль system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), автоматически объединяют системные и пользовательские запросы в одно сообщение пользователя.
DeepSeek-специфично: thinkingEnabled добавляет { thinking: { type: 'enabled' } } в запрос. reasoningEffort (низкий/средний/высокий) передаётся как reasoning_effort. Проверяется, что максимальное количество токенов вывода ≥ 8000 при включённом режиме размышлений.
Оценка количества токенов
estimateTokens(text): Math.ceil(text.length / 4) — гипотеза 4 символа на токен. Используется для обеспечения maxResearchContentTokens перед отправкой в LLM.
Отслеживание затрат не реализовано.
Обнаружение моделей
| Режим | Провайдеры | Конечная точка |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Список моделей API | |
anthropic-models | Anthropic | Список моделей API |
openai-compatible-models | DeepSeek, Qwen, Mistral и т. д. | /v1/models |
openrouter-models | OpenRouter | Список моделей API |
github-models | GitHub Models | Инференс API |
none | Azure OpenAI | Отключено (требуется имя развертывания) |
Быстрый старт
- Выберите провайдера — DeepSeek (Китай), OpenAI (Международный) или Ollama (Локальный/бесплатный)
- Введите ключ API — Настройки → Notemd → Провайдер → Ключ API
- Проверить соединение — Нажмите кнопку теста
- Необязательно: модели для каждой задачи — Включите
useMultiModelSettingsи настройте их отдельно
Для Ollama: ключ API не требуется. Просто убедитесь, что ollama serve работает.
Следующие шаги
- 📝 Заметки по концепции — Использует модель извлечения для каждой задачи
- 🎨 Диаграммы — Использует модель диаграмм для каждой задачи
- 🔍 Исследования — Использует специальную модель для исследований
- ⚙️ Настройки — Полный список параметров