Skip to main content

LLM Провайдери

💡TL;DR

Notemd підтримує 36 LLM провайдерів у 4 типах транспорту. Усі API виклики виконуються безпосередньо через HTTP (без SDK), з автоматичною перепробуванням, заміною транспорту та кешуванням відповідей протягом 5 хвилин. Вибір моделі для кожного завдання дозволяє використовувати дешеві моделі для екстракції концепцій та потужні моделі для досліджень. Для локальних провайдерів (Ollama, LMStudio) ключ API не потрібен.

Це частина Obsidian Посібника з управління знаннями в ШІ.

Категорії провайдерів

Хмарні провайдери

ПостачальникБазовий URL за замовчуваннямСтандартна модельТемпература
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Шлюзові/проксі-провайдери

ПостачальникБазовий URL за замовчуваннямСтандартна модельПримітки
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetДодає заголовки HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniДодає заголовок X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniДодає заголовок APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelНеобов’язковий ключ API
Новий APIlocalhost:3000/v1gpt-4.1Необов’язковий ключ API
OpenAI Compatible(user-configured)your-model-idCustomний кінець шляху

Постачальники Китаю

ПостачальникDefault Base URLСтандартна модельПримітки
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusОрієнтований на програмування
Doubaoark.cn-beijing.volces.com/api/v3(необхідний ID кінцевої точки)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Кінець шляху Zhipu, Китай
Z AIapi.z.ai/api/paas/v4glm-5Кінець шляху Zhipu, міжнародний
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BПлатформа для розміщення моделей
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao вимагає ідентифікатора кінця шляху Ark (формат: ep-xxxxxxxx-xxxx-xxxx). Замінити стандартний замінник.

Локальні постачальники

ПостачальникDefault Base URLСтандартна модельПримітки
Ollamalocalhost:11434/apillama3Немає ключа API. Стрімінг NDJSON. Відкриття моделей через /api/tags
LMStudiolocalhost:1234/v1local-modelНадсилає "EMPTY" як токен авторизації. Відкриття сумісне з OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(user-configured)gpt-4oНазва розгортання в URL. Заголовок api-key

Вибір моделі для кожного завдання

Notemd підтримує окремого постачальника та модель для кожного завдання. Увімкніть це за допомогою useMultiModelSettings: true.

Доступні завдання

ЗавданняКлюч налаштуваньСтандартний постачальник
Додавання посилань (вставка посилань з вікі)addLinksProvider / addLinksModelDeepSeek
Дослідження (пошук у Інтернеті + узагальнення)researchProvider / researchModelDeepSeek
Створення з заголовкаgenerateTitleProvider / generateTitleModelDeepSeek
ПерекладtranslateProvider / translateModelDeepSeek
Генерація діаграмsummarizeToMermaidProvider / ModelDeepSeek
Витягування концепційextractConceptsProvider / ModelDeepSeek
Витягування оригінального текстуextractOriginalTextProvider / ModelDeepSeek

Порядок розв’язання

  1. Якщо useMultiModelSettings увімкнено → використовувати постачальника та модель, специфічні для завдання
  2. Якщо параметр перевизначення моделі завдання порожній → повернутися до стандартної моделі постачальника
  3. Якщо постачальник завдання недійсний → повернутися до глобального activeProvider
  4. Якщо useMultiModelSettings вимкнено → усі завдання використовують глобальний activeProvider

Рекомендовані конфігурації

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Архітектура виклику API

Шари транспортування

  1. Obsidian requestUrl — основний (вбудований, працює на всіх платформах)
  2. Desktop HTTP — модулі Node.js http/https (стрімінг + довгі запити)
  3. Web fetch — альтернатива, коли модулі Node.js недоступні

Плагін автоматично перемикається між шарами транспортування при тимчасових проблемах мережі.

Логіка повторних спроб

  • Звичайний режим (enableStableApiCall: false): Одна спроба. При тимчасовій невдачі автоматично переходить до стабільної повторної спроби.
  • Режим стабільних повторних спроб (enableStableApiCall: true): До 4 спроб (1 + 3 повторні спроби) з інтервалом у 5 секунд.
  • Тимчасові помилки, що викликають повторну спробу: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Не підлягають повторній спробі: HTTP 400, 401, 403, 404

Кешування відповідей

5-хвилинний кеш у пам’яті типу LRU, ключується за постачальником + моделлю + температурою + запитом + контентом. Наступні ідентичні запити протягом 5 хвилин повертають результати з кешу миттєво.

Обробка моделей міркувань

Моделі, які не підтримують роль system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), автоматично об’єднують системні та користувацькі запити в одне повідомлення користувача.

DeepSeek-специфічно: thinkingEnabled додає { thinking: { type: 'enabled' } } до запиту. reasoningEffort (низький/середній/високий) передається як reasoning_effort. Перевіряє, чи максимальна кількість токенів вихідних даних ≥ 8000 під час роботи моделі.

Оцінка кількості токенів

estimateTokens(text): Math.ceil(text.length / 4) — евристика 4 символи на токен. Використовується для забезпечення maxResearchContentTokens перед надсиланням до LLM.

Трекінг витрат не реалізований.

Відкриття моделей

РежимПостачальникиКінцева точка
ollama-tagsOllama/api/tags
google-modelsGoogleСписок моделей API
anthropic-modelsAnthropicСписок моделей API
openai-compatible-modelsDeepSeek, Qwen, Mistral тощо./v1/models
openrouter-modelsOpenRouterСписок моделей API
github-modelsGitHub ModelsІнференс API
noneAzure OpenAIВимкнено (требується назва розгортання)

Швидкий старт

  1. Виберіть постачальника — DeepSeek (Китай), OpenAI (Міжнародний) або Ollama (Локальний/Безкоштовний)
  2. Введіть ключ API — Налаштування → Notemd → Постачальник → Ключ API
  3. Перевірити з’єднання — Натисніть кнопку тесту
  4. Необов’язково: моделі за завданням — Увімкніть useMultiModelSettings та налаштуйте їх окремо

Для Ollama: ключ API не потрібен. Просто переконайтеся, що ollama serve працює.


Наступні кроки