LLM Провайдери
Notemd підтримує 36 LLM провайдерів у 4 типах транспорту. Усі API виклики виконуються безпосередньо через HTTP (без SDK), з автоматичною перепробуванням, заміною транспорту та кешуванням відповідей протягом 5 хвилин. Вибір моделі для кожного завдання дозволяє використовувати дешеві моделі для екстракції концепцій та потужні моделі для досліджень. Для локальних провайдерів (Ollama, LMStudio) ключ API не потрібен.
Це частина Obsidian Посібника з управління знаннями в ШІ.
Категорії провайдерів
Хмарні провайдери
| Постачальник | Базовий URL за замовчуванням | Стандартна модель | Температура |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Шлюзові/проксі-провайдери
| Постачальник | Базовий URL за замовчуванням | Стандартна модель | Примітки |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Додає заголовки HTTP-Referer + X-Title |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Додає заголовок X-GitHub-Api-Version |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Додає заголовок APP-Code |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Необов’язковий ключ API |
| Новий API | localhost:3000/v1 | gpt-4.1 | Необов’язковий ключ API |
| OpenAI Compatible | (user-configured) | your-model-id | Customний кінець шляху |
Постачальники Китаю
| Постачальник | Default Base URL | Стандартна модель | Примітки |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Орієнтований на програмування |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (необхідний ID кінцевої точки) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Кінець шляху Zhipu, Китай |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Кінець шляху Zhipu, міжнародний |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Платформа для розміщення моделей |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao вимагає ідентифікатора кінця шляху Ark (формат: ep-xxxxxxxx-xxxx-xxxx). Замінити стандартний замінник.
Локальні постачальники
| Постачальник | Default Base URL | Стандартна модель | Примітки |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Немає ключа API. Стрімінг NDJSON. Відкриття моделей через /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Надсилає "EMPTY" як токен авторизації. Відкриття сумісне з OpenAI |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (user-configured) | gpt-4o | Назва розгортання в URL. Заголовок api-key |
Вибір моделі для кожного завдання
Notemd підтримує окремого постачальника та модель для кожного завдання. Увімкніть це за допомогою useMultiModelSettings: true.
Доступні завдання
| Завдання | Ключ налаштувань | Стандартний постачальник |
|---|---|---|
| Додавання посилань (вставка посилань з вікі) | addLinksProvider / addLinksModel | DeepSeek |
| Дослідження (пошук у Інтернеті + узагальнення) | researchProvider / researchModel | DeepSeek |
| Створення з заголовка | generateTitleProvider / generateTitleModel | DeepSeek |
| Переклад | translateProvider / translateModel | DeepSeek |
| Генерація діаграм | summarizeToMermaidProvider / Model | DeepSeek |
| Витягування концепцій | extractConceptsProvider / Model | DeepSeek |
| Витягування оригінального тексту | extractOriginalTextProvider / Model | DeepSeek |
Порядок розв’язання
- Якщо
useMultiModelSettingsувімкнено → використовувати постачальника та модель, специфічні для завдання - Якщо параметр перевизначення моделі завдання порожній → повернутися до стандартної моделі постачальника
- Якщо постачальник завдання недійсний → повернутися до глобального
activeProvider - Якщо
useMultiModelSettingsвимкнено → усі завдання використовують глобальнийactiveProvider
Рекомендовані конфігурації
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
Архітектура виклику API
Шари транспортування
- Obsidian
requestUrl— основний (вбудований, працює на всіх платформах) - Desktop HTTP — модулі Node.js
http/https(стрімінг + довгі запити) - Web
fetch— альтернатива, коли модулі Node.js недоступні
Плагін автоматично перемикається між шарами транспортування при тимчасових проблемах мережі.
Логіка повторних спроб
- Звичайний режим (
enableStableApiCall: false): Одна спроба. При тимчасовій невдачі автоматично переходить до стабільної повторної спроби. - Режим стабільних повторних спроб (
enableStableApiCall: true): До 4 спроб (1 + 3 повторні спроби) з інтервалом у 5 секунд. - Тимчасові помилки, що викликають повторну спробу:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Не підлягають повторній спробі: HTTP 400, 401, 403, 404
Кешування відповідей
5-хвилинний кеш у пам’яті типу LRU, ключується за постачальником + моделлю + температурою + запитом + контентом. Наступні ідентичні запити протягом 5 хвилин повертають результати з кешу миттєво.
Обробка моделей міркувань
Моделі, які не підтримують роль system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), автоматично об’єднують системні та користувацькі запити в одне повідомлення користувача.
DeepSeek-специфічно: thinkingEnabled додає { thinking: { type: 'enabled' } } до запиту. reasoningEffort (низький/середній/високий) передається як reasoning_effort. Перевіряє, чи максимальна кількість токенів вихідних даних ≥ 8000 під час роботи моделі.
Оцінка кількості токенів
estimateTokens(text): Math.ceil(text.length / 4) — евристика 4 символи на токен. Використовується для забезпечення maxResearchContentTokens перед надсиланням до LLM.
Трекінг витрат не реалізований.
Відкриття моделей
| Режим | Постачальники | Кінцева точка |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Список моделей API | |
anthropic-models | Anthropic | Список моделей API |
openai-compatible-models | DeepSeek, Qwen, Mistral тощо. | /v1/models |
openrouter-models | OpenRouter | Список моделей API |
github-models | GitHub Models | Інференс API |
none | Azure OpenAI | Вимкнено (требується назва розгортання) |
Швидкий старт
- Виберіть постачальника — DeepSeek (Китай), OpenAI (Міжнародний) або Ollama (Локальний/Безкоштовний)
- Введіть ключ API — Налаштування → Notemd → Постачальник → Ключ API
- Перевірити з’єднання — Натисніть кнопку тесту
- Необов’язково: моделі за завданням — Увімкніть
useMultiModelSettingsта налаштуйте їх окремо
Для Ollama: ключ API не потрібен. Просто переконайтеся, що ollama serve працює.
Наступні кроки
- 📝 Примітки до концепції — Використовує модель екстракції за завданням
- 🎨 Діаграми — Використовує модель діаграм за завданням
- 🔍 Дослідження — Використовує спеціалізовану модель для досліджень
- ⚙️ Налаштування — Повний посібник з налаштувань