Skip to main content

Dostawcy LLM

💡TL;DR

Notemd obsługuje 36 dostawców LLM w 4 typach transporту. Wszystkie wywołania API używają surowego HTTP (bez SDK) z automatycznym ponawianiem prób, fallbackiem transportu oraz buforowaniem odpowiedzi na 5 minut. Możliwość wyboru modelu na poziomie zadania umożliwia stosowanie tańszych modeli do ekstrakcji koncepcji oraz potężnych modeli do badań. Dla dostawców lokalnych (Ollama, LMStudio) nie jest potrzebny klucz API.

To jest część Obsidian Przewodnika po zarządzaniu wiedzą AI.

Kategorie dostawców

Dostawcy chmurowe

DostawcaPodstawowy URL domyślnyDomyślny modelTemperatura
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Dostawcy bramkowe/proxy

DostawcaPodstawowy URL domyślnyDomyślny modelUwagi
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetDodaje nagłówki HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniDodaje nagłówek X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniDodaje nagłówek APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelOpcjonalny klucz API
Nowy APIlocalhost:3000/v1gpt-4.1Opcjonalny klucz API
OpenAI Compatible(konfigurowane przez użytkownika)your-model-idKonfigurowalny punkt końcowy

Dostawcy z Chin

DostawcaBaza domyślna URLDomyślny modelUwagi
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusSkupiony na programowaniu
Doubaoark.cn-beijing.volces.com/api/v3(wymagany ID punktu końcowego)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Punkt końcowy Zhipu w Chinach
Z AIapi.z.ai/api/paas/v4glm-5Punkt końcowy Zhipu międzynarodowy
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatforma hostowania modeli
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao wymaga identyfikatora punktu końcowego Ark (format: ep-xxxxxxxx-xxxx-xxxx). Domyślny placeholder musi zostać zastąpiony.

Dostawcy lokalni

DostawcaBaza domyślna URLDomyślny modelUwagi
Ollamalocalhost:11434/apillama3Brak klucza API. Strumieniowanie NDJSON. Odkrywanie modeli za pomocą /api/tags
LMStudiolocalhost:1234/v1local-modelWysyła "EMPTY" jako token nośny. Odkrywanie kompatybilne z OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(skonfigurowane przez użytkownika)gpt-4oNazwa implementacji w URL. Nagłówek api-key

Wybór modelu na zasadzie zadania

Notemd obsługuje niezależnego dostawcę i model dla każdego zadania. Włącz to za pomocą useMultiModelSettings: true.

Dostępne zadania

ZadanieKlucz ustawieńDomyślny dostawca
Dodawanie linków (wstawianie linków wiki)addLinksProvider / addLinksModelDeepSeek
Badania (szukanie w sieci + podsumowanie)researchProvider / researchModelDeepSeek
Generowanie na podstawie tytuługenerateTitleProvider / generateTitleModelDeepSeek
TłumaczenietranslateProvider / translateModelDeepSeek
Generowanie diagramówsummarizeToMermaidProvider / ModelDeepSeek
Wydobywanie koncepcjiextractConceptsProvider / ModelDeepSeek
Wydobywanie oryginalnego tekstuextractOriginalTextProvider / ModelDeepSeek

Kolejność rozwiązywania

  1. Jeśli useMultiModelSettings jest włączone → użyj dostawcy i modelu specyficznych dla zadania
  2. Jeśli wartość przejęcia modelu zadania jest pusta → użyj domyślnego modelu dostawcy
  3. Jeśli dostawca zadania jest nieważny → użyj globalnego activeProvider
  4. Jeśli useMultiModelSettings jest wyłączone → wszystkie zadania używają globalnego activeProvider

Zalecane konfiguracje

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Architektura wywołań API

Warstwy transportowe

  1. Obsidian requestUrl — główna (wbudowana, działa na wszystkich platformach)
  2. Desktop HTTP — moduły Node.js http/https (strumieniowanie + długie żądania)
  3. Web fetch — alternatywa, gdy moduły Node.js nie są dostępne

Wtyczka automatycznie przechodzi między warstwami transportowymi w przypadku tymczasowych błędów sieciowych.

Logika ponawiania prób

  • Tryb normalny (enableStableApiCall: false): Jedna próba. W przypadku tymczasowego niepowodzenia następuje automatyczne przejście do stabilnego ponawiania.
  • Stabilny tryb ponawiania (enableStableApiCall: true): Do 4 prób (1 + 3 ponowne próby) z odstępami 5 sekund.
  • Błędy tymczasowe, które powodują ponowne próby: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Niepodlegające ponownemu przetworzeniu: HTTP 400, 401, 403, 404

Cacheowanie odpowiedzi

5-minutowy cache LRU w pamięci operacyjnej, kluczowany według dostawcy + modelu + temperatury + promptu + treści. Kolejne identyczne żądania w ciągu 5 minut zwracają wyniki z cache'u natychmiast.

Obsługa modeli rozumowania

Modele, które nie obsługują roli system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), automatycznie łączą prompty systemowe i użytkownika w jedną wiadomość użytkownika.

DeepSeek-specificzny: thinkingEnabled dodaje { thinking: { type: 'enabled' } } do żądania. reasoningEffort (niski/średni/wysoki) jest przekazywany jako reasoning_effort. Sprawdza, czy maksymalna liczba tokenów wyjściowych ≥ 8000, gdy aktywna jest funkcja rozmyślania.

Oszacowanie tokenów

estimateTokens(text): Math.ceil(text.length / 4) — heurystyka 4 znaków na token. Służy do zapewnienia maxResearchContentTokens przed wysłaniem do LLM.

Nie wdrożono śledzenia kosztów.

Odkrywanie modeli

TrybDostawcyKoniec punktu końcowego
ollama-tagsOllama/api/tags
google-modelsGoogleLista modeli API
anthropic-modelsAnthropicLista modeli API
openai-compatible-modelsDeepSeek, Qwen, Mistral itp./v1/models
openrouter-modelsOpenRouterLista modeli API
github-modelsGitHub ModelsInferencja API
noneAzure OpenAIWyłączone (wymaga nazwy implementacji)

Szybki start

  1. Wybierz dostawcę — DeepSeek (Chiny), OpenAI (Międzynarodowy) lub Ollama (Lokalny/Darmowy)
  2. Wpisz klucz API — Ustawienia → Notemd → Dostawca → Klucz API
  3. Przetestuj połączenie — Kliknij przycisk testowania
  4. Opcjonalnie: modele na poziomie zadań — Włącz useMultiModelSettings i skonfiguruj je indywidualnie

Dla Ollama: nie jest potrzebna klucz API. Upewnij się tylko, że ollama serve działa.


Kolejne kroki

  • 📝 Notatki koncepcyjne — Wykorzystuje model ekstrakcji na poziomie zadań
  • 🎨 Diagramy — Wykorzystuje model diagramów na poziomie zadań
  • 🔍 Badania — Wykorzystuje model specyficzny dla badań
  • ⚙️ Konfiguracja — Pełna lista ustawień