Skip to main content

LLM poskytovatelé

💡TL;DR

Notemd podporuje 36 LLM poskytovatelů napříč 4 typy přenosu. Všechny API volání využívají syrový HTTP (bez SDK) s automatickým opakováním, náhradním přenosem a ukládáním odpovědí na 5 minut. Výběr modelu podle úlohy vám umožňuje použít levné modely pro extrakci konceptů a výkonné modely pro výzkum. Pro lokální poskytovatele (Ollama, LMStudio) není potřeba žádný API klíč.

Toto je součástí Obsidian Průvodce AI pro správu znalostí.

Kategorie poskytovatelů

Cloudoví poskytovatelé

PoskytovatelVýchozí základ URLVýchozí modelTeplota
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Bránoví / proxy poskytovatelé

PoskytovatelVýchozí základ URLVýchozí modelPoznámky
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetPřidává hlavičky HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniPřidává hlavičku X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniPřidává hlavičku APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelVolitelný API klíč
Nový APIlocalhost:3000/v1gpt-4.1Volitelný API klíč
OpenAI Compatible(user-configured)your-model-idVlastní koncový bod

Čínští poskytovatelé

PoskytovatelVýchozí základna URLVýchozí modelPoznámky
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusZaměřené na programování
Doubaoark.cn-beijing.volces.com/api/v3(je vyžadován ID koncového bodu)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Koncový bod Zhipu v Číně
Z AIapi.z.ai/api/paas/v4glm-5Mezinárodní koncový bod Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatforma pro hostování modelů
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao vyžaduje ID koncového bodu Ark (formát: ep-xxxxxxxx-xxxx-xxxx). Výchozí zástupný symbol je třeba nahradit.

Lokální poskytovatelé

PoskytovatelVýchozí základna URLVýchozí modelPoznámky
Ollamalocalhost:11434/apillama3Žádný klíč API. Přenos NDJSON. Objevování modelů prostřednictvím /api/tags
LMStudiolocalhost:1234/v1local-modelOdesílá "EMPTY" jako token nositele. Objevování kompatibilní s OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(uživatelem nakonfigurováno)gpt-4oNázev nasazení v URL. Záhlaví api-key

Výběr modelu pro jednotlivé úlohy

Notemd podporuje nezávislého poskytovatele a model pro každý úkol. Aktivujte pomocí useMultiModelSettings: true.

Dostupné úkoly

ÚlohaKlíč nastaveníVýchozí poskytovatel
Přidání odkazů (vložení wiki odkazu)addLinksProvider / addLinksModelDeepSeek
Výzkum (vyhledávání na webu + shrnutí)researchProvider / researchModelDeepSeek
Generování z názvugenerateTitleProvider / generateTitleModelDeepSeek
PřekladtranslateProvider / translateModelDeepSeek
Generování diagramůsummarizeToMermaidProvider / ModelDeepSeek
Extrakce konceptůextractConceptsProvider / ModelDeepSeek
Extrakce původního textuextractOriginalTextProvider / ModelDeepSeek

Pořadí řešení

  1. Pokud je useMultiModelSettings zapnuto → použijte poskytovatele a model specifické pro úkol
  2. Pokud je přepsání modelu úkolu prázdné → vraťte se k výchozímu modelu poskytovatele
  3. Pokud je poskytovatel úkolu neplatný → vraťte se ke globálnímu activeProvider
  4. Pokud je useMultiModelSettings vypnuté → všechny úlohy používají globální activeProvider

Doporučené konfigurace

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Architektura volání API

Transportní vrstvy

  1. Obsidian requestUrl — primární (vestavěné, funguje na všech platformách)
  2. Desktop HTTP — moduly Node.js http/https (streaming + dlouhé požadavky)
  3. Web fetch — náhrada, pokud nejsou k dispozici moduly Node.js

Plugin automaticky přepíná mezi transporty při dočasných síťových chybách.

Logika opakování

  • Normální režim (enableStableApiCall: false): Jeden pokus. Při dočasné chybě se automaticky přejde na stabilní opakování.
  • Režim stabilního opakování (enableStableApiCall: true): Až 4 pokusy (1 + 3 opakování) s intervaly 5 sekund.
  • Dočasné chyby, které spouštějí opakování: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Nepřipustitelné k opakování: HTTP 400, 401, 403, 404

Caching odpovědí

5minutová paměťová cache LRU se klíči založenými na poskytovateli + modelu + teplotě + promptu + obsahu. Následující identické požadavky během 5 minut vracejí výsledky z cache okamžitě.

Zpracování modelů pro uvažování

Modely, které nepodporují roli system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), automaticky spojují systémové a uživatelské prompty do jediné uživatelské zprávy.

DeepSeek-specifické: thinkingEnabled přidává { thinking: { type: 'enabled' } } do požadavku. reasoningEffort (nízký/střední/vysoký) je předán jako reasoning_effort. Ověřuje, zda maximální počet výstupních tokenů ≥ 8000, když je aktivní režim uvažování.

Odhad tokenů

estimateTokens(text): Math.ceil(text.length / 4) — heuristika 4 znaků na token. Používá se k zajištění maxResearchContentTokens před odesláním do LLM.

Není implementováno sledování nákladů.

Objevování modelů

RežimPoskytovateléKoncový bod
ollama-tagsOllama/api/tags
google-modelsGoogleSeznam modelů API
anthropic-modelsAnthropicSeznam modelů API
openai-compatible-modelsDeepSeek, Qwen, Mistral atd./v1/models
openrouter-modelsOpenRouterSeznam modelů API
github-modelsGitHub ModelsInference API
noneAzure OpenAIVypnuto (vyžaduje název nasazení)

Rychlý start

  1. Vyberte poskytovatele — DeepSeek (Čína), OpenAI (Mezinárodní) nebo Ollama (Místní/Bezplatné)
  2. Zadejte klíč API — Nastavení → Notemd → Poskytovatel → Klíč API
  3. Otestujte spojení — Klikněte na tlačítko testování
  4. Volitelné: Modely na úroveň úkolu — Povolte useMultiModelSettings a nakonfigurujte je individuálně

Pro Ollama: klíč API není potřeba. Stačí se ujistit, že ollama serve běží.


Další kroky

  • 📝 Poznámky ke konceptu — Využívá model extrakce na úroveň úkolu
  • 🎨 Diagramy — Využívá model diagramů na úroveň úkolu
  • 🔍 Výzkum — Využívá model specifický pro výzkum
  • ⚙️ Konfigurace — Kompletní referenční sady nastavení