Skip to main content

LLM Társítók

💡TL;DR

Notemd 36 LLM társítót támogat 4 transzporttípusban. Minden API kérésekhez használódik az összetett HTTP (nem vannak SDK-k), amelyben automatikus újrakövetés, transzportállapító átváltás és 5 percös válaszmezőtárolás van. A műveletenkénti modellelem lehetősége lehetővé teszi, hogy a konceptek kivonásához olcsó modelleket, a kutatásokhoz pedig erős modelleket használjunk. A helyi társítókhoz (Ollama, LMStudio) nincs szükség API kulcsra.

Ez része a Obsidian AI tudományos kezelési útmutatójának.

Társítók kategóriái

Felhőtársítók

TársítóAlapértelmezett alap URLAlapértelmezett modellTemperatúra
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Átjáró / Proxy társítók

TársítóAlapértelmezett alap URLAlapértelmezett modellMegjegyzések
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetHozzáadja a HTTP-Referer + X-Title fejleteket
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniHozzáadja a X-GitHub-Api-Version fejlet
AIHubMixaihubmix.com/v1gpt-4o-miniHozzáadja a APP-Code fejlet
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelVálasztható API kulcs
Új APIlocalhost:3000/v1gpt-4.1Választható API kulcs
OpenAI Compatible(használó-konfigurált)your-model-idSzerkeszthető végpont

Kínábeli szolgáltatók

TársítóAlapértelmezett bázis URLAlapértelmezett modellMegjegyzések
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusKódoláshoz specializált
Doubaoark.cn-beijing.volces.com/api/v3(endpoint ID szükséges)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, Kína végpontja
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, nemzetközi végpontja
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BModell-hostelési platform
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubaonek egy Ark végpont ID-re van szüksége (formátum: ep-xxxxxxxx-xxxx-xxxx). A alapértelmezett helyettesítőt kell cserélni.

Lokális fornítók

TársítóAlapértelmezett bázis URLAlapértelmezett modellMegjegyzések
Ollamalocalhost:11434/apillama3Nincs API kulcs. NDJSON streamelés. Modellkeresés /api/tags keresztül
LMStudiolocalhost:1234/v1local-modelÍrja el "EMPTY"-t bármérő tokenként. OpenAI-kompatibilis keresés
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(használó-konfigurált)gpt-4oElhelyezési nevű URL-ban. api-key címzete

Munkaalapú modell választása

Notemd támogatja külön felelőt és modellt minden munkához. Engedélyezze az useMultiModelSettings: true-vel.

Lelévő munkák

MunkaBeállítások kulcsaAlapfelelő
Hivatkozások hozzáadása (wiki-hivatkozás beillesztése)addLinksProvider / addLinksModelDeepSeek
Tudományos kutatás (web-keresés + összefoglalás)researchProvider / researchModelDeepSeek
Cím alapján készítésgenerateTitleProvider / generateTitleModelDeepSeek
ÜbersetzungtranslateProvider / translateModelDeepSeek
Diagram készítésesummarizeToMermaidProvider / ModelDeepSeek
Konceptek kiemeléseextractConceptsProvider / ModelDeepSeek
Összességi szöveg kiemeléseextractOriginalTextProvider / ModelDeepSeek

Löszerőrend

  1. Ha useMultiModelSettings aktív → használja a munkához specifikus felelőt és modellt
  2. Ha a munka modellének módosítása üres → válassza ki a felelő alapmodellt
  3. Ha a munka felelője érvénytelen → válassza ki a globális activeProvider-t
  4. Ha useMultiModelSettings nincs bekapcsolva → az összes munkahasználja a globális activeProvider-t

Tanácsolt konfigurációk

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API hívás architektúrája

Transzportrétegek

  1. Obsidian requestUrl — primáris (beépített, működik minden platformon)
  2. Asztali HTTP — Node.js http/https modulok (streaming + hosszú kérések)
  3. Web fetch — lehetséges választó, ha a Node.js modulok nem elérhetőek

A plug-in automatikusan átmeneti hálózati hibák esetén átmeni a transzportrétegek között.

Ugyanírás logika

  • Normál módszer (enableStableApiCall: false): Egy kísérlet. Átmeneti hiba esetén automatikusan emelkedik egy stabilabb ugyanírásra.
  • Stabil ugyanírás módszer (enableStableApiCall: true): Legfeljebb 4 kísérlet (1 + 3 ugyanírás) 5 másodperces intervallumokkal.
  • Átmeneti hibák, amelyek indítják az ugyanírást: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Nem ugyanírhatók: HTTP 400, 401, 403, 404

Válasz tárolása

5 percös memóriában lévő LRU tároló, amely kulcsa a fornító + modell + temperatúra + kérdés + tartalom. A következő egyező kérések 5 perc alatt azonnal adják vissza a tárolt eredményeket.

Logikai modell kezelése

Akik a system szerepét (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) nem támogatják, azoknál a rendszeri + felhasználói kérdések automatikusan összevonódnak egyetlen felhasználói üzenettel.

DeepSeek-specifikus: thinkingEnabled hozzáadja { thinking: { type: 'enabled' } } a kéréhez. reasoningEffort (alacsony/közepes/felső) kerül át jako reasoning_effort. ellenőrizi, hogy a maximális kijelölt token száma ≥ 8000, ha aktiválva a gondolkodás.

Token-értékelés

estimateTokens(text): Math.ceil(text.length / 4) — 4 karakteres token-heuristikus. Használódik az maxResearchContentTokens megkövetésére, mielőtt küldjük az LLM-he.

Nincs implementált költségkövetés.

Model felfedezése

MódszerTársítókVégpont
ollama-tagsOllama/api/tags
google-modelsGoogleModellek listája API
anthropic-modelsAnthropicModellek listája API
openai-compatible-modelsDeepSeek, Qwen, Mistral stb./v1/models
openrouter-modelsOpenRouterModellek listája API
github-modelsGitHub ModelsInferenciális folyamat API
noneAzure OpenAIKikapcsolva (kötelező a telepítésnev)

Rágratkozás

  1. Válassza egy társítót — DeepSeek (Kína), OpenAI (Internacionális) vagy Ollama (Lokális/Tiszta)
  2. Írja be a API kulcsot — Beállítások → Notemd → Társító → API Kulcs
  3. Próbálja ki a kapcsolatot — Kattintson a teszt gombra
  4. Választható: Feladatspecifikus modellek — Engedélyezze a useMultiModelSettings-t és konfigurálja azokat külön-külön

Ollama esetén: nincs szükség API kulcsra. Csak ellenőrizze, hogy a ollama serve működik.


További lépések