Skip to main content

Provezoare LLM

💡TL;DR

Notemd susține 36 de provezoare LLM în 4 tipuri de transport. Toate apelurile API folosesc HTTP brut (fără SDK-uri) cu reîncercări automate, fallback de transport și cacheare a răspunsurilor pe 5 minute. Seleția modelului pe sarcină vă permite să utilizați modele ieftine pentru extracția conceptelor și modele puternice pentru cercetare. Nu este necesară nicio cheie API pentru provezoarele locale (Ollama, LMStudio).

Acesta face parte din Obsidian Ghidul de gestionare a cunoștințelor AI.

Categorie de provezoare

Provezoare cloud

FurnizorBaza implicită URLModelul implicitTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Provezoare gateway/proxy

FurnizorBaza implicită URLModelul implicitNote
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetAdaugă en-titlurile HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniAdaugă en-titlul X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniAdaugă en-titlul APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelCheie opționala API
New APIlocalhost:3000/v1gpt-4.1Cheie opționala API
OpenAI Compatible(configurat de utilizator)your-model-idEndpoint personalizat

furnizorii din China

FurnizorBase implicită URLModelul implicitNote
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusFocusat pe programare
Doubaoark.cn-beijing.volces.com/api/v3(eșantionul endpointului este obligatoriu)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Endpoint Zhipu, China
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, endpoint internațional
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatformă de găzduire a modelelor
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao necesită un ID de endpoint Ark (format: ep-xxxxxxxx-xxxx-xxxx). Placeholder-ul implicit trebuie înlocuit.

furnizori locali

FurnizorBase implicită URLModelul implicitNote
Ollamalocalhost:11434/apillama3Fără cheie API. Streamare NDJSON. Descoperire a modelelor prin /api/tags
LMStudiolocalhost:1234/v1local-modelTrimite "EMPTY" ca token de portare. Descoperire compatibilă cu OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(configurat de utilizator)gpt-4oNumele de implementare în URL. Înaltarea api-key

Selectare a modelului pe sarcină

Notemd suportă un furnizor și o model independentă pentru fiecare sarcină. Activează cu useMultiModelSettings: true.

Sarcini disponibile

SarcinăCheia de setăriFurnizor implicit
Adăugare de linkuri (insertare de link wiki)addLinksProvider / addLinksModelDeepSeek
Cercetare (căutare pe web + rezumat)researchProvider / researchModelDeepSeek
Generare din titlugenerateTitleProvider / generateTitleModelDeepSeek
TraduceretranslateProvider / translateModelDeepSeek
Generare de diagramesummarizeToMermaidProvider / ModelDeepSeek
Extracție de concepteextractConceptsProvider / ModelDeepSeek
Extracție de text originalextractOriginalTextProvider / ModelDeepSeek

Ordine de rezolvare

  1. Dacă useMultiModelSettings este activ → se folosește furnizorul și modelul specific pentru sarcină
  2. Dacă suprascrierea modelului pentru sarcină este golă → se revine la modelul implicit al furnizorului
  3. Dacă furnizorul pentru sarcină este invalid → se revine la activeProvider global
  4. Dacă useMultiModelSettings este dezactivat → toate sarcinile folosesc activeProvider global

Configurații recomandate

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Arhitectura de apel a API

Straturile de transport

  1. Obsidian requestUrl — principal (în integrare, funcționează pe toate platformele)
  2. Desktop HTTP — module Node.js http/https (streaming + cereri lungi)
  3. Web fetch — soluție de rezervă atunci când modulele Node.js nu sunt disponibile

Pluginul cascadează automat între straturile de transport în cazul erorilor temporare de rețea.

Logică de repetare

  • Mod normal (enableStableApiCall: false): O tentativă singură. În caz de eșec temporar, se face o escaladare automată la o repetare stabilă.
  • Mod de repetare stabilă (enableStableApiCall: true): Până la 4 tentative (1 + 3 repetări) cu intervale de 5 secunde.
  • Erorile temporare care declanșează repetare: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Nerepetabile: HTTP 400, 401, 403, 404

Cachearea răspunsurilor

Cache LRU în memorie pe 5 minute, indexată după provider + model + temperatură + prompt + conținut. Cererile identice ulterioare în decurs de 5 minute returnează instantaneu rezultatele din cache.

Gestionarea modelelor de raționament

Modelele care nu suportă rolul system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) au automat prompturile sistemului + ale utilizatorului combinate într-un singur mesaj de utilizator.

Specific pentru DeepSeek: thinkingEnabled adaugă { thinking: { type: 'enabled' } } la cerere. reasoningEffort (scăzut/mediu/alt) este transmis ca reasoning_effort. Verifică că numărul maxim de tokeni de ieșire este ≥ 8000 atunci când este activată gândirea.

Estimarea tokenilor

estimateTokens(text): Math.ceil(text.length / 4) — heuristică de 4 caractere pe token. Folosită pentru a respecta maxResearchContentTokens înainte de trimitere către LLM.

Nu este implementată urmărire a costurilor.

Descoperirea modelelor

ModProvideriEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleLista modelelor API
anthropic-modelsAnthropicLista modelelor API
openai-compatible-modelsDeepSeek, Qwen, Mistral, etc./v1/models
openrouter-modelsOpenRouterLista modelelor API
github-modelsGitHub ModelsInferența API
noneAzure OpenAIDesactivat (se necesită numele de implementare)

Start rapid

  1. Alegeți un furnizor — DeepSeek (China), OpenAI (Internațional), sau Ollama (Local/Free)
  2. Introduceți cheia API — Setări → Notemd → Furnizor → Cheie API
  3. Testați conexiunea — Faceți clic pe butonul de test
  4. Opțional: Modele pe sarcină — Activați useMultiModelSettings și configurați-le individual

Pentru Ollama: nu este necesară cheia API. Asigurați-vă doar că ollama serve este în funcțiune.


Următoarele pași

  • 📝 Notițe conceptuale — Folosește modelul de extracție pe sarcină
  • 🎨 Diagrame — Folosește modelul de diagramă pe sarcină
  • 🔍 Cercetare — Folosește model specific pentru cercetare
  • ⚙️ Configurație — Referință completă a setărilor