Skip to main content

Fornitori LLM

💡TL;DR

Notemd supporta 36 fornitori LLM su 4 tipi di trasporto. Tutte le chiamate API utilizzano il formato grezzo HTTP (senza SDK) con riprovazione automatica, fallback di trasporto e caching delle risposte per 5 minuti. La selezione del modello per task permette di utilizzare modelli economici per l’estrazione dei concetti e modelli potenti per la ricerca. Non è necessaria alcuna chiave API per i fornitori locali (Ollama, LMStudio).

Questo fa parte della Obsidian Guida alla gestione delle conoscenze AI.

Categorie di fornitore

Fornitori cloud

FornitoreBase predefinita URLModello predefinitoTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Fornitori gateway/proxy

FornitoreBase predefinita URLModello predefinitoNote
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetAggiunge intestazioni HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniAggiunge intestazione X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniAggiunge intestazione APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelChiave opzionale API
Nuovo APIlocalhost:3000/v1gpt-4.1Chiave opzionale API
OpenAI Compatible(configurato dall'utente)your-model-idEndpoint personalizzato

Fornitori Cina

FornitoreBase predefinita URLModello predefinitoNote
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusOrientato alla programmazione
Doubaoark.cn-beijing.volces.com/api/v3(richiesto ID endpoint)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Endpoint di Zhipu, Cina
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, endpoint internazionale
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPiattaforma di hosting per modelli
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao richiede un ID di endpoint Ark (formato: ep-xxxxxxxx-xxxx-xxxx). Il placeholder predefinito deve essere sostituito.

Fornitori locali

FornitoreBase predefinita URLModello predefinitoNote
Ollamalocalhost:11434/apillama3Nessuna chiave API. Streaming NDJSON. Scoperta dei modelli tramite /api/tags
LMStudiolocalhost:1234/v1local-modelInvia "EMPTY" come token di autenticazione. Scoperta compatibile con OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(configurato dall'utente)gpt-4oNome della distribuzione in URL. Intestazione api-key

Selezione del modello per attività

Notemd supporta fornitori e modelli indipendenti per ogni task. Abilitare con useMultiModelSettings: true.

Task disponibili

CompitoChiave delle ImpostazioniFornitore Predefinito
Aggiungere Link (inserimento di link wiki)addLinksProvider / addLinksModelDeepSeek
Ricerca (ricerca web + riassunto)researchProvider / researchModelDeepSeek
Generare dal TitologenerateTitleProvider / generateTitleModelDeepSeek
TraduzionetranslateProvider / translateModelDeepSeek
Generazione di DiagrammisummarizeToMermaidProvider / ModelDeepSeek
Estrazione dei ConcettiextractConceptsProvider / ModelDeepSeek
Estrazione del Testo OriginaleextractOriginalTextProvider / ModelDeepSeek

Ordine di Risoluzione

  1. Se useMultiModelSettings è attivo → utilizzare il fornitore e il modello specifici per il compito
  2. Se l’override del modello del compito è vuoto → tornare al modello predefinito del fornitore
  3. Se il fornitore del compito è invalido → tornare al activeProvider globale
  4. Se useMultiModelSettings è disattivato → tutti i task utilizzano il globale activeProvider

Configurazioni consigliate

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Architettura di chiamata di API

Strati di trasporto

  1. Obsidian requestUrl — primario (integrato, funziona su tutte le piattaforme)
  2. Desktop HTTP — moduli Node.js http/https (streaming + richieste lunghe)
  3. Web fetch — soluzione di fallback quando i moduli Node.js non sono disponibili

Il plugin passa automaticamente da un trasporto all’altro in caso di errori temporanei di rete.

Logica di ripetizione

  • Modalità normale (enableStableApiCall: false): Un’unica tentativa. In caso di fallimento temporaneo, si passa automaticamente a una ripetizione stabile.
  • Modalità di ripetizione stabile (enableStableApiCall: true): Fino a 4 tentativi (1 + 3 ripetizioni) con intervalli di 5 secondi.
  • Errori temporanei che attivano la ripetizione: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Non ripetibili: HTTP 400, 401, 403, 404

Caching delle risposte

Cache in memoria LRU da 5 minuti, chiaviata da provider + modello + temperatura + prompt + contenuto. Le richieste identiche successive entro 5 minuti restituiscono immediatamente i risultati memorizzati.

Gestione del modello di ragionamento

I modelli che non supportano il ruolo system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) combinano automaticamente le istanze di sistema e utente in un unico messaggio utente.

Specifico per DeepSeek: thinkingEnabled aggiunge { thinking: { type: 'enabled' } } alla richiesta. reasoningEffort (basso/medio/alto) viene passato come reasoning_effort. Verifica che i token massimi di output siano ≥ 8000 quando è attiva la funzione di riflessione.

Stima dei token

estimateTokens(text): Math.ceil(text.length / 4) — euristica di 4 caratteri per token. Utilizzata per applicare la regola maxResearchContentTokens prima dell’invio a LLM.

Non è implementato il tracciamento dei costi.

Scoperta dei modelli

ModalitàFornitoriEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleElenco modelli API
anthropic-modelsAnthropicElenco modelli API
openai-compatible-modelsDeepSeek, Qwen, Mistral, ecc./v1/models
openrouter-modelsOpenRouterElenco modelli API
github-modelsGitHub ModelsInferenza API
noneAzure OpenAIDisattivato (richiede nome di deployment)

Avvio rapido

  1. Scegli un fornitore — DeepSeek (Cina), OpenAI (Internazionale) o Ollama (Locale/Gratuito)
  2. Inserisci la chiave API — Impostazioni → Notemd → Fornitore → Chiave API
  3. Testa la connessione — Clicca sul pulsante di test
  4. Opzionale: modelli per task — Abilita useMultiModelSettings e configurali individualmente

Per Ollama: non è necessaria alcuna chiave API. Assicurati solo che ollama serve sia in esecuzione.


Prossimi passi

  • 📝 Note concettuali — Utilizza il modello di estrazione per task
  • 🎨 Diagrammi — Utilizza il modello di diagramma per task
  • 🔍 Ricerca — Utilizza il modello specifico per la ricerca
  • ⚙️ Configurazione — Riferimento completo alle impostazioni