Salta al contenuto principale

Provider LLM

💡TL;DR
Notemd offre 36 profili in cinque famiglie: OpenAI-compatible, Anthropic, Google, Azure OpenAI e Ollama. Scegli il protocollo del tuo endpoint, credenziali e modello accessibili. I valori iniziali sono configurabili e non garantiscono disponibilità attuale presso il provider.

Categorie​

I valori seguenti provengono dal registro. Mantieni schema e percorso URL completi; sostituisci segnaposto con endpoint e modelli reali. Accesso, prezzi e ritiro dei modelli dipendono dal provider.

Cloud​

ProviderModello inizialeURL base iniziale
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oConfigura l’endpoint della risorsa Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateway e proxy​

ProviderModello inizialeURL base iniziale
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Locali​

ProviderModello inizialeURL base iniziale
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Provider cinesi​

Consulta la configurazione regionale. La categoria non garantisce accessibilità geografica o qualità linguistica. Abbina regione dell’account, endpoint e diritti sul modello.

Modelli per attività​

Attiva useMultiModelSettings per scegliere provider e override separati. Altrimenti vale activeProvider. Un override vuoto usa il modello del provider; le scelte salvate non valide vengono riconciliate con quello attivo al caricamento.

AttivitàImpostazione providerOverride modello
LinkaddLinksProvideraddLinksModel
Generazione dal titologenerateTitleProvidergenerateTitleModel
Sintesi di ricercaresearchProviderresearchModel
TraduzionetranslateProvidertranslateModel
Estrazione concettiextractConceptsProviderextractConceptsModel
Sintesi MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Estrazione originaleextractOriginalTextProviderextractOriginalTextModel

Il provider attivo e quelli salvati per attività iniziano con DeepSeek. Cambiare solo il provider attivo non sostituisce instradamenti specifici abilitati. Verificali prima di usare materiale privato.

Architettura delle chiamate​

Trasporti​

La runtime usa richieste Obsidian e fallback che interpretano il protocollo: stream HTTP Node su desktop, fetch in altri ambienti. Claude dietro un gateway OpenAI-compatible usa il profilo del gateway, non Anthropic nativo.

Tentativi​

La modalità stabile è inizialmente disattivata; dove applicabili, i valori configurati sono tre tentativi e cinque secondi di intervallo. I fallback possono gestire errori transitori, non credenziali o modelli errati. Timeout remoti, limiti e quote possono ancora interrompere richieste lunghe.

Cache delle risposte​

Una cache limitata in memoria può riusare risposte riuscite. Endpoint, modello, parametri, prompt e contenuto contribuiscono all’identità. Non è persistenza né contabilità e non garantisce che una ripetizione eviti costi.

Ragionamento​

Le opzioni reasoning/thinking seguono regole del profilo e del modello. Non trasferire parametri tra protocolli. Verifica campionamento e budget con l’attività esatta.

Stima token​

Lunghezza del testo e limiti configurati non sono conteggi esatti. Per la fatturazione consulta l’uso effettivo del provider; non esiste una stima universale dei costi.

Scoperta dei modelli​

Fetch models usa la scoperta supportata dal profilo. Alcuni deployment richiedono un nome manuale. Permesso di elenco e permesso di generazione sono distinti.

Testa connessione segue il profilo: models-then-chat può riuscire con il solo elenco; chat-only genera una risposta breve. Esegui comunque una vera attività per verificare modello e formato.

  • Anthropic e Google hanno elenchi nativi.
  • Ollama elenca tag scaricati; LM Studio i modelli esposti dal server.
  • Azure richiede deployment e versione API.
  • I gateway possono limitare l’elenco pur consentendo un modello esplicito.

Avvio rapido​

  1. Scegli il profilo in Settings → Notemd.
  2. Configura endpoint, credenziali e modello/deployment reale.
  3. Prova la connessione e una nota temporanea.
  4. Controlla output e progresso prima di abilitare lotti o instradamento specifico.

Per uso locale prepara modello e server. Ollama non richiede chiave; LM Studio accetta chiave facoltativa e parte da EMPTY. Imposta un token reale se necessario. Ricerca Web e altre dipendenze di rete restano online.

Passi successivi​