Provider LLM
Categorie
I valori seguenti provengono dal registro. Mantieni schema e percorso URL completi; sostituisci segnaposto con endpoint e modelli reali. Accesso, prezzi e ritiro dei modelli dipendono dal provider.
Cloud
| Provider | Modello iniziale | URL base iniziale |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Configura l’endpoint della risorsa Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateway e proxy
| Provider | Modello iniziale | URL base iniziale |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Locali
| Provider | Modello iniziale | URL base iniziale |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Provider cinesi
Consulta la configurazione regionale. La categoria non garantisce accessibilità geografica o qualità linguistica. Abbina regione dell’account, endpoint e diritti sul modello.
Modelli per attività
Attiva useMultiModelSettings per scegliere provider e override separati. Altrimenti vale activeProvider. Un override vuoto usa il modello del provider; le scelte salvate non valide vengono riconciliate con quello attivo al caricamento.
| Attività | Impostazione provider | Override modello |
|---|---|---|
| Link | addLinksProvider | addLinksModel |
| Generazione dal titolo | generateTitleProvider | generateTitleModel |
| Sintesi di ricerca | researchProvider | researchModel |
| Traduzione | translateProvider | translateModel |
| Estrazione concetti | extractConceptsProvider | extractConceptsModel |
| Sintesi Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Estrazione originale | extractOriginalTextProvider | extractOriginalTextModel |
Il provider attivo e quelli salvati per attività iniziano con DeepSeek. Cambiare solo il provider attivo non sostituisce instradamenti specifici abilitati. Verificali prima di usare materiale privato.
Architettura delle chiamate
Trasporti
La runtime usa richieste Obsidian e fallback che interpretano il protocollo: stream HTTP Node su desktop, fetch in altri ambienti. Claude dietro un gateway OpenAI-compatible usa il profilo del gateway, non Anthropic nativo.
Tentativi
La modalità stabile è inizialmente disattivata; dove applicabili, i valori configurati sono tre tentativi e cinque secondi di intervallo. I fallback possono gestire errori transitori, non credenziali o modelli errati. Timeout remoti, limiti e quote possono ancora interrompere richieste lunghe.
Cache delle risposte
Una cache limitata in memoria può riusare risposte riuscite. Endpoint, modello, parametri, prompt e contenuto contribuiscono all’identità. Non è persistenza né contabilità e non garantisce che una ripetizione eviti costi.
Ragionamento
Le opzioni reasoning/thinking seguono regole del profilo e del modello. Non trasferire parametri tra protocolli. Verifica campionamento e budget con l’attività esatta.
Stima token
Lunghezza del testo e limiti configurati non sono conteggi esatti. Per la fatturazione consulta l’uso effettivo del provider; non esiste una stima universale dei costi.
Scoperta dei modelli
Fetch models usa la scoperta supportata dal profilo. Alcuni deployment richiedono un nome manuale. Permesso di elenco e permesso di generazione sono distinti.
Testa connessione segue il profilo: models-then-chat può riuscire con il solo elenco; chat-only genera una risposta breve. Esegui comunque una vera attività per verificare modello e formato.
- Anthropic e Google hanno elenchi nativi.
- Ollama elenca tag scaricati; LM Studio i modelli esposti dal server.
- Azure richiede deployment e versione API.
- I gateway possono limitare l’elenco pur consentendo un modello esplicito.
Avvio rapido
- Scegli il profilo in Settings → Notemd.
- Configura endpoint, credenziali e modello/deployment reale.
- Prova la connessione e una nota temporanea.
- Controlla output e progresso prima di abilitare lotti o instradamento specifico.
Per uso locale prepara modello e server. Ollama non richiede chiave; LM Studio accetta chiave facoltativa e parte da EMPTY. Imposta un token reale se necessario. Ricerca Web e altre dipendenze di rete restano online.