Furnizori LLM
Categorii
Tabelele provin din registru. Păstrați schema și calea completă a URL-ului; înlocuiți exemplele cu instalarea dvs. Drepturile, prețurile și retragerea modelelor sunt controlate de furnizor.
Cloud
| Furnizor | Model implicit | URL de bază |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Configurați endpoint-ul resursei Azure |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateway-uri și proxy-uri
| Furnizor | Model implicit | URL de bază |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Servere locale
| Furnizor | Model implicit | URL de bază |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Furnizori chinezi
Vedeți configurarea regională. Categoria nu garantează disponibilitate geografică sau calitatea limbii chineze. Aliniați regiunea contului, endpoint-ul și drepturile modelului.
Alegere per sarcină
useMultiModelSettings permite furnizori/modele separate; altfel se aplică activeProvider. Modelul gol îl preia pe cel al furnizorului. Selecțiile salvate de furnizori care nu mai sunt valide sunt normalizate la cel activ la încărcare.
| Sarcină | Setarea furnizorului | Câmpul modelului |
|---|---|---|
| Linkuri | addLinksProvider | addLinksModel |
| Generare din titluri | generateTitleProvider | generateTitleModel |
| Rezumat de cercetare | researchProvider | researchModel |
| Traducere | translateProvider | translateModel |
| Concepte | extractConceptsProvider | extractConceptsModel |
| Rezumat Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Text original | extractOriginalTextProvider | extractOriginalTextModel |
Furnizorul activ și cei salvați pentru sarcini încep cu DeepSeek. Schimbarea doar a celui activ nu înlocuiește rutele specifice activate. Verificați-le înainte de conținut privat.
Arhitectura cererilor
Straturi de transport
Notemd folosește cererile Obsidian și fallback conștient de protocol. Pe desktop poate folosi streamuri Node HTTP, în alte medii fetch. Claude accesat prin gateway OpenAI-compatible folosește profilul gateway-ului, nu API-ul nativ Anthropic.
Reîncercări
Modul stabil este oprit; valorile asociate sunt trei reîncercări la intervale de cinci secunde. Erorile temporare pot trece prin fallback/reîncercări comune. Reparați separat accesul și configurația modelului. Cererile lungi pot în continuare depăși timpul sau cota.
Cache de răspunsuri
Un cache limitat în memorie poate reutiliza răspunsuri reușite. Identitatea include endpoint, model, parametri de generare, prompt și conținut. Nu este stocare persistentă sau contor de cost și nu garantează repetări gratuite.
Modele de raționament
Reasoning/thinking urmează regulile profilului și modelului. Nu mutați parametri specifici de protocol între servicii. Modelele pot respinge setări de tokenuri, eșantionare sau raționament; testați sarcina reală.
Estimarea tokenurilor
Lungimea textului și limita de ieșire nu sunt măsurători exacte ale furnizorului. Calculați costul din consumul real; nu există o garanție generală de estimare.
Descoperirea modelelor
Fetch models funcționează unde este suportat; unele instalări cer ID manual. Drepturile de listare și generare sunt independente. Test connection în models-then-chat poate trece doar prin listare, iar chat-only generează scurt. Verificați sarcina și formatul reale.
- Anthropic și Google au propriile API-uri de descoperire.
- Ollama listează taguri descărcate, LM Studio modele ale serverului.
- Azure cere deployment și versiune API.
- Gateway-urile pot limita lista și permite totuși generare cu ID explicit.
Pornire
- Alegeți profilul corect în Settings → Notemd.
- Introduceți endpoint-ul, cheia și modelul/deploymentul accesibil.
- Testați conexiunea și o notă de probă.
- Verificați rezultatul și raportul înaintea loturilor ori rutării per sarcină.
Local, serverul și modelul trebuie pregătite. Ollama nu cere cheie; LM Studio o acceptă opțional, implicit EMPTY. Folosiți token real când instalarea îl cere. LLM local nu face căutarea web offline.