ارائهدهندگان LLM
دستهها
مقادیر جدول از رجیستری آمدهاند. scheme و مسیر کامل URL را حفظ و مقدار نمونه را با deployment واقعی عوض کنید. دسترسی، قیمت و زمان پایان پشتیبانی متعلق به ارائهدهنده است.
ابری
| ارائهدهنده | مدل اولیه | نشانی اولیه |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | نشانی منبع Azure خود را تنظیم کنید |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
درگاه و پراکسی
| ارائهدهنده | مدل اولیه | نشانی اولیه |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
محلی
| ارائهدهنده | مدل اولیه | نشانی اولیه |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
ارائهدهندگان چینی
تنظیم منطقهای را ببینید. این دسته دسترسی جغرافیایی یا کیفیت زبان چینی را تضمین نمیکند. منطقهٔ حساب، نشانی و مجوز مدل را تطبیق دهید.
انتخاب برای هر کار
با useMultiModelSettings ارائهدهنده و override مدل را جدا کنید؛ وگرنه activeProvider استفاده میشود. override خالی مدل همان ارائهدهنده را میگیرد. انتخاب ذخیرهشدهٔ نامعتبر هنگام بارگذاری با ارائهدهندهٔ فعال سازگار میشود.
| کار | تنظیم ارائهدهنده | override مدل |
|---|---|---|
| پیوند | addLinksProvider | addLinksModel |
| تولید عنوان | generateTitleProvider | generateTitleModel |
| خلاصهٔ پژوهش | researchProvider | researchModel |
| ترجمه | translateProvider | translateModel |
| استخراج مفهوم | extractConceptsProvider | extractConceptsModel |
| خلاصهٔ Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| استخراج اصل | extractOriginalTextProvider | extractOriginalTextModel |
ارائهدهندهٔ فعال و انتخابهای اولیهٔ کار DeepSeek هستند. تغییر فعال، مسیر اختصاصی روشن را جایگزین نمیکند. هر مسیر را قبل از دادهٔ خصوصی بررسی کنید.
ساختار درخواست
لایهٔ انتقال
درخواست Obsidian و fallback آگاه از پروتکل به کار میرود. دسکتاپ میتواند stream HTTP در Node و محیط دیگر fetch داشته باشد. Claude پشت درگاه OpenAI-compatible از نمایهٔ همان درگاه استفاده میکند، نه Anthropic بومی.
تلاش دوباره
حالت پایدار ابتدا خاموش و تنظیم قابلاعمال سه تلاش دوباره با فاصلهٔ پنج ثانیه است. خطای گذرا میتواند وارد مسیر مشترک تکرار یا fallback شود. احراز هویت و مدل اشتباه باید اصلاح شود؛ درخواست بلند هنوز با timeout، حد مدل و سهمیه محدود میشود.
حافظهٔ پاسخ
cache محدود در حافظه میتواند پاسخ موفق را بازاستفاده کند. نشانی، مدل، پارامترها، prompt و متن در هویت درخواست نقش دارند. این ذخیرهٔ پایدار یا حسابرس هزینه نیست و نبود درخواست پولی تازه را تضمین نمیکند.
مدل استدلالی
Reasoning و thinking تابع قواعد مدل و نمایهاند. پارامتر پروتکل دیگر را کپی نکنید. همان کار را بیازمایید؛ موفقیت چت پذیرش هر تنظیم نمونهگیری یا token را ثابت نمیکند.
تخمین token
طول متن و حد خروجی تعداد دقیق token ارائهدهنده نیست. برای هزینه مصرف واقعی حساب را بخوانید. برآورد عمومی قیمت وجود ندارد.
پیدا کردن مدل
Fetch models فقط در نمایهٔ پشتیبانیشده کار میکند. بعضی deploymentها نام دستی لازم دارند. مجوز فهرست و تولید مستقلاند. آزمایش اتصال در models-then-chat میتواند با فهرست موفق شود؛ chat-only تولید کوتاه دارد. مدل و قالب را با کار واقعی بررسی کنید.
- Anthropic و Google فهرست بومی دارند.
- Ollama tag دریافتشده و LM Studio مدل در معرض سرور را میخواند.
- Azure به deployment و نسخهٔ API نیاز دارد.
- درگاه ممکن است فهرست را ببندد ولی مدل صریح را بپذیرد.
شروع
- در Settings → Notemd نمایهٔ درست را انتخاب کنید.
- endpoint، کلید و مدل یا deployment واقعی را وارد کنید.
- اتصال و یک یادداشت موقت را بیازمایید.
- خروجی را پیش از گروه یا مسیر اختصاصی ببینید.
مدل و سرور محلی را از قبل آماده کنید. Ollama کلید اجباری ندارد؛ LM Studio کلید اختیاری با مقدار آغازین EMPTY دارد. اگر سرور محافظتشده است token واقعی بدهید. مدل محلی جستوجوی وب را آفلاین نمیکند.