رفتن به محتوای اصلی

ارائه‌دهندگان LLM

💡TL;DR
Notemd دارای 36 نمایه در خانواده‌های OpenAI-compatible، Anthropic، Google، Azure OpenAI و Ollama است. پروتکل endpoint را با نمایه، اطلاعات مجاز و مدل در دسترس هماهنگ کنید. مقادیر اولیه قابل‌تغییرند و دسترسی امروز به مدل را تضمین نمی‌کنند.

دسته‌ها​

مقادیر جدول از رجیستری آمده‌اند. scheme و مسیر کامل URL را حفظ و مقدار نمونه را با deployment واقعی عوض کنید. دسترسی، قیمت و زمان پایان پشتیبانی متعلق به ارائه‌دهنده است.

ابری​

ارائه‌دهندهمدل اولیهنشانی اولیه
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oنشانی منبع Azure خود را تنظیم کنید
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

درگاه و پراکسی​

ارائه‌دهندهمدل اولیهنشانی اولیه
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

محلی​

ارائه‌دهندهمدل اولیهنشانی اولیه
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

ارائه‌دهندگان چینی​

تنظیم منطقه‌ای را ببینید. این دسته دسترسی جغرافیایی یا کیفیت زبان چینی را تضمین نمی‌کند. منطقهٔ حساب، نشانی و مجوز مدل را تطبیق دهید.

انتخاب برای هر کار​

با useMultiModelSettings ارائه‌دهنده و override مدل را جدا کنید؛ وگرنه activeProvider استفاده می‌شود. override خالی مدل همان ارائه‌دهنده را می‌گیرد. انتخاب ذخیره‌شدهٔ نامعتبر هنگام بارگذاری با ارائه‌دهندهٔ فعال سازگار می‌شود.

کارتنظیم ارائه‌دهندهoverride مدل
پیوندaddLinksProvideraddLinksModel
تولید عنوانgenerateTitleProvidergenerateTitleModel
خلاصهٔ پژوهشresearchProviderresearchModel
ترجمهtranslateProvidertranslateModel
استخراج مفهومextractConceptsProviderextractConceptsModel
خلاصهٔ MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
استخراج اصلextractOriginalTextProviderextractOriginalTextModel

ارائه‌دهندهٔ فعال و انتخاب‌های اولیهٔ کار DeepSeek هستند. تغییر فعال، مسیر اختصاصی روشن را جایگزین نمی‌کند. هر مسیر را قبل از دادهٔ خصوصی بررسی کنید.

ساختار درخواست​

لایهٔ انتقال​

درخواست Obsidian و fallback آگاه از پروتکل به کار می‌رود. دسکتاپ می‌تواند stream HTTP در Node و محیط دیگر fetch داشته باشد. Claude پشت درگاه OpenAI-compatible از نمایهٔ همان درگاه استفاده می‌کند، نه Anthropic بومی.

تلاش دوباره​

حالت پایدار ابتدا خاموش و تنظیم قابل‌اعمال سه تلاش دوباره با فاصلهٔ پنج ثانیه است. خطای گذرا می‌تواند وارد مسیر مشترک تکرار یا fallback شود. احراز هویت و مدل اشتباه باید اصلاح شود؛ درخواست بلند هنوز با timeout، حد مدل و سهمیه محدود می‌شود.

حافظهٔ پاسخ​

cache محدود در حافظه می‌تواند پاسخ موفق را بازاستفاده کند. نشانی، مدل، پارامترها، prompt و متن در هویت درخواست نقش دارند. این ذخیرهٔ پایدار یا حسابرس هزینه نیست و نبود درخواست پولی تازه را تضمین نمی‌کند.

مدل استدلالی​

Reasoning و thinking تابع قواعد مدل و نمایه‌اند. پارامتر پروتکل دیگر را کپی نکنید. همان کار را بیازمایید؛ موفقیت چت پذیرش هر تنظیم نمونه‌گیری یا token را ثابت نمی‌کند.

تخمین token​

طول متن و حد خروجی تعداد دقیق token ارائه‌دهنده نیست. برای هزینه مصرف واقعی حساب را بخوانید. برآورد عمومی قیمت وجود ندارد.

پیدا کردن مدل​

Fetch models فقط در نمایهٔ پشتیبانی‌شده کار می‌کند. بعضی deploymentها نام دستی لازم دارند. مجوز فهرست و تولید مستقل‌اند. آزمایش اتصال در models-then-chat می‌تواند با فهرست موفق شود؛ chat-only تولید کوتاه دارد. مدل و قالب را با کار واقعی بررسی کنید.

  • Anthropic و Google فهرست بومی دارند.
  • Ollama tag دریافت‌شده و LM Studio مدل در معرض سرور را می‌خواند.
  • Azure به deployment و نسخهٔ API نیاز دارد.
  • درگاه ممکن است فهرست را ببندد ولی مدل صریح را بپذیرد.

شروع​

  1. در Settings → Notemd نمایهٔ درست را انتخاب کنید.
  2. endpoint، کلید و مدل یا deployment واقعی را وارد کنید.
  3. اتصال و یک یادداشت موقت را بیازمایید.
  4. خروجی را پیش از گروه یا مسیر اختصاصی ببینید.

مدل و سرور محلی را از قبل آماده کنید. Ollama کلید اجباری ندارد؛ LM Studio کلید اختیاری با مقدار آغازین EMPTY دارد. اگر سرور محافظت‌شده است token واقعی بدهید. مدل محلی جست‌وجوی وب را آفلاین نمی‌کند.

گام بعد​