Skip to main content

فراهم‌کنندگان LLM

💡TL;DR

Notemd از ۳۶ فراهم‌کننده LLM در ۴ نوع انتقال پشتیبانی می‌کند. تمام فراخوانی‌های API از HTTP خام (بدون SDKها) استفاده کرده و دارای تلاش مجدد خودکار، جایگزینی انتقال و ذخیره‌سازی پاسخ به مدت ۵ دقیقه هستند. انتخاب مدل بر حسب وظیفه امکان استفاده از مدل‌های ارزان برای استخراج مفاهیم و مدل‌های قدرتمند برای تحقیقات را فراهم می‌کند. برای فراهم‌کنندگان محلی (Ollama، LMStudio) نیازی به کلید API نیست.

این بخشی از Obsidian راهنمای مدیریت دانش هوش مصنوعی است.

رده‌های فراهم‌کننده

فراهم‌کنندگان ابری

ارائه‌دهندهپایه‌ی پیش‌فرض URLمدل پیش‌فرضدمای خروجی
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

فراهم‌کنندگان گیت‌وی / پروکسی

ارائه‌دهندهپایه‌ی پیش‌فرض URLمدل پیش‌فرضیادداشت‌ها
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetافزودن هدرهای HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniافزودن هدر X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniافزودن هدر APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelکلید اختیاری API
نوع جدید APIlocalhost:3000/v1gpt-4.1کلید اختیاری API
OpenAI Compatible(تنظیم‌شده توسط کاربر)your-model-idنقطه پایان سفارشی

ارائه‌دهندگان چین

ارائه‌دهندهپایه پیش‌فرض URLمدل پیش‌فرضیادداشت‌ها
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusمتمرکز بر برنامه‌نویسی
Doubaoark.cn-beijing.volces.com/api/v3(شناسه پایانه الزامی است)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5نقطه پایان Zhipu، چین
Z AIapi.z.ai/api/paas/v4glm-5نقطه پایان بین‌المللی Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32Bپلتفرم میزبانی مدل‌ها
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao نیاز به شناسه نقطه پایان Ark دارد (فرمت: ep-xxxxxxxx-xxxx-xxxx). جایگزینی جایگزین پیش‌فرض الزامی است.

ارائه‌دهندگان محلی

ارائه‌دهندهپایه پیش‌فرض URLمدل پیش‌فرضیادداشت‌ها
Ollamalocalhost:11434/apillama3هیچ کلید API وجود ندارد. پخش NDJSON. کشف مدل از طریق /api/tags
LMStudiolocalhost:1234/v1local-modelارسال "EMPTY" به عنوان توکن بیرر. کشف سازگار با OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(تنظیم‌شده توسط کاربر)gpt-4oنام استقرار در URL. هدر api-key

انتخاب مدل بر حسب وظیفه

Notemd از ارائه‌دهنده و مدل مستقل برای هر وظیفه پشتیبانی می‌کند. آن را با useMultiModelSettings: true فعال کنید.

وظایف موجود

وظیفهکلید تنظیماتارائه‌دهنده پیش‌فرض
افزودن لینک‌ها (قرار دادن لینک ویکی)addLinksProvider / addLinksModelDeepSeek
تحقیق (جستجوی وب + خلاصه‌سازی)researchProvider / researchModelDeepSeek
تولید از عنوانgenerateTitleProvider / generateTitleModelDeepSeek
ترجمهtranslateProvider / translateModelDeepSeek
تولید نمودارsummarizeToMermaidProvider / ModelDeepSeek
استخراج مفهومextractConceptsProvider / ModelDeepSeek
استخراج متن اصلیextractOriginalTextProvider / ModelDeepSeek

ترتیب رفع مشکلات

  1. اگر useMultiModelSettings فعال باشد → از ارائه‌دهنده و مدل مخصوص وظیفه استفاده کنید
  2. اگر تغییر مدل وظیفه خالی باشد → به مدل پیش‌فرض ارائه‌دهنده رجوع کنید
  3. اگر ارائه‌دهنده وظیفه نامعتبر باشد → به activeProvider جهانی رجوع کنید
  4. اگر useMultiModelSettings خاموش باشد → تمام وظایف از activeProvider جهانی استفاده می‌کنند

پیکربندی‌های توصیه‌شده

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

معماری فراخوانی API

لایه‌های انتقال

  1. Obsidian requestUrl — اصلی (داخلی، روی تمام پلتفرم‌ها کار می‌کند)
  2. Desktop HTTP — ماژول‌های Node.js http/https (ستریمینگ + درخواست‌های طولانی)
  3. Web fetch — گزینه جایگزین هنگام عدم در دسترس بودن ماژول‌های Node.js

این پلاگین به‌طور خودکار در صورت خطاهای موقت شبکه، بین لایه‌های انتقال جابجا می‌شود.

منطق تلاش مجدد

  • حالت عادی (enableStableApiCall: false): یک تلاش. در صورت خطا موقت، به‌طور خودکار به تلاش مجدد پایدار ارتقا می‌یابد.
  • حالت تلاش مجدد پایدار (enableStableApiCall: true): تا ۴ تلاش (۱ + ۳ تلاش مجدد) با فواصل ۵ ثانیه‌ای.
  • خطاهای موقتی که باعث تلاش مجدد می‌شوند: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • غیرقابل تلاش مجدد: HTTP 400, 401, 403, 404

کش‌سازی پاسخ‌ها

کش LRU در حافظه با مدت زمان ۵ دقیقه که بر اساس ارائه‌دهنده + مدل + دما + پرامپت + محتوا کلیدگذاری می‌شود. درخواست‌های یکسان بعدی در عرض ۵ دقیقه بلافاصله با نتایج کش‌شده پاسخ داده می‌شوند.

مدیریت مدل‌های استدلالی

مدل‌هایی که از نقش system پشتیبانی نمی‌کنند (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) به‌طور خودکار پرامپت‌های سیستم و کاربر را در یک پیام کاربری واحد ترکیب می‌کنند.

DeepSeek-مشخص: thinkingEnabled { thinking: { type: 'enabled' } } را به درخواست اضافه می‌کند. reasoningEffort (پایین/متوسط/بالا) به عنوان reasoning_effort منتقل می‌شود. هنگام فعال بودن حالت تفکر، اطمینان حاصل می‌شود که حداکثر توکن‌های خروجی ≥ 8000 باشد.

تخمین توکن

estimateTokens(text): Math.ceil(text.length / 4) — روش هیوریستیک ۴ کاراکتر برای هر توکن. برای اعمال maxResearchContentTokens قبل از ارسال به LLM استفاده می‌شود.

هیچ ردیابی هزینه‌ای پیاده‌سازی نشده است.

کشف مدل‌ها

حالتارائه‌دهندگاننقطه پایان
ollama-tagsOllama/api/tags
google-modelsGoogleلیست مدل‌ها API
anthropic-modelsAnthropicلیست مدل‌ها API
openai-compatible-modelsDeepSeek، Qwen، Mistral و غیره./v1/models
openrouter-modelsOpenRouterلیست مدل‌ها API
github-modelsGitHub Modelsاستنتاج API
noneAzure OpenAIغیرفعال (نیاز به نام پیاده‌سازی دارد)

شروع سریع

  1. یک ارائه‌دهنده انتخاب کنید — DeepSeek (چین)، OpenAI (بین‌المللی) یا Ollama (محلی/رایگان)
  2. کلید API را وارد کنید — تنظیمات → Notemd → ارائه‌دهنده → کلید API
  3. اتصال را آزمایش کنید — روی دکمه آزمایش کلیک کنید
  4. گزینه‌ای: مدل‌های مخصوص هر وظیفهuseMultiModelSettings را فعال کنید و به‌طور جداگانه پیکربندی نمایید

برای Ollama: نیازی به کلید API نیست. فقط مطمئن شوید که ollama serve در حال اجراست.


گام‌های بعدی