Skip to main content

LLM प्रदाता

💡TL;DR

Notemd 4 परिवहन प्रकारों में 36 LLM प्रदाताओं का समर्थन करता है. सभी API कॉलें कच्चे HTTP का उपयोग करती हैं (कोई SDK नहीं) एवं स्वचालित पुनः प्रयास, परिवहन फ़ॉलबैक एवं 5 मिनट की प्रतिक्रिया कैशिंग की सुविधा देती हैं. प्रति-कार्य मॉडल चयन के कारण आप अवधारणा निष्कर्षण हेतु सस्ते मॉडल एवं अनुसंधान हेतु शक्तिशाली मॉडल का उपयोग कर सकते हैं. स्थानीय प्रदाताओं (Ollama, LMStudio) के लिए कोई API कुंजी आवश्यक नहीं है.

यह Obsidian AI Knowledge Management Guide का हिस्सा है.

प्रदाता श्रेणियाँ

क्लाउड प्रदाता

प्रदाताडिफ़ॉल्ट बेस URLडिफ़ॉल्ट मॉडलटेम्परेचर
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

गेटवे / प्रॉक्सी प्रदाता

प्रदाताडिफ़ॉल्ट बेस URLडिफ़ॉल्ट मॉडलनोट्स
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetHTTP-Referer + X-Title हेडर जोड़ता है
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniX-GitHub-Api-Version हेडर जोड़ता है
AIHubMixaihubmix.com/v1gpt-4o-miniAPP-Code हेडर जोड़ता है
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelवैकल्पिक API कुंजी
नया APIlocalhost:3000/v1gpt-4.1वैकल्पिक API कुंजी
OpenAI Compatible(user-configured)your-model-idकस्टम एंडपॉइंट

चीन के प्रदाता

प्रदाताडिफ़ॉल्ट बेस URLडिफ़ॉल्ट मॉडलनोट्स
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusकोडिंग-केंद्रित
Doubaoark.cn-beijing.volces.com/api/v3(एंडपॉइंट ID आवश्यक है)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, China एंडपॉइंट
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, अंतर्राष्ट्रीय एंडपॉइंट
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32Bमॉडल होस्टिंग प्लेटफ़ॉर्म
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao के लिए एक Ark एंडपॉइंट ID आवश्यक है (फ़ॉर्मेट: ep-xxxxxxxx-xxxx-xxxx). डिफ़ॉल्ट प्लेसहोल्डर को बदलना आवश्यक है.

स्थानीय प्रदाता

प्रदाताडिफ़ॉल्ट बेस URLडिफ़ॉल्ट मॉडलनोट्स
Ollamalocalhost:11434/apillama3कोई API कुंजी नहीं. NDJSON स्ट्रीमिंग. /api/tags के माध्यम से मॉडल खोज
LMStudiolocalhost:1234/v1local-model"EMPTY" को बेयरर टोकन के रूप में भेजता है. OpenAI-संगत खोज
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(user-configured)gpt-4oURL में डिप्लॉयमेंट का नाम। api-key हेडर

कार्य-वार मॉडल चयन

Notemd प्रत्येक टास्क के लिए स्वतंत्र प्रोवाइडर और मॉडल का समर्थन करता है। useMultiModelSettings: true के साथ इसे सक्षम करें.

उपलब्ध टास्क

कार्यसेटिंग्स कुंजीडिफ़ॉल्ट प्रोवाइडर
लिंक जोड़ें (विकि-लिंक सम्मिलन)addLinksProvider / addLinksModelDeepSeek
अनुसंधान (वेब खोज + सारांशीकरण)researchProvider / researchModelDeepSeek
शीर्षक से जनरेट करेंgenerateTitleProvider / generateTitleModelDeepSeek
अनुवादtranslateProvider / translateModelDeepSeek
डायग्राम जनरेशनsummarizeToMermaidProvider / ModelDeepSeek
अवधारणा निष्कर्षणextractConceptsProvider / ModelDeepSeek
मूल पाठ निष्कर्षणextractOriginalTextProvider / ModelDeepSeek

रिज़ॉल्यूशन क्रम

  1. यदि useMultiModelSettings सक्षम है → टास्क-विशिष्ट प्रोवाइडर + मॉडल का उपयोग करें
  2. यदि टास्क मॉडल ओवरराइड खाली है → प्रोवाइडर के डिफ़ॉल्ट मॉडल पर वापस जाएं
  3. यदि टास्क प्रोवाइडर अमान्य है → ग्लोबल activeProvider पर वापस जाएं
  4. यदि useMultiModelSettings बंद है → सभी कार्य ग्लोबल activeProvider का उपयोग करते हैं

अनुशंसित कॉन्फ़िगरेशन्स

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API कॉल आर्किटेक्चर

ट्रांसपोर्ट लेयर्स

  1. Obsidian requestUrl — प्राथमिक (बिल्ट-इन, सभी प्लेटफॉर्मों पर कार्य करता है)
  2. डेस्कटॉप HTTP — Node.js http/https मॉड्यूल (स्ट्रीमिंग + लंबे अनुरोध)
  3. वेब fetch — जब Node.js मॉड्यूल उपलब्ध न हों तो वैकल्पिक विकल्प

अस्थायी नेटवर्क त्रुटियों के समय प्लगइन स्वचालित रूप से ट्रांसपोर्ट्स के बीच स्विच कर देता है.

रिट्राई लॉजिक

  • सामान्य मोड (enableStableApiCall: false): एक ही प्रयास। अस्थायी विफलता पर, स्वचालित रूप से स्थिर रिट्राई मोड में स्विच हो जाता है.
  • स्थिर रिट्राई मोड (enableStableApiCall: true): 4 बार तक प्रयास (1 + 3 रिट्राई) 5 सेकंड के अंतराल पर.
  • जो अस्थायी त्रुटियाँ रिट्राई को ट्रिगर करती हैं: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • जिन्हें रिट्राई नहीं किया जा सकता: HTTP 400, 401, 403, 404

रिस्पॉन्स कैशिंग

प्रोवाइडर + मॉडल + टेम्परेचर + प्रॉम्प्ट + कंटेंट के आधार पर 5 मिनट की इन-मेमोरी LRU कैश। 5 मिनट के भीतर आने वाले समान अनुरोधों को तुरंत कैश्ड परिणाम मिल जाते हैं.

रीज़निंग मॉडल हैंडलिंग

वे मॉडल जो system भूमिका का समर्थन नहीं करते (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) स्वचालित रूप से सिस्टम + यूज़र प्रॉम्प्ट्स को एक ही यूज़र मैसेज में जोड़ देते हैं.

DeepSeek-विशिष्ट: thinkingEnabled अनुरोध में { thinking: { type: 'enabled' } } जोड़ता है। reasoningEffort (कम/मध्यम/उच्च) को reasoning_effort के रूप में पास किया जाता है। जब सोच चालू होती है तो अधिकतम आउटपुट टोकन ≥ 8000 होने की पुष्टि करता है।

टोकन अनुमान

estimateTokens(text): Math.ceil(text.length / 4) — प्रति टोकन 4 अक्षरों की विधि। LLM को भेजने से पहले maxResearchContentTokens को लागू करने हेतु इसका उपयोग किया जाता है।

लागत ट्रैकिंग लागू नहीं की गई है।

मॉडल खोज

मोडप्रदाताएंडपॉइंट
ollama-tagsOllama/api/tags
google-modelsGoogleमॉडल सूची API
anthropic-modelsAnthropicमॉडल सूची API
openai-compatible-modelsDeepSeek, Qwen, Mistral, आदि./v1/models
openrouter-modelsOpenRouterमॉडल सूची API
github-modelsGitHub Modelsइन्फरेंस API
noneAzure OpenAIअक्षम (डिप्लॉयमेंट नाम की आवश्यकता है)

त्वरित प्रारंभ

  1. प्रदाता चुनें — DeepSeek (चीन), OpenAI (अंतरराष्ट्रीय), या Ollama (स्थानीय/मुफ्त)
  2. API कुंजी दर्ज करें — सेटिंग्स → Notemd → प्रदाता → API कुंजी
  3. कनेक्शन जाँचें — टेस्ट बटन पर क्लिक करें
  4. वैकल्पिक: प्रति-कार्य मॉडलuseMultiModelSettings को सक्षम करें एवं इसे अलग से कॉन्फ़िगर करें

Ollama के लिए: API कुंजी की कोई आवश्यकता नहीं है। बस यह सुनिश्चित करें कि ollama serve चल रहा है.


अगले चरण