Skip to main content

LLM Sağlayıcılar

💡TL;DR

Notemd, 4 farklı taşıma türünde 36 LLM sağlayıcıyı destekler. Tüm API çağrıları otomatik yeniden deneme, taşıma geri dönüşü ve 5 dakikalık yanıt önbellekleme özellikleriyle ham HTTP kullanır (SDK yoktur). Görev başına model seçimi sayesinde kavram çıkarma için ucuz modelleri ve araştırma için güçlü modelleri kullanabilirsiniz. Yerel sağlayıcılar (Ollama, LMStudio) için herhangi bir API anahtarı gerekmez.

Bu içerik Obsidian AI Bilgi Yönetimi Kılavuzu serisinin bir parçasıdır.

Sağlayıcı Kategorileri

Bulut Sağlayıcıları

SağlayıcıVarsayılan Temel URLVarsayılan ModelSıcaklık
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Ağ Geçidi / Proxy Sağlayıcıları

SağlayıcıVarsayılan Temel URLVarsayılan ModelNotlar
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetHTTP-Referer + X-Title başlıkları ekler
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniX-GitHub-Api-Version başlığı ekler
AIHubMixaihubmix.com/v1gpt-4o-miniAPP-Code başlığı ekler
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelİsteğe bağlı API anahtarı
Yeni APIlocalhost:3000/v1gpt-4.1İsteğe bağlı API anahtarı
OpenAI Compatible(kullanıcı tarafından yapılandırıldı)your-model-idÖzel uç nokta

Çin Sağlayıcıları

SağlayıcıVarsayılan Temel URLVarsayılan ModelNotlar
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusKodlamaya odaklı
Doubaoark.cn-beijing.volces.com/api/v3(Uç nokta kimliği gereklidir)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Çin uç noktası Zhipu
Z AIapi.z.ai/api/paas/v4glm-5Uluslararası uç noktası Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BModel barındırma platformu
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao, bir Ark uç nokta ID'si gerektirir (format: ep-xxxxxxxx-xxxx-xxxx). Varsayılan yer tutucu değiştirilmelidir.

Yerel Sağlayıcılar

SağlayıcıVarsayılan Temel URLVarsayılan ModelNotlar
Ollamalocalhost:11434/apillama3API anahtarı yok. NDJSON akışı. /api/tags aracılığıyla model keşfi
LMStudiolocalhost:1234/v1local-model"EMPTY"'yı taşıyıcı token olarak gönderir. OpenAI-uyumlu keşif
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(kullanıcı tarafından yapılandırıldı)gpt-4oURL içindeki dağıtım adı. api-key başlığı

Görev Bazlı Model Seçimi

Notemd, her görev için ayrı sağlayıcı ve model destekler. useMultiModelSettings: true ile etkinleştirin.

Mevcut Görevler

GörevAyarlar AnahtarıVarsayılan Sağlayıcı
Bağlantı Ekleme (wiki bağlantısı ekleme)addLinksProvider / addLinksModelDeepSeek
Araştırma (web araması + özetleme)researchProvider / researchModelDeepSeek
Başlıktan OluşturmagenerateTitleProvider / generateTitleModelDeepSeek
ÇeviritranslateProvider / translateModelDeepSeek
Diyagram OluşturmasummarizeToMermaidProvider / ModelDeepSeek
Kavram ÇıkarmaextractConceptsProvider / ModelDeepSeek
Orijinal Metin ÇıkarmaextractOriginalTextProvider / ModelDeepSeek

Çözüm Sırası

  1. Eğer useMultiModelSettings etkinse → göreve özel sağlayıcı + model kullanılır
  2. Görev modeli özel ayarı boşsa → sağlayıcının varsayılan modeline dönülür
  3. Görev sağlayıcısı geçersizse → küresel activeProvider kullanılır
  4. Eğer useMultiModelSettings kapalıysa → tüm görevler küresel activeProvider kullanır

Önerilen Yapılandırmalar

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Çağrı Mimarisi

Taşıma Katmanları

  1. Obsidian requestUrl — birincil (yerleşik, tüm platformlarda çalışır)
  2. Masaüstü HTTP — Node.js http/https modülleri (akışlı + uzun istekler)
  3. Web fetch — Node.js modülleri kullanılamadığında yedek çözüm

Eklenti, geçici ağ hatalarında otomatik olarak taşıma yöntemleri arasında geçiş yapar.

Yeniden Deneme Mantığı

  • Normal mod (enableStableApiCall: false): Tek deneme. Geçici bir hata durumunda otomatik olarak daha istikrarlı bir yeniden denemeye geçilir.
  • İstikrarlı yeniden deneme modu (enableStableApiCall: true): 5 saniyelik aralıklarla toplam 4 deneme (1 + 3 yeniden deneme)
  • Yeniden denemeyi tetikleyen geçici hatalar: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Yeniden deneme yapılamayanlar: HTTP 400, 401, 403, 404

Yanıt Önbellekleme

Sağlayıcı + model + sıcaklık + istek + içerik anahtarlarıyla 5 dakikalık bellek içi LRU önbellek. 5 dakika içinde gelen benzer istekler anında önbellekten yanıt alır.

Mantık Modeli İşleme

system rolünü desteklemeyen modeller (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) otomatik olarak sistem + kullanıcı isteklerini tek bir kullanıcı mesajı halinde birleştirir.

DeepSeek-özel: thinkingEnabled isteğe { thinking: { type: 'enabled' } } ekler. reasoningEffort (düşük/orta/yüksek) değeri reasoning_effort olarak iletilir. Düşünme modu açıkken maksimum çıktı token sayısının ≥ 8000 olup olmadığı doğrulanır.

Token Tahmini

estimateTokens(text): Math.ceil(text.length / 4) — her token için 4 karakterlik bir yaklaşım. LLM'a göndermeden önce maxResearchContentTokens koşulunu sağlamak için kullanılır.

Maliyet takibi uygulanmamıştır.

Model Keşfi

ModSağlayıcılarUç Nokta
ollama-tagsOllama/api/tags
google-modelsGoogleModeller listesi API
anthropic-modelsAnthropicModeller listesi API
openai-compatible-modelsDeepSeek, Qwen, Mistral vb./v1/models
openrouter-modelsOpenRouterModel listesi API
github-modelsGitHub ModelsÇıkarım API
noneAzure OpenAIDevre dışı (dağıtım adı gereklidir)

Hızlı Başlangıç

  1. Bir sağlayıcı seçin — DeepSeek (Çin), OpenAI (Uluslararası) veya Ollama (Yerel/Ücretsiz)
  2. API anahtarını girin — Ayarlar → Notemd → Sağlayıcı → API Anahtarı
  3. Bağlantıyı test edin — Test butonuna tıklayın
  4. İsteğe bağlı: Görev bazlı modelleruseMultiModelSettings'yı etkinleştirin ve ayrı ayrı yapılandırın

Ollama için: API anahtarı gerekmez. Sadece ollama serve'ın çalıştığından emin olun.


Sonraki Adımlar