Zum Hauptinhalt springen

LLM Anbieter

💡TL;DR

Notemd unterstützt 36 LLM-Anbieter über 4 Transporttypen. Alle API-Aufrufe verwenden rohes HTTP (ohne SDKs) mit automatischem Wiederholungsversuch, Transport-Fallback und 5-minütiger Antwortcaching. Die Auswahl des Modells pro Aufgabe ermöglicht es Ihnen, günstige Modelle für die Konzeptextraktion sowie leistungsstarke Modelle für Forschungszwecke zu verwenden. Für lokale Anbieter (Ollama, LMStudio) ist kein API-Schlüssel erforderlich.

Dies ist ein Teil des Obsidian AI-Know-how-Management-Leitfadens.

Kategorien von Anbietern

Cloud-Anbieter

AnbieterStandardbasis URLStandardmodellTemperatur
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Gateway-/Proxy-Anbieter

AnbieterStandardbasis URLStandardmodellNotizen
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetFügt die Header HTTP-Referer + X-Title hinzu
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniFügt den Header X-GitHub-Api-Version hinzu
AIHubMixaihubmix.com/v1gpt-4o-miniFügt den Header APP-Code hinzu
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelOptionale API-Schlüssel
Neu APIlocalhost:3000/v1gpt-4.1Optionale API-Schlüssel
OpenAI Compatible(von dem Benutzer konfiguriert)your-model-idBenutzerdefinierter Endpunkt

Chinesische Anbieter

AnbieterStandardbasis URLStandardmodellNotizen
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-pluskodierungsorientiert
Doubaoark.cn-beijing.volces.com/api/v3(Ein Endpunkt-ID ist erforderlich)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, chinesischer Endpunkt
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, internationaler Endpunkt
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BModell-Hosting-Plattform
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao benötigt eine Ark-Endpunkt-ID (Format: ep-xxxxxxxx-xxxx-xxxx). Der Standard-Ersatztext muss ersetzt werden.

Lokale Anbieter

AnbieterStandardbasis URLStandardmodellNotizen
Ollamalocalhost:11434/apillama3Kein API-Schlüssel. NDJSON-Streaming. Modellentdeckung über /api/tags
LMStudiolocalhost:1234/v1local-modelSendet "EMPTY" als Trägertoken. Entdeckung, kompatibel mit OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Modellserver
Azure OpenAI(von dem Benutzer konfiguriert)gpt-4oNamens des Deployments in URL. api-key-Header

Modellauswahl pro Aufgabe

Notemd unterstützt einen eigenständigen Anbieter und ein eigenständiges Modell für jede Aufgabe. Aktivieren Sie es mit useMultiModelSettings: true.

Verfügbare Aufgaben

AufgabeEinstellungen-SchlüsselStandardanbieter
Links hinzufügen (Einfügung eines Wiki-Links)addLinksProvider / addLinksModelDeepSeek
Recherche (Websuche + Zusammenfassung)researchProvider / researchModelDeepSeek
Erstellen aus TitelgenerateTitleProvider / generateTitleModelDeepSeek
ÜbersetzungtranslateProvider / translateModelDeepSeek
DiagrammgenerierungsummarizeToMermaidProvider / ModelDeepSeek
KonzeptextraktionextractConceptsProvider / ModelDeepSeek
Extraktion des OriginaltextesextractOriginalTextProvider / ModelDeepSeek

Auflösungsreihenfolge

  1. Wenn useMultiModelSettings aktiv ist → verwenden Sie den für die Aufgabe spezifischen Anbieter + Modell
  2. Wenn die Task-Modell-Überwriteung leer ist → weichen Sie auf das Standardmodell des Anbieters aus
  3. Wenn der Aufgabenzuweiser ungültig ist → wechseln auf den globalen activeProvider
  4. Wenn useMultiModelSettings ausgeschaltet ist → alle Aufgaben verwenden das globale activeProvider

Empfohlene Konfigurationen

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Aufrufarchitektur

Transportebenen

  1. Obsidian requestUrl — primär (eingebaut, funktioniert auf allen Plattformen)
  2. Desktop HTTP — Node.js http/https-Module (Streaming + lange Anfragen)
  3. Web fetch – Rückfall, wenn Node.js-Module nicht verfügbar sind

Der Plugin wechselt bei vorübergehenden Netzwerkfehlern automatisch zwischen den Transportmethoden.

Wiederholungslogik

  • Normalmodus (enableStableApiCall: false): Einzelversuch. Bei vorübergehendem Fehler wird automatisch auf einen stabilen Neversuch umgestiegen.
  • Stabiler Wiederholungsmodus (enableStableApiCall: true): Bis zu 4 Versuche (1 + 3 Wiederholungen) mit 5-Sekunden-Intervallen.
  • Vorübergehende Fehler, die eine Wiederholung auslösen: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Nicht wiederholbar: HTTP 400, 401, 403, 404

Antwort-Caching

5-minütiger In-Memory-LRU-Cache, der nach Provider + Modell + Temperatur + Prompt + Inhalt keyt wird. Nachfolgende identische Anfragen innerhalb von 5 Minuten liefern sofort die aus dem Cache geladenen Ergebnisse.

Verarbeitung von Reasoning-Modellen

Modelle, die die system-Rolle nicht unterstützen (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), kombinieren automatisch die System- und Benutzereingaben zu einer einzigen Benutzernachricht.

DeepSeek-spezifisch: thinkingEnabled fügt { thinking: { type: 'enabled' } } zur Anfrage hinzu. reasoningEffort (niedrig/mittel/hoch) wird als reasoning_effort übergeben. Es wird überprüft, dass die maximale Anzahl an Ausgabetokens ≥ 8000 ist, wenn das Nachdenken aktiviert ist.

Token-Schätzung

estimateTokens(text): Math.ceil(text.length / 4) — Heuristik mit 4 Zeichen pro Token. Wird verwendet, um maxResearchContentTokens vor dem Senden an LLM durchzusetzen.

Es wird keine Kostenverfolgung implementiert.

Modellentdeckung

ModenAnbieterEndpunkt
ollama-tagsOllama/api/tags
google-modelsGoogleListe der Modelle API
anthropic-modelsAnthropicListe der Modelle API
openai-compatible-modelsDeepSeek, Qwen, Mistral, usw./v1/models
openrouter-modelsOpenRouterModellliste API
github-modelsGitHub ModelsSchlussfolgerung API
noneAzure OpenAIDeaktiviert (erfordert Namen der Bereitstellung)

Schnellstart

  1. Wählen Sie einen Anbieter – DeepSeek (China), OpenAI (International) oder Ollama (Lokal/Kostenlos)
  2. Drücken Sie die API-Taste — Einstellungen → Notemd → Anbieter → API-Schlüssel
  3. Verbindung testen — Klicken Sie auf die Test-Kнопpe
  4. Optionell: Modell pro Aufgabe – Aktivieren Sie useMultiModelSettings und konfigurieren Sie sie einzeln

Für Ollama: Es ist keine API-Einstellung erforderlich. Stellen Sie einfach sicher, dass ollama serve läuft.


Nächste Schritte

  • 📝 Konzeptnotizen — Verwendet ein Modell zur Extraktion pro Aufgabe
  • 🎨 Diagrams — Verwendet das Diagramm-Modell pro Aufgabe
  • 🔍 Forschung — Verwendet ein modell speziell für Forschungszwecke
  • ⚙️ Konfiguration — Vollständige Referenz der Einstellungen