Skip to main content

Παρόχοι LLM

💡TL;DR

Notemd υποστηρίζει 36 παρόχους LLM σε 4 τύπους μεταφοράς. Όλες οι κλήσεις API χρησιμοποιούν ακατέργαστο HTTP (χωρίς SDKs) με αυτόματη επανεπιχείρηση, εναλλακτική μεταφορά και αποθήκευση απαντήσεων για 5 λεπτά. Η επιλογή μοντέλου ανά εργασία σας επιτρέπει να χρησιμοποιήσετε φθηνά μοντέλα για εξαγωγή έννοιων και ισχυρά μοντέλα για έρευνα. Δεν απαιτείται κλειδί API για τοπικούς παρόχους (Ollama, LMStudio).

Αυτό αποτελεί μέρος του Obsidian Οδηγού Διαχείρισης Γνώσης AI.

Κατηγορίες Παρόχων

Παρόχοι Cloud

ΠαρόχοςΒασικό URL προεπιλογήΠροεπιλεγμένο μοντέλοΘερμοκρασία
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Παρόχοι Γέιτγουέι / Proxy

ΠαρόχοςΒασικό URL προεπιλογήΠροεπιλεγμένο μοντέλοΣημειώσεις
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetΠροσθέτει τα επικεφάλαια HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniΠροσθέτει το επικεφάλαιο X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniΠροσθέτει το επικεφάλαιο APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelΕπιλεκτικό κλειδί API
Νέο APIlocalhost:3000/v1gpt-4.1Επιλεκτικό κλειδί API
OpenAI Compatible(user-configured)your-model-idΠροσαρμοσμένο σημείο άκρου

Κινεζικοί παρόχοι

ΠαρόχοςDefault Base URLΠροεπιλεγμένο μοντέλοΣημειώσεις
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusΜε επικέντρωση στον προγραμματισμό
Doubaoark.cn-beijing.volces.com/api/v3(απαιτείται ID σημείου πρόσβασης)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Σημείο άκρου Zhipu, Κίνα
Z AIapi.z.ai/api/paas/v4glm-5Σημείο άκρου Zhipu, διεθνές
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BΠλατφόρμα φιλοξενίας μοντέλων
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao απαιτεί ID σημείου άκρου Ark (μορφή: ep-xxxxxxxx-xxxx-xxxx). Ο προεπιλεγμένος χώρος αντικατάστασης πρέπει να αντικατασταθεί.

Τοπικοί πάροχοι

ΠαρόχοςDefault Base URLΠροεπιλεγμένο μοντέλοΣημειώσεις
Ollamalocalhost:11434/apillama3Δεν υπάρχει κλειδί API. Στριμινγκ NDJSON. Ανακάλυψη μοντέλων μέσω /api/tags
LMStudiolocalhost:1234/v1local-modelΑποστέλλει "EMPTY" ως τοκέν προσωπικοποίησης. Ανακάλυψη συμβατή με OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(χρησιμοποιητής-διαμόρφωτο)gpt-4oΌνομα ανάπτυξης στο URL. api-key επίκεφαλο

Επιλογή μοντέλου ανά εργασία

Το Notemd υποστηρίζει ανεξάρτητους πάροχους και μοντέλα για κάθε εργασία. Ενεργοποιήστε με useMultiModelSettings: true.

Διαθέσιμες εργασίες

ΕργασίαΚλειδί ρυθμίσεωνΠροεπιλεγμένος πάροχος
Προσθήκη συνδέσμων (εισαγωγή wiki-link)addLinksProvider / addLinksModelDeepSeek
Έρευνα (αναζήτηση στο Διαδίκτυο + σύνοψη)researchProvider / researchModelDeepSeek
Δημιουργία από τίτλοgenerateTitleProvider / generateTitleModelDeepSeek
ΜετάφρασηtranslateProvider / translateModelDeepSeek
Δημιουργία διαγράμματοςsummarizeToMermaidProvider / ModelDeepSeek
Ανάκτηση έννοιαςextractConceptsProvider / ModelDeepSeek
Ανάκτηση αυθεντικού κειμένουextractOriginalTextProvider / ModelDeepSeek

Τάξη επίλυσης

  1. Αν το useMultiModelSettings είναι ενεργό → χρησιμοποιήστε τον πάροχο και το μοντέλο που αφορούν τη συγκεκριμένη εργασία
  2. Αν η υπερκατάσταση μοντέλου της εργασίας είναι κενή → επιστρέψτε στο προεπιλεγμένο μοντέλο του πάροχου
  3. Αν ο πάροχος της εργασίας είναι μη έγκυρος → επιστρέψτε στο παγκόσμιο activeProvider
  4. Αν το useMultiModelSettings είναι απενεργοποιημένο → όλες οι εργασίες χρησιμοποιούν το παγκόσμιο activeProvider

Συνιστώμενες διαμόρφωσεις

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Αρχιτεκτονική κλήσης API

Στρώματα μεταφοράς

  1. Obsidian requestUrl — πρωταρχικό (ενσωματωμένο, λειτουργεί σε όλες τις πλατφόρμες)
  2. Desktop HTTP — μόντουλα Node.js http/https (στριμινγκ + μακρά αιτήματα)
  3. Web fetch — εναλλακτική λύση όταν τα μόντουλα Node.js δεν είναι διαθέσιμα

Το πρόσθετο μεταβάλλεται αυτόματα μεταξύ των στρωμάτων μεταφοράς σε προσωρινές σφάλματα δικτύου.

Λογική επαναπροσπάθειας

  • Φυσιολογικός λειτουργικός τρόπος (enableStableApiCall: false): Μία προσπάθεια. Σε προσωρινή αποτυχία, γίνεται αυτόματη εξέλιξη σε σταθερή επαναπροσπάθεια.
  • Λειτουργικός τρόπος σταθερής επαναπροσπάθειας (enableStableApiCall: true): Μέχρι 4 προσπάθειες (1 + 3 επαναπροσπάθειες) με διαστήματα 5 σεκόνδων.
  • Προσωρινά σφάλματα που πυροδοτούν επαναπροσπάθεια: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Μη επαναπροσπαθήσιμα: HTTP 400, 401, 403, 404

Κεμπάδωση απαντήσεων

5 λεπτά κεμπάδωση LRU σε μνήμη, βασισμένη σε πάροχο + μοντέλο + θερμοκρασία + πρόταση + περιεχόμενο. Συνεχής ίδιες αιτήσεις εντός 5 λεπτών επιστρέφουν αμέσως τα κεμπαδωμένα αποτελέσματα.

Μεταχείριση μοντέλων σκέψης

Τα μοντέλα που δεν υποστηρίζουν τον ρόλο system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) έχουν αυτόματα τις προτάσεις σύστηματος + χρήστη συνδυασμένες σε μία μόνο πρόταση χρήστη.

DeepSeek-specific: thinkingEnabled προσθέτει { thinking: { type: 'enabled' } } στην αίτηση. reasoningEffort (low/medium/high) μεταδίδεται ως reasoning_effort. Επαληθεύει ότι τα μέγιστα τόκεν εξόδου ≥ 8000 όταν η λειτουργία thinking είναι ενεργή.

Token Estimation

estimateTokens(text): Math.ceil(text.length / 4) — αλγόριθμος heuristic 4 χαρακτήρες ανά τόκεν. Χρησιμοποιείται για να επιβληθεί maxResearchContentTokens πριν από την αποστολή στο LLM.

Δεν υπάρχει υλοποίηση παρακολούθησης κόστους.

Ανακάλυψη μοντέλων

ΜοδόςProvidersEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleΚατάλογος μοντέλων API
anthropic-modelsAnthropicΚατάλογος μονδέλων API
openai-compatible-modelsDeepSeek, Qwen, Mistral, κ.λπ./v1/models
openrouter-modelsOpenRouterΚατάλογος μοντέλων API
github-modelsGitHub ModelsInference API
noneAzure OpenAIΑπενεργοποιημένο (απαιτεί όνομα ανάπτυξης)

Quick Start

  1. Επιλέξτε έναν πάροχο — DeepSeek (Κίνα), OpenAI (Διεθνής), ή Ollama (Τοπικό/Μη χρεώσιμο)
  2. Εισάγετε τον κλειδί API — Settings → Notemd → Provider → API Key
  3. Δοκιμάστε σύνδεση — Κάντε κλικ στο κουμπί δοκιμής
  4. Προαιρετικά: Μοντέλα ανά εργασία — Ενεργοποιήστε useMultiModelSettings και ρυθμίστε τα ξεχωριστά

Για Ollama: δεν χρειάζεται το κλειδί API. Απλώς βεβαιωθείτε ότι το ollama serve λειτουργεί.


Επόμενα βήματα