Παρόχοι LLM
Notemd υποστηρίζει 36 παρόχους LLM σε 4 τύπους μεταφοράς. Όλες οι κλήσεις API χρησιμοποιούν ακατέργαστο HTTP (χωρίς SDKs) με αυτόματη επανεπιχείρηση, εναλλακτική μεταφορά και αποθήκευση απαντήσεων για 5 λεπτά. Η επιλογή μοντέλου ανά εργασία σας επιτρέπει να χρησιμοποιήσετε φθηνά μοντέλα για εξαγωγή έννοιων και ισχυρά μοντέλα για έρευνα. Δεν απαιτείται κλειδί API για τοπικούς παρόχους (Ollama, LMStudio).
Αυτό αποτελεί μέρος του Obsidian Οδηγού Διαχείρισης Γνώσης AI.
Κατηγορίες Παρόχων
Παρόχοι Cloud
| Παρόχος | Βασικό URL προεπιλογή | Προεπιλεγμένο μοντέλο | Θερμοκρασία |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Παρόχοι Γέιτγουέι / Proxy
| Παρόχος | Βασικό URL προεπιλογή | Προεπιλεγμένο μοντέλο | Σημειώσεις |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Προσθέτει τα επικεφάλαια HTTP-Referer + X-Title |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Προσθέτει το επικεφάλαιο X-GitHub-Api-Version |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Προσθέτει το επικεφάλαιο APP-Code |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Επιλεκτικό κλειδί API |
| Νέο API | localhost:3000/v1 | gpt-4.1 | Επιλεκτικό κλειδί API |
| OpenAI Compatible | (user-configured) | your-model-id | Προσαρμοσμένο σημείο άκρου |
Κινεζικοί παρόχοι
| Παρόχος | Default Base URL | Προεπιλεγμένο μοντέλο | Σημειώσεις |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Με επικέντρωση στον προγραμματισμό |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (απαιτείται ID σημείου πρόσβασης) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Σημείο άκρου Zhipu, Κίνα |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Σημείο άκρου Zhipu, διεθνές |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Πλατφόρμα φιλοξενίας μοντέλων |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao απαιτεί ID σημείου άκρου Ark (μορφή: ep-xxxxxxxx-xxxx-xxxx). Ο προεπιλεγμένος χώρος αντικατάστασης πρέπει να αντικατασταθεί.
Τοπικοί πάροχοι
| Παρόχος | Default Base URL | Προεπιλεγμένο μοντέλο | Σημειώσεις |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Δεν υπάρχει κλειδί API. Στριμινγκ NDJSON. Ανακάλυψη μοντέλων μέσω /api/tags |
| LMStudio | localhost:1234/v1 | local-model | Αποστέλλει "EMPTY" ως τοκέν προσωπικοποίησης. Ανακάλυψη συμβατή με OpenAI |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (χρησιμοποιητής-διαμόρφωτο) | gpt-4o | Όνομα ανάπτυξης στο URL. api-key επίκεφαλο |
Επιλογή μοντέλου ανά εργασία
Το Notemd υποστηρίζει ανεξάρτητους πάροχους και μοντέλα για κάθε εργασία. Ενεργοποιήστε με useMultiModelSettings: true.
Διαθέσιμες εργασίες
| Εργασία | Κλειδί ρυθμίσεων | Προεπιλεγμένος πάροχος |
|---|---|---|
| Προσθήκη συνδέσμων (εισαγωγή wiki-link) | addLinksProvider / addLinksModel | DeepSeek |
| Έρευνα (αναζήτηση στο Διαδίκτυο + σύνοψη) | researchProvider / researchModel | DeepSeek |
| Δημιουργία από τίτλο | generateTitleProvider / generateTitleModel | DeepSeek |
| Μετάφραση | translateProvider / translateModel | DeepSeek |
| Δημιουργία διαγράμματος | summarizeToMermaidProvider / Model | DeepSeek |
| Ανάκτηση έννοιας | extractConceptsProvider / Model | DeepSeek |
| Ανάκτηση αυθεντικού κειμένου | extractOriginalTextProvider / Model | DeepSeek |
Τάξη επίλυσης
- Αν το
useMultiModelSettingsείναι ενεργό → χρησιμοποιήστε τον πάροχο και το μοντέλο που αφορούν τη συγκεκριμένη εργασία - Αν η υπερκατάσταση μοντέλου της εργασίας είναι κενή → επιστρέψτε στο προεπιλεγμένο μοντέλο του πάροχου
- Αν ο πάροχος της εργασίας είναι μη έγκυρος → επιστρέψτε στο παγκόσμιο
activeProvider - Αν το
useMultiModelSettingsείναι απενεργοποιημένο → όλες οι εργασίες χρησιμοποιούν το παγκόσμιοactiveProvider
Συνιστώμενες διαμόρφωσεις
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
Αρχιτεκτονική κλήσης API
Στρώματα μεταφοράς
- Obsidian
requestUrl— πρωταρχικό (ενσωματωμένο, λειτουργεί σε όλες τις πλατφόρμες) - Desktop HTTP — μόντουλα Node.js
http/https(στριμινγκ + μακρά αιτήματα) - Web
fetch— εναλλακτική λύση όταν τα μόντουλα Node.js δεν είναι διαθέσιμα
Το πρόσθετο μεταβάλλεται αυτόματα μεταξύ των στρωμάτων μεταφοράς σε προσωρινές σφάλματα δικτύου.
Λογική επαναπροσπάθειας
- Φυσιολογικός λειτουργικός τρόπος (
enableStableApiCall: false): Μία προσπάθεια. Σε προσωρινή αποτυχία, γίνεται αυτόματη εξέλιξη σε σταθερή επαναπροσπάθεια. - Λειτουργικός τρόπος σταθερής επαναπροσπάθειας (
enableStableApiCall: true): Μέχρι 4 προσπάθειες (1 + 3 επαναπροσπάθειες) με διαστήματα 5 σεκόνδων. - Προσωρινά σφάλματα που πυροδοτούν επαναπροσπάθεια:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Μη επαναπροσπαθήσιμα: HTTP 400, 401, 403, 404
Κεμπάδωση απαντήσεων
5 λεπτά κεμπάδωση LRU σε μνήμη, βασισμένη σε πάροχο + μοντέλο + θερμοκρασία + πρόταση + περιεχόμενο. Συνεχής ίδιες αιτήσεις εντός 5 λεπτών επιστρέφουν αμέσως τα κεμπαδωμένα αποτελέσματα.
Μεταχείριση μοντέλων σκέψης
Τα μοντέλα που δεν υποστηρίζουν τον ρόλο system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) έχουν αυτόματα τις προτάσεις σύστηματος + χρήστη συνδυασμένες σε μία μόνο πρόταση χρήστη.
DeepSeek-specific: thinkingEnabled προσθέτει { thinking: { type: 'enabled' } } στην αίτηση. reasoningEffort (low/medium/high) μεταδίδεται ως reasoning_effort. Επαληθεύει ότι τα μέγιστα τόκεν εξόδου ≥ 8000 όταν η λειτουργία thinking είναι ενεργή.
Token Estimation
estimateTokens(text): Math.ceil(text.length / 4) — αλγόριθμος heuristic 4 χαρακτήρες ανά τόκεν. Χρησιμοποιείται για να επιβληθεί maxResearchContentTokens πριν από την αποστολή στο LLM.
Δεν υπάρχει υλοποίηση παρακολούθησης κόστους.
Ανακάλυψη μοντέλων
| Μοδός | Providers | Endpoint |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Κατάλογος μοντέλων API | |
anthropic-models | Anthropic | Κατάλογος μονδέλων API |
openai-compatible-models | DeepSeek, Qwen, Mistral, κ.λπ. | /v1/models |
openrouter-models | OpenRouter | Κατάλογος μοντέλων API |
github-models | GitHub Models | Inference API |
none | Azure OpenAI | Απενεργοποιημένο (απαιτεί όνομα ανάπτυξης) |
Quick Start
- Επιλέξτε έναν πάροχο — DeepSeek (Κίνα), OpenAI (Διεθνής), ή Ollama (Τοπικό/Μη χρεώσιμο)
- Εισάγετε τον κλειδί API — Settings → Notemd → Provider → API Key
- Δοκιμάστε σύνδεση — Κάντε κλικ στο κουμπί δοκιμής
- Προαιρετικά: Μοντέλα ανά εργασία — Ενεργοποιήστε
useMultiModelSettingsκαι ρυθμίστε τα ξεχωριστά
Για Ollama: δεν χρειάζεται το κλειδί API. Απλώς βεβαιωθείτε ότι το ollama serve λειτουργεί.
Επόμενα βήματα
- 📝 Σημειώσεις Συνέπειας — Χρησιμοποιεί μοντέλο εξαγωγής ανά εργασία
- 🎨 Διαγράμματα — Χρησιμοποιεί μοντέλο διαγράμματος ανά εργασία
- 🔍 Έρευνα — Χρησιμοποιεί μοντέλο ειδικό για έρευνα
- ⚙️ Ρύθμιση — Πλήρης αναφορά ρυθμίσεων