Διαχωρισμός προς το κύριο περιεχόμενο

Πάροχοι LLM

💡TL;DR
Υπάρχουν 36 προφίλ σε πέντε οικογένειες: OpenAI-compatible, Anthropic, Google, Azure OpenAI και Ollama. Επιλέξτε το πρωτόκολλο του endpoint, επιτρεπόμενα δεδομένα και διαθέσιμο μοντέλο. Οι αρχικές τιμές είναι παραδείγματα που αλλάζουν, όχι εγγύηση σημερινής διαθεσιμότητας.

Κατηγορίες​

Οι πίνακες προέρχονται από το μητρώο. Διατηρήστε σχήμα URL και πλήρη διαδρομή· αντικαταστήστε παραδείγματα με την πραγματική σας εγκατάσταση. Δικαιώματα, τιμές και απόσυρση μοντέλων ορίζονται από τον πάροχο.

Cloud​

ΠάροχοςΑρχικό μοντέλοΒασική διεύθυνση
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oΟρίστε το endpoint του πόρου Azure
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Πύλες και proxy​

ΠάροχοςΑρχικό μοντέλοΒασική διεύθυνση
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Τοπικά​

ΠάροχοςΑρχικό μοντέλοΒασική διεύθυνση
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Κινεζικοί πάροχοι​

Δείτε περιφερειακή διαμόρφωση. Η κατηγορία δεν εγγυάται γεωγραφική διαθεσιμότητα ή ποιότητα κινεζικών. Συνδυάστε σωστά περιοχή λογαριασμού, endpoint και πρόσβαση μοντέλου.

Επιλογή ανά εργασία​

Το useMultiModelSettings ενεργοποιεί ξεχωριστούς παρόχους/μοντέλα· αλλιώς ισχύει activeProvider. Κενό μοντέλο χρησιμοποιεί του παρόχου. Μη έγκυρες αποθηκευμένες επιλογές παρόχων προσαρμόζονται στον ενεργό κατά τη φόρτωση.

ΕργασίαΡύθμιση παρόχουΠεδίο μοντέλου
ΣύνδεσμοιaddLinksProvideraddLinksModel
Παραγωγή τίτλωνgenerateTitleProvidergenerateTitleModel
Σύνοψη έρευναςresearchProviderresearchModel
ΜετάφρασηtranslateProvidertranslateModel
ΈννοιεςextractConceptsProviderextractConceptsModel
Σύνοψη MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Πρωτότυπο κείμενοextractOriginalTextProviderextractOriginalTextModel

Ο ενεργός και οι αποθηκευμένοι πάροχοι εργασιών αρχίζουν ως DeepSeek. Αλλαγή μόνο του ενεργού δεν αντικαθιστά τις ενεργοποιημένες διαδρομές εργασιών. Ελέγξτε πριν από ιδιωτικό υλικό.

Αρχιτεκτονική αιτημάτων​

Επίπεδα μεταφοράς​

Το Notemd χρησιμοποιεί αιτήματα Obsidian και fallback που γνωρίζει το πρωτόκολλο. Στον υπολογιστή μπορεί να χρησιμοποιήσει ροές Node HTTP, αλλού fetch. Claude μέσω πύλης OpenAI-compatible χρησιμοποιεί το προφίλ πύλης, όχι το εγγενές API Anthropic.

Επαναλήψεις​

Η σταθερή λειτουργία είναι ανενεργή· σχετικές αρχικές τιμές είναι τρεις επαναλήψεις ανά πέντε δευτερόλεπτα. Προσωρινά λάθη μπορούν να περάσουν από κοινό fallback/επανάληψη. Διορθώστε ξεχωριστά πρόσβαση και ρύθμιση μοντέλου. Μεγάλα αιτήματα μπορούν ακόμη να λήξουν ή να υπερβούν όρια χρήσης.

Προσωρινή μνήμη απαντήσεων​

Περιορισμένη cache μνήμης μπορεί να επαναχρησιμοποιήσει επιτυχείς απαντήσεις. Endpoint, μοντέλο, παράμετροι παραγωγής, οδηγία και περιεχόμενο καθορίζουν την ταυτότητα. Δεν είναι μόνιμη αποθήκευση ή μετρητής κόστους και δεν εγγυάται δωρεάν επανάληψη.

Μοντέλα συλλογισμού​

Reasoning/thinking ακολουθούν κανόνες προφίλ και μοντέλου. Μη μεταφέρετε ειδικές παραμέτρους πρωτοκόλλου μεταξύ υπηρεσιών. Δοκιμάστε πραγματική εργασία· μοντέλα μπορεί να απορρίπτουν ρυθμίσεις tokens, δειγματοληψίας ή συλλογισμού.

Εκτίμηση tokens​

Μήκος κειμένου και όρια εξόδου δεν είναι ακριβής μέτρηση tokens παρόχου. Υπολογίστε χρέωση με πραγματική κατανάλωση. Δεν υπάρχει γενική εγγύηση εκτίμησης κόστους.

Εύρεση μοντέλων​

Το Fetch models λειτουργεί όπου υποστηρίζεται. Ορισμένα deployments θέλουν χειροκίνητο ID. Δικαιώματα λίστας και παραγωγής είναι ανεξάρτητα. Το Test connection μπορεί να περάσει μόνο από λίστα στο models-then-chat, ενώ chat-only παράγει σύντομα. Ελέγξτε την πραγματική εργασία και μορφή εξόδου.

  • Anthropic και Google χρησιμοποιούν το δικό τους API εύρεσης.
  • Ollama δείχνει ληφθέντα tags, LM Studio μοντέλα διακομιστή.
  • Azure απαιτεί deployment και έκδοση API.
  • Πύλες μπορούν να περιορίζουν λίστες αλλά να επιτρέπουν κλήση με ρητό ID.

Έναρξη​

  1. Επιλέξτε σωστό προφίλ στο Settings → Notemd.
  2. Δώστε endpoint, κλειδί και διαθέσιμο μοντέλο/deployment.
  3. Δοκιμάστε σύνδεση και προσωρινή σημείωση.
  4. Ελέγξτε αποτέλεσμα/αναφορά πριν από παρτίδες ή δρομολόγηση εργασιών.

Τοπικά πρέπει να είναι έτοιμος ο διακομιστής και το μοντέλο. Το Ollama δεν απαιτεί κλειδί· το LM Studio το δέχεται προαιρετικά, αρχικά EMPTY. Χρησιμοποιήστε πραγματικό token όπου απαιτείται. Τοπικό LLM δεν κάνει την αναζήτηση ιστού offline.

Συνέχεια​