Skip to main content

Penyedia LLM

💡TL;DR

Notemd menyokong 36 penyedia LLM merentasi 4 jenis pengangkutan. Semua panggilan API menggunakan HTTP mentah (tanpa SDK) dengan percubaan semula automatik, alternatif pengangkutan, dan pengecapan respons selama 5 minit. Pemilihan model mengikut tugas membolehkan anda menggunakan model murah untuk pengekstrakan konsep dan model berkuasa untuk penyelidikan. Tiada kunci API diperlukan untuk penyedia tempatan (Ollama, LMStudio).

Ini merupakan sebahagian daripada Obsidian Panduan Pengurusan Pengetahuan AI.

Kategori Penyedia

Penyedia Awan

PenyediaAsas URL lalaiModel LalaiSuhu
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Penyedia Pintu Gerbang / Proksi

PenyediaAsas URL lalaiModel LalaiNota
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetMenambah header HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniMenambah header X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniMenambah header APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelKunci API pilihan
API barulocalhost:3000/v1gpt-4.1Kunci API pilihan
OpenAI Compatible(disusun oleh pengguna)your-model-idTitik hujung khusus

Penyedia di China

PenyediaAsas lalai URLModel LalaiNota
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusFokus pada pengaturcaraan
Doubaoark.cn-beijing.volces.com/api/v3(ID titik hujung diperlukan)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Titik hujung Zhipu, China
Z AIapi.z.ai/api/paas/v4glm-5Titik hujung antarabangsa Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatform hos model
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao memerlukan ID titik hujung Ark (format: ep-xxxxxxxx-xxxx-xxxx). Tempat letak lalai mesti digantikan.

Penyedia tempatan

PenyediaAsas lalai URLModel LalaiNota
Ollamalocalhost:11434/apillama3Tiada kunci API. Penstriman NDJSON. Penemuan model melalui /api/tags
LMStudiolocalhost:1234/v1local-modelMenghantar "EMPTY" sebagai token pembawa. Penemuan yang serasi dengan OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(dikonfigurasikan oleh pengguna)gpt-4oNama penempatan dalam URL. Tajuk api-key

Pemilihan Model Mengikut Tugas

Notemd menyokong penyedia dan model yang berasingan untuk setiap tugas. Aktifkan dengan useMultiModelSettings: true.

Tugas yang tersedia

TugasKunci tetapanPenyedia lalai
Tambah pautan (penyisipan pautan wiki)addLinksProvider / addLinksModelDeepSeek
Penyelidikan (carian web + ringkasan)researchProvider / researchModelDeepSeek
Jana daripada tajukgenerateTitleProvider / generateTitleModelDeepSeek
TerjemahantranslateProvider / translateModelDeepSeek
Penghasilan diagramsummarizeToMermaidProvider / ModelDeepSeek
Pengeluaran konsepextractConceptsProvider / ModelDeepSeek
Pengeluaran teks asalextractOriginalTextProvider / ModelDeepSeek

Urutan penyelesaian

  1. Jika useMultiModelSettings diaktifkan → gunakan penyedia dan model khusus tugas
  2. Jika penggantian model tugas kosong → gunakan model lalai penyedia
  3. Jika penyedia tugas tidak sah → gunakan activeProvider global
  4. Jika useMultiModelSettings dimatikan → semua tugas menggunakan activeProvider global

Konfigurasi yang disyorkan

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Arsitektur Panggilan API

Lapisan Pengangkutan

  1. Obsidian requestUrl — utama (terbina dalam, berfungsi pada semua platform)
  2. Desktop HTTP — modul Node.js http/https (penstriman + permintaan panjang)
  3. Web fetch — alternatif apabila modul Node.js tidak tersedia

Plug-in ini secara automatik beralih antara lapisan pengangkutan sekiranya berlaku ralat rangkaian sementara.

Logik Ulang Cuba

  • Mod biasa (enableStableApiCall: false): Satu percubaan. Jika gagal sementara, ia akan dinaik taraf secara automatik ke ulangan yang stabil.
  • Mod ulangan stabil (enableStableApiCall: true): Sehingga 4 percubaan (1 + 3 ulangan) dengan selang masa 5 saat.
  • Ralat sementara yang mencetuskan ulangan: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Yang tidak boleh diulang cuba: HTTP 400, 401, 403, 404

Penyimpanan Cache Respons

Cache LRU dalam memori selama 5 minit yang dikunci mengikut penyedia + model + suhu + gesaan + kandungan. Permintaan yang serupa selepas 5 minit akan mendapat hasil cache dengan segera.

Pengendalian Model Penalaran

Model yang tidak menyokong peranan system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) secara automatik menggabungkan gesaan sistem dan pengguna menjadi satu mesej pengguna sahaja.

DeepSeek-specific: thinkingEnabled menambah { thinking: { type: 'enabled' } } ke dalam permintaan. reasoningEffort (rendah/medium/tinggi) dihantar sebagai reasoning_effort. Memastikan bahawa maksimum token keluaran ≥ 8000 apabila mod pemikiran diaktifkan.

Anggaran Token

estimateTokens(text): Math.ceil(text.length / 4) — heuristik 4 aksara setiap token. Digunakan untuk mematuhi maxResearchContentTokens sebelum dihantar ke LLM.

Tiada penjejak kos yang dilaksanakan.

Penemuan Model

ModPenyediaTitik Akhir
ollama-tagsOllama/api/tags
google-modelsGoogleSenarai Model API
anthropic-modelsAnthropicSenarai Model API
openai-compatible-modelsDeepSeek, Qwen, Mistral, dan sebagainya./v1/models
openrouter-modelsOpenRouterSenarai Model API
github-modelsGitHub ModelsInferensi API
noneAzure OpenAIDihentikan (memerlukan nama penempatan)

Permulaan Cepat

  1. Pilih penyedia — DeepSeek (China), OpenAI (Antarabangsa), atau Ollama (Tempatan/Bebas)
  2. Masukkan kunci API — Tetapan → Notemd → Penyedia → Kunci API
  3. Uji sambungan — Klik butang ujian
  4. Pilihan: Model mengikut tugas — Aktifkan useMultiModelSettings dan tetapkan secara berasingan

Untuk Ollama: tiada kunci API diperlukan. Pastikan ollama serve sedang berjalan.


Langkah Seterusnya

  • 📝 Nota Konsep — Menggunakan model pengekstrakan mengikut tugas
  • 🎨 Diagram — Menggunakan model diagram mengikut tugas
  • 🔍 Penyelidikan — Menggunakan model khusus penyelidikan
  • ⚙️ Konfigurasi — Rujukan tetapan penuh