Skip to main content

Penyedia LLM

💡TL;DR

Notemd mendukung 36 penyedia LLM di 4 jenis transportasi. Semua panggilan API menggunakan HTTP mentah (tanpa SDK) dengan retry otomatis, fallback transportasi, dan caching respons selama 5 menit. Pemilihan model per tugas memungkinkan Anda menggunakan model murah untuk ekstraksi konsep dan model kuat untuk penelitian. Tidak diperlukan kunci API untuk penyedia lokal (Ollama, LMStudio).

Ini merupakan bagian dari Obsidian Panduan Manajemen Pengetahuan AI.

Kategori Penyedia

Penyedia Cloud

PenyediaDasar URL defaultModel DefaultTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Penyedia Gateway / Proxy

PenyediaDasar URL defaultModel DefaultCatatan
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetMenambahkan header HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniMenambahkan header X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniMenambahkan header APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelKunci API opsional
API barulocalhost:3000/v1gpt-4.1Kunci API opsional
OpenAI Compatible(diatur oleh pengguna)your-model-idTitik akhir khusus

Penyedia di Cina

PenyediaDasar default URLModel DefaultCatatan
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusBerfokus pada pemrograman
Doubaoark.cn-beijing.volces.com/api/v3(ID endpoint diperlukan)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Titik akhir Zhipu, Tiongkok
Z AIapi.z.ai/api/paas/v4glm-5Titik akhir internasional Zhipu
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BPlatform penampungan model
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao memerlukan ID titik akhir Ark (format: ep-xxxxxxxx-xxxx-xxxx). Placeholder default harus diganti.

Penyedia lokal

PenyediaDasar default URLModel DefaultCatatan
Ollamalocalhost:11434/apillama3Tidak ada kunci API. Streaming NDJSON. Penemuan model melalui /api/tags
LMStudiolocalhost:1234/v1local-modelMengirim "EMPTY" sebagai token bearer. Penemuan yang kompatibel dengan OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(diatur oleh pengguna)gpt-4oNama penyebaran di URL. Header api-key

Pemilihan Model Per Tugas

Notemd mendukung penyedia dan model yang terpisah untuk setiap tugas. Aktifkan dengan useMultiModelSettings: true.

Tugas yang Tersedia

TugasKunci PengaturanPenyedia Default
Menambahkan Tautan (penyisipan tautan wiki)addLinksProvider / addLinksModelDeepSeek
Penelitian (pencarian web + ringkasan)researchProvider / researchModelDeepSeek
Menghasilkan dari JudulgenerateTitleProvider / generateTitleModelDeepSeek
TerjemahantranslateProvider / translateModelDeepSeek
Pembuatan DiagramsummarizeToMermaidProvider / ModelDeepSeek
Ekstraksi KonsepextractConceptsProvider / ModelDeepSeek
Ekstraksi Teks AsliextractOriginalTextProvider / ModelDeepSeek

Urutan Resolusi

  1. Jika useMultiModelSettings aktif → gunakan penyedia + model khusus tugas
  2. Jika pengganti model tugas kosong → gunakan model default penyedia
  3. Jika penyedia tugas tidak valid → gunakan activeProvider global
  4. Jika useMultiModelSettings dimatikan → semua tugas menggunakan activeProvider global

Konfigurasi yang direkomendasikan

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Arsitektur Panggilan API

Lapisan Transportasi

  1. Obsidian requestUrl — utama (bawaan, berfungsi di semua platform)
  2. Desktop HTTP — modul Node.js http/https (streaming + permintaan panjang)
  3. Web fetch — alternatif bila modul Node.js tidak tersedia

Plugin ini secara otomatis beralih antar lapisan transportasi saat terjadi kesalahan jaringan sementara.

Logika Ulang

  • Mode normal (enableStableApiCall: false): Satu percobaan. Jika gagal sementara, otomatis naik tingkat ke ulangan yang stabil.
  • Mode ulangan stabil (enableStableApiCall: true): Hingga 4 percobaan (1 + 3 ulangan) dengan interval 5 detik.
  • Kesalahan sementara yang memicu ulangan: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Yang tidak dapat diulang: HTTP 400, 401, 403, 404

Pengarsipan Respons

Cache LRU dalam memori selama 5 menit yang diberi kunci berdasarkan penyedia + model + suhu + prompt + konten. Permintaan serupa setelahnya dalam 5 menit akan langsung mengembalikan hasil yang sudah dikasihkan.

Penanganan Model Penalaran

Model yang tidak mendukung peran system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) secara otomatis menggabungkan prompt sistem dan pengguna menjadi satu pesan pengguna tunggal.

DeepSeek-specific: thinkingEnabled menambahkan { thinking: { type: 'enabled' } } ke dalam permintaan. reasoningEffort (rendah/tengah/tinggi) dikirim sebagai reasoning_effort. Memverifikasi bahwa batas maksimum token keluaran ≥ 8000 saat mode berpikir diaktifkan.

Perkiraan Token

estimateTokens(text): Math.ceil(text.length / 4) — heuristik 4 karakter per token. Digunakan untuk menerapkan maxResearchContentTokens sebelum dikirim ke LLM.

Tidak ada pelacakan biaya yang diimplementasikan.

Penemuan Model

ModePenyediaTitik Akhir
ollama-tagsOllama/api/tags
google-modelsGoogleDaftar Model API
anthropic-modelsAnthropicDaftar Model API
openai-compatible-modelsDeepSeek, Qwen, Mistral, dll./v1/models
openrouter-modelsOpenRouterDaftar Model API
github-modelsGitHub ModelsInferensi API
noneAzure OpenAIDisonaktifkan (memerlukan nama penyebaran)

Mulai Cepat

  1. Pilih penyedia — DeepSeek (Tiongkok), OpenAI (Internasional), atau Ollama (Lokal/Bebas)
  2. Masukkan kunci API — Pengaturan → Notemd → Penyedia → Kunci API
  3. Uji koneksi — Klik tombol uji
  4. Opsi: Model per tugas — Aktifkan useMultiModelSettings dan atur secara terpisah

Untuk Ollama: tidak diperlukan kunci API. Pastikan saja ollama serve sedang berjalan.


Langkah Selanjutnya

  • 📝 Catatan Konsep — Menggunakan model ekstraksi per tugas
  • 🎨 Diagram — Menggunakan model diagram per tugas
  • 🔍 Penelitian — Menggunakan model khusus penelitian
  • ⚙️ Konfigurasi — Referensi pengaturan lengkap