Lompat ke konten utama

Penyedia LLM

💡TL;DR
Notemd memiliki 36 preset dalam lima keluarga: kompatibel OpenAI, Anthropic, Google, Azure OpenAI, dan Ollama. Cocokkan protokol endpoint, isi kredensial, lalu uji model yang dapat diakses pada catatan kecil. Nilai preset dapat diubah dan bukan janji ketersediaan model saat ini.

Kategori penyedia​

Nilai berikut berasal dari registry penyedia. Pertahankan skema URL dan jalur lengkap. Ganti placeholder dengan nilai deployment nyata. Akses hosted, harga, dan penghentian model ditentukan penyedia.

Penyedia cloud​

PenyediaModel presetURL dasar preset
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oAtur endpoint sumber daya Azure Anda
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateway / proxy​

PenyediaModel presetURL dasar preset
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Penyedia lokal​

PenyediaModel presetURL dasar preset
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Penyedia Tiongkok​

Lihat pengaturan regional untuk DeepSeek, Qwen, Doubao, Moonshot, GLM, dan preset terkait. Kategori menggambarkan konfigurasi, bukan jaminan akses geografis atau kualitas bahasa Mandarin. Cocokkan wilayah akun, endpoint, dan izin model.

Model per tugas​

Aktifkan useMultiModelSettings untuk penyedia/model terpisah. Jika nonaktif, tugas memakai activeProvider. Override model kosong memakai model penyedia terkait; pilihan penyedia tersimpan yang tidak sah diselaraskan dengan penyedia aktif saat pengaturan dimuat.

TugasPengaturan penyediaOverride model
Tambah tautanaddLinksProvideraddLinksModel
Generasi judulgenerateTitleProvidergenerateTitleModel
Ringkasan risetresearchProviderresearchModel
TerjemahantranslateProvidertranslateModel
Ekstraksi konsepextractConceptsProviderextractConceptsModel
Ringkasan MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Ekstraksi kutipan asliextractOriginalTextProviderextractOriginalTextModel

Penyedia aktif dan pilihan tugas bawaan adalah DeepSeek. Verifikasi setiap tugas sebelum materi privat; mengubah penyedia aktif tidak menimpa pilihan per tugas yang diaktifkan.

Arsitektur panggilan API​

Lapisan transport​

Plugin memakai fasilitas permintaan Obsidian dan fallback yang memahami protokol. Desktop dapat memakai stream HTTP Node, lingkungan lain dapat memakai fetch. Protokol penyedia berbeda dari transport runtime. Claude melalui gateway kompatibel OpenAI memakai preset gateway, bukan profil Anthropic native.

Retry​

Mode permintaan stabil nonaktif secara bawaan, dengan tiga retry dan interval lima detik saat berlaku. Gangguan transport sementara dapat masuk retry/fallback bersama. Autentikasi/model salah harus diperbaiki, bukan diulang terus. Permintaan panjang masih bisa gagal karena timeout remote, batas model, atau kuota.

Cache respons​

Respons sukses dapat dipakai ulang dari cache memori terbatas. Endpoint, model, pengaturan generasi, prompt, dan isi membentuk identitas permintaan. Cache bukan penyimpanan persisten, meter biaya, atau jaminan pengulangan bebas panggilan berbayar.

Model penalaran​

Kontrol reasoning/thinking muncul sesuai preset dan aturan model. Jangan memindahkan parameter khusus protokol antarpenyedia. Model yang dapat chat masih bisa menolak pengaturan penalaran, token, atau sampling tertentu.

Perkiraan token​

Perkiraan panjang teks dan batas keluaran bukan hitungan token persis penyedia. Periksa penggunaan aktual untuk tagihan. Tidak tersedia perkiraan biaya universal.

Penemuan model​

Fetch models mencari model jika didukung. Beberapa deployment memerlukan nama model/deployment manual. Izin daftar dan izin generasi berbeda.

Uji koneksi mengikuti mode preset. models-then-chat dapat sukses dari daftar saja; chat-only melakukan generasi kecil. Jalankan tugas nyata kecil untuk model dan bentuk keluaran yang diperlukan.

  • Anthropic/Google memiliki protokol daftar native.
  • Ollama mendaftar tag terunduh; LM Studio mendaftar model yang disediakan server.
  • Azure memerlukan deployment dan versi API; daftar umum bukan pengganti.
  • Gateway bisa membatasi discovery meskipun model tertentu menerima chat.

Mulai cepat​

  1. Pilih preset cocok di Settings → Notemd.
  2. Masukkan endpoint, kredensial, dan model/deployment tersedia.
  3. Jalankan Uji koneksi, lalu proses catatan uji.
  4. Tinjau hasil/progres sebelum batch atau perutean per tugas.

Untuk lokal, unduh/muat model dan mulai server dahulu. Ollama tidak memerlukan kunci; LM Studio menerima kunci opsional dengan preset EMPTY. Isi token nyata jika server mewajibkan. LLM lokal tidak membuat pencarian web atau tugas berjaringan menjadi offline.

Selanjutnya​