Penyedia LLM
Kategori penyedia
Nilai berikut berasal dari registry penyedia. Pertahankan skema URL dan jalur lengkap. Ganti placeholder dengan nilai deployment nyata. Akses hosted, harga, dan penghentian model ditentukan penyedia.
Penyedia cloud
| Penyedia | Model preset | URL dasar preset |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Atur endpoint sumber daya Azure Anda |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateway / proxy
| Penyedia | Model preset | URL dasar preset |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Penyedia lokal
| Penyedia | Model preset | URL dasar preset |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Penyedia Tiongkok
Lihat pengaturan regional untuk DeepSeek, Qwen, Doubao, Moonshot, GLM, dan preset terkait. Kategori menggambarkan konfigurasi, bukan jaminan akses geografis atau kualitas bahasa Mandarin. Cocokkan wilayah akun, endpoint, dan izin model.
Model per tugas
Aktifkan useMultiModelSettings untuk penyedia/model terpisah. Jika nonaktif, tugas memakai activeProvider. Override model kosong memakai model penyedia terkait; pilihan penyedia tersimpan yang tidak sah diselaraskan dengan penyedia aktif saat pengaturan dimuat.
| Tugas | Pengaturan penyedia | Override model |
|---|---|---|
| Tambah tautan | addLinksProvider | addLinksModel |
| Generasi judul | generateTitleProvider | generateTitleModel |
| Ringkasan riset | researchProvider | researchModel |
| Terjemahan | translateProvider | translateModel |
| Ekstraksi konsep | extractConceptsProvider | extractConceptsModel |
| Ringkasan Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Ekstraksi kutipan asli | extractOriginalTextProvider | extractOriginalTextModel |
Penyedia aktif dan pilihan tugas bawaan adalah DeepSeek. Verifikasi setiap tugas sebelum materi privat; mengubah penyedia aktif tidak menimpa pilihan per tugas yang diaktifkan.
Arsitektur panggilan API
Lapisan transport
Plugin memakai fasilitas permintaan Obsidian dan fallback yang memahami protokol. Desktop dapat memakai stream HTTP Node, lingkungan lain dapat memakai fetch. Protokol penyedia berbeda dari transport runtime. Claude melalui gateway kompatibel OpenAI memakai preset gateway, bukan profil Anthropic native.
Retry
Mode permintaan stabil nonaktif secara bawaan, dengan tiga retry dan interval lima detik saat berlaku. Gangguan transport sementara dapat masuk retry/fallback bersama. Autentikasi/model salah harus diperbaiki, bukan diulang terus. Permintaan panjang masih bisa gagal karena timeout remote, batas model, atau kuota.
Cache respons
Respons sukses dapat dipakai ulang dari cache memori terbatas. Endpoint, model, pengaturan generasi, prompt, dan isi membentuk identitas permintaan. Cache bukan penyimpanan persisten, meter biaya, atau jaminan pengulangan bebas panggilan berbayar.
Model penalaran
Kontrol reasoning/thinking muncul sesuai preset dan aturan model. Jangan memindahkan parameter khusus protokol antarpenyedia. Model yang dapat chat masih bisa menolak pengaturan penalaran, token, atau sampling tertentu.
Perkiraan token
Perkiraan panjang teks dan batas keluaran bukan hitungan token persis penyedia. Periksa penggunaan aktual untuk tagihan. Tidak tersedia perkiraan biaya universal.
Penemuan model
Fetch models mencari model jika didukung. Beberapa deployment memerlukan nama model/deployment manual. Izin daftar dan izin generasi berbeda.
Uji koneksi mengikuti mode preset. models-then-chat dapat sukses dari daftar saja; chat-only melakukan generasi kecil. Jalankan tugas nyata kecil untuk model dan bentuk keluaran yang diperlukan.
- Anthropic/Google memiliki protokol daftar native.
- Ollama mendaftar tag terunduh; LM Studio mendaftar model yang disediakan server.
- Azure memerlukan deployment dan versi API; daftar umum bukan pengganti.
- Gateway bisa membatasi discovery meskipun model tertentu menerima chat.
Mulai cepat
- Pilih preset cocok di Settings → Notemd.
- Masukkan endpoint, kredensial, dan model/deployment tersedia.
- Jalankan Uji koneksi, lalu proses catatan uji.
- Tinjau hasil/progres sebelum batch atau perutean per tugas.
Untuk lokal, unduh/muat model dan mulai server dahulu. Ollama tidak memerlukan kunci; LM Studio menerima kunci opsional dengan preset EMPTY. Isi token nyata jika server mewajibkan. LLM lokal tidak membuat pencarian web atau tugas berjaringan menjadi offline.
Selanjutnya
- OpenAI, Anthropic, Google, Tiongkok, lokal: pengaturan protokol.
- Konfigurasi: tugas dan tujuan.
- Pemecahan masalah: batas diagnostik dan laporan aman.