Penyedia LLM
Kategori penyedia
Nilai berikut datang daripada daftar penyedia. Kekalkan skema URL dan laluan penuh. Gantikan model atau titik akhir pemegang tempat dengan nilai deployment sebenar. Akses, harga dan jadual persaraan penyedia dihoskan ditentukan penyedia.
Penyedia awan
| Penyedia | Model pratetap | URL asas pratetap |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Tetapkan titik akhir sumber Azure anda |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Penyedia gerbang / proksi
| Penyedia | Model pratetap | URL asas pratetap |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Penyedia setempat
| Penyedia | Model pratetap | URL asas pratetap |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Penyedia China
Lihat persediaan penyedia serantau untuk DeepSeek, Qwen, Doubao, Moonshot, GLM dan pratetap berkaitan. Kategori menerangkan konfigurasi, bukan jaminan akses geografi atau mutu bahasa Cina. Padankan rantau akaun, titik akhir dan hak akses model.
Pemilihan model khusus tugas
Aktifkan useMultiModelSettings untuk memilih penyedia dan model gantian berasingan. Tanpanya, tugas menggunakan activeProvider. Medan model tugas kosong menggunakan model yang ditetapkan penyedia itu; pilihan penyedia tersimpan yang tidak sah diselaraskan dengan penyedia aktif ketika tetapan dimuatkan.
| Tugas | Tetapan penyedia | Model gantian |
|---|---|---|
| Tambah pautan | addLinksProvider | addLinksModel |
| Penjanaan tajuk | generateTitleProvider | generateTitleModel |
| Ringkasan penyelidikan | researchProvider | researchModel |
| Terjemahan | translateProvider | translateModel |
| Ekstraksi konsep | extractConceptsProvider | extractConceptsModel |
| Ringkasan Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Ekstraksi teks asal | extractOriginalTextProvider | extractOriginalTextModel |
Penyedia aktif dan penyedia tugas tersimpan lalai ialah DeepSeek. Semak setiap tugas sebelum memproses bahan peribadi; menukar penyedia aktif sahaja tidak mengganti pilihan khusus tugas yang diaktifkan.
Seni bina panggilan API
Lapisan penghantaran
Pemalam menggunakan kemudahan permintaan Obsidian dan laluan gantian yang memahami protokol. Desktop boleh menggunakan aliran HTTP Node, persekitaran lain boleh menggunakan fetch. Protokol penyedia dan penghantaran masa jalan ialah konsep berbeza. Claude melalui gerbang serasi OpenAI menggunakan pratetap gerbang itu, bukan profil Anthropic natif.
Percubaan semula
Mod permintaan stabil dimatikan secara lalai, dengan tiga percubaan semula bersela lima saat apabila berkenaan. Ralat penghantaran sementara boleh memasuki laluan percubaan/gantian dikongsi. Baiki pengesahan atau konfigurasi model tidak sah; jangan bergantung pada ulangan. Permintaan panjang tetap boleh gagal kerana had masa jauh, model atau kuota.
Cache respons
Respons berjaya boleh digunakan semula melalui cache memori terhad. Titik akhir, model, tetapan penjanaan, prompt dan kandungan membentuk identiti permintaan. Cache bukan simpanan kekal, meter kos atau jaminan ulangan tidak mencetuskan panggilan berbayar baharu.
Pengendalian model penaakulan
Kawalan penaakulan/pemikiran muncul apabila disokong pratetap dan peraturan model. Jangan salin parameter khusus protokol antara penyedia. Uji tugas tepat; model boleh bersembang tetapi mungkin menolak tetapan penaakulan, token atau pensampelan tertentu.
Anggaran token
Anggaran panjang teks dan had keluaran bukan jumlah token tepat penyedia. Semak penggunaan sebenar untuk bil. Pemalam tidak menyediakan anggaran kos sejagat.
Penemuan model
Fetch models menemui model apabila pratetap menyokongnya. Sesetengah deployment memerlukan nama model atau deployment secara manual. Izin menyenaraikan dan menjana ialah perkara berasingan.
Test connection mengikut mod pratetap. models-then-chat boleh melaporkan kejayaan daripada senarai model sahaja; chat-only menjalankan penjanaan kecil. Sentiasa uji tugas sebenar kecil untuk model dan bentuk keluaran aliran.
- Anthropic dan Google mempunyai protokol senarai natif.
- Ollama menyenaraikan tag dimuat turun; LM Studio menyenaraikan model yang didedahkan pelayan setempat.
- Azure OpenAI memerlukan konfigurasi deployment dan versi API; senarai umum tidak menggantikannya.
- Gerbang mungkin mengehadkan penemuan walaupun model tertentu menerima sembang.
Mula pantas
- Pilih pratetap sepadan dalam Settings → Notemd.
- Masukkan titik akhir, kelayakan dan model/deployment sebenar yang tersedia.
- Jalankan Test connection, kemudian proses satu nota ujian.
- Semak hasil dan laporan sebelum kelompok atau penghalaan khusus tugas.
Untuk operasi setempat, muat turun/muatkan model dan mulakan pelayannya dahulu. Ollama tidak memerlukan kunci API; LM Studio menerima kunci pilihan dan pratetap EMPTY. Masukkan token sebenar jika pelayan memerlukannya. LLM setempat tidak menjadikan carian web atau tugas bergantung rangkaian luar talian.
Seterusnya
- OpenAI, Anthropic, Google, penyedia China dan model setempat: persediaan protokol.
- Konfigurasi: tetapan tugas serta destinasi.
- Penyelesaian masalah: kegagalan, batas diagnostik dan laporan selamat.