Lompat ke kandungan utama

Penyedia LLM

💡TL;DR
Notemd mempunyai 36 pratetap merentas lima keluarga protokol: serasi OpenAI, Anthropic, Google, Azure OpenAI dan Ollama. Pilih pratetap yang sepadan dengan protokol titik akhir, masukkan kelayakan diperlukan dan uji model tersedia pada nota kecil. Lalai pratetap ialah nilai permulaan boleh ubah, bukan janji ketersediaan model huluan semasa.

Kategori penyedia​

Nilai berikut datang daripada daftar penyedia. Kekalkan skema URL dan laluan penuh. Gantikan model atau titik akhir pemegang tempat dengan nilai deployment sebenar. Akses, harga dan jadual persaraan penyedia dihoskan ditentukan penyedia.

Penyedia awan​

PenyediaModel pratetapURL asas pratetap
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oTetapkan titik akhir sumber Azure anda
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Penyedia gerbang / proksi​

PenyediaModel pratetapURL asas pratetap
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Penyedia setempat​

PenyediaModel pratetapURL asas pratetap
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Penyedia China​

Lihat persediaan penyedia serantau untuk DeepSeek, Qwen, Doubao, Moonshot, GLM dan pratetap berkaitan. Kategori menerangkan konfigurasi, bukan jaminan akses geografi atau mutu bahasa Cina. Padankan rantau akaun, titik akhir dan hak akses model.

Pemilihan model khusus tugas​

Aktifkan useMultiModelSettings untuk memilih penyedia dan model gantian berasingan. Tanpanya, tugas menggunakan activeProvider. Medan model tugas kosong menggunakan model yang ditetapkan penyedia itu; pilihan penyedia tersimpan yang tidak sah diselaraskan dengan penyedia aktif ketika tetapan dimuatkan.

TugasTetapan penyediaModel gantian
Tambah pautanaddLinksProvideraddLinksModel
Penjanaan tajukgenerateTitleProvidergenerateTitleModel
Ringkasan penyelidikanresearchProviderresearchModel
TerjemahantranslateProvidertranslateModel
Ekstraksi konsepextractConceptsProviderextractConceptsModel
Ringkasan MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Ekstraksi teks asalextractOriginalTextProviderextractOriginalTextModel

Penyedia aktif dan penyedia tugas tersimpan lalai ialah DeepSeek. Semak setiap tugas sebelum memproses bahan peribadi; menukar penyedia aktif sahaja tidak mengganti pilihan khusus tugas yang diaktifkan.

Seni bina panggilan API​

Lapisan penghantaran​

Pemalam menggunakan kemudahan permintaan Obsidian dan laluan gantian yang memahami protokol. Desktop boleh menggunakan aliran HTTP Node, persekitaran lain boleh menggunakan fetch. Protokol penyedia dan penghantaran masa jalan ialah konsep berbeza. Claude melalui gerbang serasi OpenAI menggunakan pratetap gerbang itu, bukan profil Anthropic natif.

Percubaan semula​

Mod permintaan stabil dimatikan secara lalai, dengan tiga percubaan semula bersela lima saat apabila berkenaan. Ralat penghantaran sementara boleh memasuki laluan percubaan/gantian dikongsi. Baiki pengesahan atau konfigurasi model tidak sah; jangan bergantung pada ulangan. Permintaan panjang tetap boleh gagal kerana had masa jauh, model atau kuota.

Cache respons​

Respons berjaya boleh digunakan semula melalui cache memori terhad. Titik akhir, model, tetapan penjanaan, prompt dan kandungan membentuk identiti permintaan. Cache bukan simpanan kekal, meter kos atau jaminan ulangan tidak mencetuskan panggilan berbayar baharu.

Pengendalian model penaakulan​

Kawalan penaakulan/pemikiran muncul apabila disokong pratetap dan peraturan model. Jangan salin parameter khusus protokol antara penyedia. Uji tugas tepat; model boleh bersembang tetapi mungkin menolak tetapan penaakulan, token atau pensampelan tertentu.

Anggaran token​

Anggaran panjang teks dan had keluaran bukan jumlah token tepat penyedia. Semak penggunaan sebenar untuk bil. Pemalam tidak menyediakan anggaran kos sejagat.

Penemuan model​

Fetch models menemui model apabila pratetap menyokongnya. Sesetengah deployment memerlukan nama model atau deployment secara manual. Izin menyenaraikan dan menjana ialah perkara berasingan.

Test connection mengikut mod pratetap. models-then-chat boleh melaporkan kejayaan daripada senarai model sahaja; chat-only menjalankan penjanaan kecil. Sentiasa uji tugas sebenar kecil untuk model dan bentuk keluaran aliran.

  • Anthropic dan Google mempunyai protokol senarai natif.
  • Ollama menyenaraikan tag dimuat turun; LM Studio menyenaraikan model yang didedahkan pelayan setempat.
  • Azure OpenAI memerlukan konfigurasi deployment dan versi API; senarai umum tidak menggantikannya.
  • Gerbang mungkin mengehadkan penemuan walaupun model tertentu menerima sembang.

Mula pantas​

  1. Pilih pratetap sepadan dalam Settings → Notemd.
  2. Masukkan titik akhir, kelayakan dan model/deployment sebenar yang tersedia.
  3. Jalankan Test connection, kemudian proses satu nota ujian.
  4. Semak hasil dan laporan sebelum kelompok atau penghalaan khusus tugas.

Untuk operasi setempat, muat turun/muatkan model dan mulakan pelayannya dahulu. Ollama tidak memerlukan kunci API; LM Studio menerima kunci pilihan dan pratetap EMPTY. Masukkan token sebenar jika pelayan memerlukannya. LLM setempat tidak menjadikan carian web atau tugas bergantung rangkaian luar talian.

Seterusnya​