ผู้ให้บริการ LLM
หมวด
ค่าตารางมาจากทะเบียนผู้ให้บริการ คง URL scheme และพาธเต็ม แล้วแทน placeholder ด้วย deployment จริง สิทธิ์ ราคา และการยุติโมเดลอยู่ในการควบคุมของผู้ให้บริการ
คลาวด์
| ผู้ให้บริการ | โมเดลเริ่มต้น | URL ฐาน |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | กำหนด endpoint ของทรัพยากร Azure ของคุณ |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Gateway และ proxy
| ผู้ให้บริการ | โมเดลเริ่มต้น | URL ฐาน |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
ภายในเครื่อง
| ผู้ให้บริการ | โมเดลเริ่มต้น | URL ฐาน |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
ผู้ให้บริการจีน
ดู การตั้งค่าตามภูมิภาค หมวดไม่ได้รับประกันการเข้าถึงตามพื้นที่หรือคุณภาพภาษาจีน ต้องจับคู่ภูมิภาคบัญชี endpoint และสิทธิ์โมเดล
เลือกตามงาน
useMultiModelSettings ให้ตั้งผู้ให้บริการและโมเดลแต่ละงาน มิฉะนั้นใช้ activeProvider ฟิลด์โมเดลที่ว่างใช้โมเดลของผู้ให้บริการ หากชื่อผู้ให้บริการที่บันทึกไม่ถูกต้อง การโหลดจะปรับให้สอดคล้องกับผู้ให้บริการปัจจุบัน
| งาน | การตั้งค่าผู้ให้บริการ | การแทนโมเดล |
|---|---|---|
| ลิงก์ | addLinksProvider | addLinksModel |
| สร้างจากชื่อเรื่อง | generateTitleProvider | generateTitleModel |
| สรุปการค้นคว้า | researchProvider | researchModel |
| แปล | translateProvider | translateModel |
| แนวคิด | extractConceptsProvider | extractConceptsModel |
| สรุป Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| ข้อความต้นฉบับ | extractOriginalTextProvider | extractOriginalTextModel |
ทั้งผู้ให้บริการปัจจุบันและค่าผู้ให้บริการของงานเริ่มที่ DeepSeek การเปลี่ยนเฉพาะผู้ให้บริการปัจจุบันไม่แทนเส้นทางงานที่เปิดใช้อยู่ ตรวจให้ครบก่อนใช้ข้อมูลส่วนตัว
โครงสร้างคำขอ
ชั้นการรับส่ง
Notemd ใช้คำขอของ Obsidian และ fallback ที่เข้าใจโพรโทคอล บนเดสก์ท็อปอาจใช้สตรีม Node HTTP ส่วนสภาพแวดล้อมอื่นใช้ fetch หากใช้ Claude ผ่าน gateway แบบ OpenAI-compatible ให้เลือกโปรไฟล์ gateway ไม่ใช่โปรไฟล์ API โดยตรงของ Anthropic
การลองใหม่
โหมดเสถียรเริ่มปิด ค่าที่เกี่ยวข้องโดยทั่วไปคือสามครั้งโดยเว้นห้าวินาที ปัญหาชั่วคราวอาจใช้เส้นทาง fallback/ลองใหม่ร่วมกัน แต่สิทธิ์และการตั้งค่าโมเดลต้องแก้ให้ถูก คำขอยาวยังอาจหมดเวลา เกินขีดจำกัด หรือเกินโควตา
แคชคำตอบ
แคชในหน่วยความจำที่จำกัดขนาดอาจใช้คำตอบที่สำเร็จซ้ำได้ endpoint โมเดล พารามิเตอร์สร้างข้อความ พรอมป์ต์ และเนื้อหามีส่วนกำหนดตัวตนของแคช ไม่ใช่ที่เก็บถาวรหรือเครื่องคิดราคา และไม่รับประกันว่าการเรียกซ้ำฟรี
โมเดลให้เหตุผล
Reasoning/thinking ใช้กฎของโปรไฟล์และโมเดล อย่านำพารามิเตอร์เฉพาะโพรโทคอลไปใช้ข้ามบริการ ทดสอบงานจริง เพราะโมเดลอาจปฏิเสธค่า token การสุ่ม หรือการให้เหตุผลบางแบบ
ประเมิน token
ความยาวข้อความและเพดานผลลัพธ์ไม่ใช่จำนวน token ที่ผู้ให้บริการนับจริง ประเมินค่าใช้จ่ายจากข้อมูลใช้งานจริง ไม่มีการคำนวณราคาสากลที่รับรองได้
ค้นหาโมเดล
Fetch models ทำงานเมื่อโปรไฟล์รองรับ บาง deployment ต้องใส่ชื่อเอง สิทธิ์ดูรายการกับสิทธิ์สร้างข้อความแยกกัน ทดสอบการเชื่อมต่อ แบบ models-then-chat อาจผ่านด้วยรายการอย่างเดียว ส่วน chat-only สร้างคำตอบสั้น ต้องตรวจงานจริงและรูปแบบผลลัพธ์
- Anthropic และ Google ใช้ API ค้นหาโมเดลของตน
- Ollama แสดง tags ที่ดาวน์โหลด ส่วน LM Studio แสดงโมเดลของเซิร์ฟเวอร์
- Azure ต้องใช้ deployment และเวอร์ชัน API
- Gateway อาจจำกัดรายการ แต่ยอมรับคำขอที่ระบุโมเดลชัดเจน
เริ่มใช้งาน
- เลือกโปรไฟล์ให้ถูกใน Settings → Notemd
- ใส่ endpoint คีย์ และโมเดล/deployment ที่ใช้ได้
- ทดสอบการเชื่อมต่อและโน้ตทดลอง
- ตรวจผลลัพธ์และรายงานก่อนเปิดงานชุดหรือเส้นทางตามงาน
ต้องเตรียมเซิร์ฟเวอร์และโมเดลในเครื่องให้พร้อม Ollama ไม่ต้องใช้คีย์ ส่วน LM Studio ให้ใส่คีย์ได้โดยไม่บังคับและเริ่มที่ EMPTY หากเซิร์ฟเวอร์ต้องใช้ token จริงให้ใส่ค่าที่ถูก โมเดลในเครื่องไม่ได้ทำให้การค้นเว็บออฟไลน์