ข้ามไปยังเนื้อหาหลัก

ผู้ให้บริการ LLM

💡TL;DR
มี 36 โปรไฟล์ในห้ากลุ่ม ได้แก่ OpenAI-compatible, Anthropic, Google, Azure OpenAI และ Ollama เลือกโพรโทคอลของ endpoint ข้อมูลที่อนุญาตให้ส่ง และโมเดลที่เข้าถึงได้ ค่าเริ่มต้นแก้ไขได้และเป็นเพียงตัวอย่าง ไม่ใช่คำรับรองการเปิดให้ใช้โมเดลในปัจจุบัน

หมวด​

ค่าตารางมาจากทะเบียนผู้ให้บริการ คง URL scheme และพาธเต็ม แล้วแทน placeholder ด้วย deployment จริง สิทธิ์ ราคา และการยุติโมเดลอยู่ในการควบคุมของผู้ให้บริการ

คลาวด์​

ผู้ให้บริการโมเดลเริ่มต้นURL ฐาน
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oกำหนด endpoint ของทรัพยากร Azure ของคุณ
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Gateway และ proxy​

ผู้ให้บริการโมเดลเริ่มต้นURL ฐาน
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

ภายในเครื่อง​

ผู้ให้บริการโมเดลเริ่มต้นURL ฐาน
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

ผู้ให้บริการจีน​

ดู การตั้งค่าตามภูมิภาค หมวดไม่ได้รับประกันการเข้าถึงตามพื้นที่หรือคุณภาพภาษาจีน ต้องจับคู่ภูมิภาคบัญชี endpoint และสิทธิ์โมเดล

เลือกตามงาน​

useMultiModelSettings ให้ตั้งผู้ให้บริการและโมเดลแต่ละงาน มิฉะนั้นใช้ activeProvider ฟิลด์โมเดลที่ว่างใช้โมเดลของผู้ให้บริการ หากชื่อผู้ให้บริการที่บันทึกไม่ถูกต้อง การโหลดจะปรับให้สอดคล้องกับผู้ให้บริการปัจจุบัน

งานการตั้งค่าผู้ให้บริการการแทนโมเดล
ลิงก์addLinksProvideraddLinksModel
สร้างจากชื่อเรื่องgenerateTitleProvidergenerateTitleModel
สรุปการค้นคว้าresearchProviderresearchModel
แปลtranslateProvidertranslateModel
แนวคิดextractConceptsProviderextractConceptsModel
สรุป MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
ข้อความต้นฉบับextractOriginalTextProviderextractOriginalTextModel

ทั้งผู้ให้บริการปัจจุบันและค่าผู้ให้บริการของงานเริ่มที่ DeepSeek การเปลี่ยนเฉพาะผู้ให้บริการปัจจุบันไม่แทนเส้นทางงานที่เปิดใช้อยู่ ตรวจให้ครบก่อนใช้ข้อมูลส่วนตัว

โครงสร้างคำขอ​

ชั้นการรับส่ง​

Notemd ใช้คำขอของ Obsidian และ fallback ที่เข้าใจโพรโทคอล บนเดสก์ท็อปอาจใช้สตรีม Node HTTP ส่วนสภาพแวดล้อมอื่นใช้ fetch หากใช้ Claude ผ่าน gateway แบบ OpenAI-compatible ให้เลือกโปรไฟล์ gateway ไม่ใช่โปรไฟล์ API โดยตรงของ Anthropic

การลองใหม่​

โหมดเสถียรเริ่มปิด ค่าที่เกี่ยวข้องโดยทั่วไปคือสามครั้งโดยเว้นห้าวินาที ปัญหาชั่วคราวอาจใช้เส้นทาง fallback/ลองใหม่ร่วมกัน แต่สิทธิ์และการตั้งค่าโมเดลต้องแก้ให้ถูก คำขอยาวยังอาจหมดเวลา เกินขีดจำกัด หรือเกินโควตา

แคชคำตอบ​

แคชในหน่วยความจำที่จำกัดขนาดอาจใช้คำตอบที่สำเร็จซ้ำได้ endpoint โมเดล พารามิเตอร์สร้างข้อความ พรอมป์ต์ และเนื้อหามีส่วนกำหนดตัวตนของแคช ไม่ใช่ที่เก็บถาวรหรือเครื่องคิดราคา และไม่รับประกันว่าการเรียกซ้ำฟรี

โมเดลให้เหตุผล​

Reasoning/thinking ใช้กฎของโปรไฟล์และโมเดล อย่านำพารามิเตอร์เฉพาะโพรโทคอลไปใช้ข้ามบริการ ทดสอบงานจริง เพราะโมเดลอาจปฏิเสธค่า token การสุ่ม หรือการให้เหตุผลบางแบบ

ประเมิน token​

ความยาวข้อความและเพดานผลลัพธ์ไม่ใช่จำนวน token ที่ผู้ให้บริการนับจริง ประเมินค่าใช้จ่ายจากข้อมูลใช้งานจริง ไม่มีการคำนวณราคาสากลที่รับรองได้

ค้นหาโมเดล​

Fetch models ทำงานเมื่อโปรไฟล์รองรับ บาง deployment ต้องใส่ชื่อเอง สิทธิ์ดูรายการกับสิทธิ์สร้างข้อความแยกกัน ทดสอบการเชื่อมต่อ แบบ models-then-chat อาจผ่านด้วยรายการอย่างเดียว ส่วน chat-only สร้างคำตอบสั้น ต้องตรวจงานจริงและรูปแบบผลลัพธ์

  • Anthropic และ Google ใช้ API ค้นหาโมเดลของตน
  • Ollama แสดง tags ที่ดาวน์โหลด ส่วน LM Studio แสดงโมเดลของเซิร์ฟเวอร์
  • Azure ต้องใช้ deployment และเวอร์ชัน API
  • Gateway อาจจำกัดรายการ แต่ยอมรับคำขอที่ระบุโมเดลชัดเจน

เริ่มใช้งาน​

  1. เลือกโปรไฟล์ให้ถูกใน Settings → Notemd
  2. ใส่ endpoint คีย์ และโมเดล/deployment ที่ใช้ได้
  3. ทดสอบการเชื่อมต่อและโน้ตทดลอง
  4. ตรวจผลลัพธ์และรายงานก่อนเปิดงานชุดหรือเส้นทางตามงาน

ต้องเตรียมเซิร์ฟเวอร์และโมเดลในเครื่องให้พร้อม Ollama ไม่ต้องใช้คีย์ ส่วน LM Studio ให้ใส่คีย์ได้โดยไม่บังคับและเริ่มที่ EMPTY หากเซิร์ฟเวอร์ต้องใช้ token จริงให้ใส่ค่าที่ถูก โมเดลในเครื่องไม่ได้ทำให้การค้นเว็บออฟไลน์

ขั้นต่อไป​