Skip to main content

ผู้ให้บริการ LLM

💡TL;DR

Notemd รองรับผู้ให้บริการ LLM จำนวน 36 รายใน 4 ประเภทการส่งข้อมูล การเรียกใช้งานทั้งหมด API จะใช้ HTTP แบบดิบ (ไม่ใช้ SDK) พร้อมการพยายามใหม่โดยอัตโนมัติ, การสลับวิธีการส่งข้อมูล และการเก็บค่าตอบกลับไว้เป็นเวลา 5 นาที การเลือกโมเดลตามแต่ละงานช่วยให้คุณสามารถใช้โมเดลราคาถูกสำหรับการสกัดแนวคิดและโมเดลที่ทรงพลังสำหรับการวิจัยได้ ไม่จำเป็นต้องมีคีย์ API สำหรับผู้ให้บริการแบบท้องถิ่น (Ollama, LMStudio)

นี่เป็นส่วนหนึ่งของ Obsidian คู่มือการจัดการความรู้ด้วย AI

หมวดหมู่ของผู้ให้บริการ

ผู้ให้บริการคลาวด์

ผู้ให้บริการค่าเริ่มต้นของ URLโมเดลเริ่มต้นTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

ผู้ให้บริการเกตเวย์/พร็อกซี่

ผู้ให้บริการค่าเริ่มต้นของ URLโมเดลเริ่มต้นหมายเหตุ
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetเพิ่มหัวเรื่อง HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniเพิ่มหัวเรื่อง X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniเพิ่มหัวเรื่อง APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelคีย์ที่สามารถเลือกใช้ได้ API
New APIlocalhost:3000/v1gpt-4.1คีย์ที่สามารถเลือกใช้ได้ API
OpenAI Compatible(user-configured)your-model-idจุดปลายทางที่กำหนดเอง

ผู้ให้บริการจากประเทศจีน

ผู้ให้บริการBase URL แบบเริ่มต้นโมเดลเริ่มต้นหมายเหตุ
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusเน้นการเขียนโค้ด
Doubaoark.cn-beijing.volces.com/api/v3(ต้องมี ID จุดสิ้นสุด)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5จุดปลายทางในประเทศจีน Zhipu
Z AIapi.z.ai/api/paas/v4glm-5จิปู, จุดปลายทางระดับนานาชาติ
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32Bแพลตฟอร์มโฮสต์โมเดล
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao ต้องการหมายเลขจุดปลายทาง Ark (รูปแบบ: ep-xxxxxxxx-xxxx-xxxx) ต้องแทนที่ค่า placeholder ดีฟอลต์ให้หมด.

ผู้ให้บริการในท้องถิ่น

ผู้ให้บริการBase ดีฟอลต์ URLโมเดลเริ่มต้นหมายเหตุ
Ollamalocalhost:11434/apillama3ไม่มีคีย์ API การสตรีม NDJSON การค้นหาโมเดลผ่าน /api/tags
LMStudiolocalhost:1234/v1local-modelส่ง "EMPTY" เป็น bearer token การค้นหาที่รองรับ OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(ตั้งค่าโดยผู้ใช้)gpt-4oชื่อการจัดจำหน่ายใน URL หัวข้อ api-key

การเลือกโมเดลตามงาน

Notemd รองรับผู้ให้บริการและโมเดลที่แยกจากกันสำหรับแต่ละงาน สามารถเปิดใช้งานได้ด้วย useMultiModelSettings: true.

งานที่มีให้บริการ

งานคีย์การตั้งค่าผู้ให้บริการเริ่มต้น
เพิ่มลิงก์ (การแทรกลิงก์วิกิ)addLinksProvider / addLinksModelDeepSeek
การค้นคว้า (ค้นหาบนเว็บ + สรุปผล)researchProvider / researchModelDeepSeek
สร้างจากชื่อgenerateTitleProvider / generateTitleModelDeepSeek
การแปลtranslateProvider / translateModelDeepSeek
การสร้างแผนภาพsummarizeToMermaidProvider / ModelDeepSeek
การดึงข้อมูลแนวคิดextractConceptsProvider / ModelDeepSeek
การดึงข้อความต้นฉบับextractOriginalTextProvider / ModelDeepSeek

ลำดับการแก้ไข

  1. หาก useMultiModelSettings อยู่ → ใช้ผู้ให้บริการและโมเดลที่เฉพาะเจาะจงกับงาน
  2. หากการเปลี่ยนแปลงโมเดลของงานว่างเปล่า → กลับไปใช้โมเดลเริ่มต้นของผู้ให้บริการ
  3. หากผู้ให้บริการของงานไม่ถูกต้อง → กลับไปใช้ activeProvider ระดับโลก
  4. หาก useMultiModelSettings ปิดอยู่ → งานทั้งหมดจะใช้ activeProvider แบบกลาง

การตั้งค่าที่แนะนำ

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Call Architecture

Transport Layers

  1. Obsidian requestUrl — รูปแบบหลัก (มาพร้อมกับระบบ ทำงานได้บนทุกแพลตฟอร์ม)
  2. Desktop HTTP — โมดูล Node.js http/https (สตรีมมิ่ง + คำขอยาว)
  3. Web fetch — ใช้เป็นทางเลือกสำรองเมื่อไม่สามารถใช้โมดูล Node.js ได้

ปลั๊กอินจะสลับรูปแบบการส่งข้อมูลโดยอัตโนมัติเมื่อเกิดข้อผิดพลาดชั่วคราวบนเครือข่าย.

ตรรกะการทดลองใหม่

  • โหมดปกติ (enableStableApiCall: false): ทดลองใหม่เพียงครั้งเดียว หากเกิดความล้มเหลวชั่วคราว จะทำการยกระดับเป็นการทดลองใหม่แบบมั่นคงโดยอัตโนมัติ.
  • โหมดการทดลองใหม่แบบมั่นคง (enableStableApiCall: true): ทดลองใหม่สูงสุด 4 ครั้ง (1 ครั้งแรก + 3 ครั้งทดลองใหม่) โดยมีช่วงเวลาห่างกัน 5 วินาที.
  • ข้อผิดพลาดชั่วคราวที่กระตุ้นให้ทดลองใหม่: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • ข้อผิดพลาดที่ไม่สามารถทดลองใหม่ได้: HTTP 400, 401, 403, 404

การเก็บข้อมูลตอบกลับ

คิวอาร์ซีแบบในหน่วยความจำที่ใช้เวลา 5 นาที โดยใช้คีย์จากผู้ให้บริการ + โมเดล + อุณหภูมิ + คำขอ + เนื้อหา คำขอที่เหมือนกันภายใน 5 นาทีจะได้รับผลลัพธ์จากคิวอาร์ซีที่เก็บไว้ทันที.

การจัดการโมเดลการให้เหตุผล

โมเดลที่ไม่รองรับบทบาท system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) จะถูกรวมคำขอจากระบบและผู้ใช้เข้าด้วยกันเป็นข้อความผู้ใช้เดียวโดยอัตโนมัติ.

DeepSeek-specific: thinkingEnabled จะเพิ่ม { thinking: { type: 'enabled' } } เข้าไปในคำขอ ส่วน reasoningEffort (ต่ำ/ปานกลาง/สูง) จะถูกส่งในรูปแบบ reasoning_effort และจะมีการตรวจสอบให้แน่ใจว่าจำนวนโทเค็นผลลัพธ์สูงสุด ≥ 8000 เมื่อเปิดการคิด.

การประมาณค่าโทเค็น

estimateTokens(text): Math.ceil(text.length / 4) — ใช้หลักการประมาณการ 4 ตัวอักษรต่อโทเค็น ใช้เพื่อบังคับใช้ maxResearchContentTokens ก่อนส่งไปยัง LLM.

ไม่มีการติดตามค่าใช้จ่ายที่ถูกนำมาใช้.

การค้นหาโมเดล

โหมดผู้ให้บริการจุดจบของเซิร์ฟเวอร์
ollama-tagsOllama/api/tags
google-modelsGoogleรายการโมเดล API
anthropic-modelsAnthropicรายการโมเดล API
openai-compatible-modelsDeepSeek, Qwen, Mistral ฯลฯ/v1/models
openrouter-modelsOpenRouterรายการโมเดล API
github-modelsGitHub Modelsการประมวลผล API
noneAzure OpenAIถูกปิดใช้งาน (ต้องมีชื่อการจัดส่ง)

เริ่มต้นอย่างรวดเร็ว

  1. เลือกผู้ให้บริการ — DeepSeek (ประเทศจีน), OpenAI (ระดับนานาชาติ) หรือ Ollama (ท้องถิ่น/ฟรี)
  2. ป้อนคีย์ API — การตั้งค่า → Notemd → ผู้ให้บริการ → คีย์ API
  3. ทดสอบการเชื่อมต่อ — คลิกปุ่มทดสอบ
  4. ตัวเลือก: โมเดลตามงาน — เปิดใช้งาน useMultiModelSettings และกำหนดค่าแยกกัน

สำหรับ Ollama: ไม่จำเป็นต้องมีคีย์ API เพียงแค่ตรวจสอบให้แน่ใจว่า ollama serve กำลังทำงานอยู่.


ขั้นตอนต่อไป

  • 📝 บันทึกแนวคิด — ใช้โมเดลการสกัดข้อมูลตามงาน
  • 🎨 แผนภาพ — ใช้โมเดลแผนภาพตามงาน
  • 🔍 Research — ใช้โมเดลสำหรับการวิจัย
  • ⚙️ Configuration — คู่มือการตั้งค่าทั้งหมด