Skip to main content

Các nhà cung cấp LLM

💡TL;DR

Notemd hỗ trợ 36 nhà cung cấp LLM trên 4 loại giao thức. Tất cả các cuộc gọi API đều sử dụng dữ liệu thô HTTP (không dùng SDK) kèm theo việc tự động thử lại, chuyển sang giao thức dự phòng và lưu trữ kết quả phản hồi trong 5 phút. Việc chọn mô hình theo từng nhiệm vụ cho phép bạn dùng các mô hình rẻ tiền để trích xuất khái niệm và các mô hình mạnh mẽ cho mục đích nghiên cứu. Không cần khóa API đối với các nhà cung cấp cục bộ (Ollama, LMStudio).

Đây là một phần của Obsidian Hướng dẫn Quản lý Kiến thức AI.

Các danh mục nhà cung cấp

Các nhà cung cấp đám mây

Nhà cung cấpGiá trị mặc định của URLMô hình mặc địnhTemperature
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Các nhà cung cấp cổng / proxy

Nhà cung cấpGiá trị mặc định của URLMô hình mặc địnhGhi chú
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetThêm tiêu đề HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniThêm tiêu đề X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniThêm tiêu đề APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelKhóa API là tùy chọn
API mớilocalhost:3000/v1gpt-4.1Khóa API là tùy chọn
OpenAI Compatible(được người dùng cấu hình)your-model-idĐầu cuối tùy chỉnh

Các nhà cung cấp tại Trung Quốc

Nhà cung cấpCơ sở mặc định URLMô hình mặc địnhGhi chú
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusTập trung vào lập trình
Doubaoark.cn-beijing.volces.com/api/v3(yêu cầu ID điểm cuối)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Đầu cuối Zhipu, Trung Quốc
Z AIapi.z.ai/api/paas/v4glm-5Đầu cuối Zhipu, quốc tế
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BNền tảng lưu trữ mô hình
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao yêu cầu ID đầu cuối Ark (định dạng: ep-xxxxxxxx-xxxx-xxxx). Giá trị mặc định của ký tự thay thế phải được thay thế.

Nhà cung cấp địa phương

Nhà cung cấpCơ sở mặc định URLMô hình mặc địnhGhi chú
Ollamalocalhost:11434/apillama3Không có khóa API. Phát trực tiếp NDJSON. Tìm kiếm mô hình thông qua /api/tags
LMStudiolocalhost:1234/v1local-modelGửi "EMPTY" dưới dạng token bearer. Tìm kiếm tương thích OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(được người dùng cấu hình)gpt-4oTên triển khai trong URL. Tiêu đề api-key

Lựa chọn mô hình theo nhiệm vụ

Notemd hỗ trợ nhà cung cấp và mô hình riêng biệt cho mỗi nhiệm vụ. Kích hoạt bằng useMultiModelSettings: true.

Các nhiệm vụ có sẵn

Nhiệm vụKhóa cài đặtNhà cung cấp mặc định
Thêm liên kết (chèn liên kết wiki)addLinksProvider / addLinksModelDeepSeek
Nghiên cứu (tìm kiếm web + tóm tắt)researchProvider / researchModelDeepSeek
Tạo từ tiêu đềgenerateTitleProvider / generateTitleModelDeepSeek
Dịch thuậttranslateProvider / translateModelDeepSeek
Tạo sơ đồsummarizeToMermaidProvider / ModelDeepSeek
Trích xuất khái niệmextractConceptsProvider / ModelDeepSeek
Trích xuất văn bản gốcextractOriginalTextProvider / ModelDeepSeek

Thứ tự giải quyết

  1. Nếu useMultiModelSettings được kích hoạt → sử dụng nhà cung cấp và mô hình riêng cho nhiệm vụ
  2. Nếu phần thay thế mô hình nhiệm vụ trống → quay lại sử dụng mô hình mặc định của nhà cung cấp
  3. Nếu nhà cung cấp nhiệm vụ không hợp lệ → quay lại sử dụng activeProvider toàn cục
  4. Nếu useMultiModelSettings bị tắt → tất cả các nhiệm vụ sẽ sử dụng activeProvider toàn cục

Các cấu hình được khuyến nghị

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

Kiến trúc gọi API

Các tầng truyền tải

  1. Obsidian requestUrl — chính (tích hợp sẵn, hoạt động trên mọi nền tảng)
  2. Desktop HTTP — các module Node.js http/https (phát trực tiếp + yêu cầu dài)
  3. Web fetch — phương án dự phòng khi các module Node.js không khả dụng

Plugin sẽ tự động chuyển sang tầng truyền tải khác khi xảy ra lỗi mạng tạm thời.

Logic thử lại

  • Chế độ bình thường (enableStableApiCall: false): Chỉ thử một lần. Nếu thất bại tạm thời, sẽ tự động nâng cấp lên chế độ thử lại ổn định.
  • Chế độ thử lại ổn định (enableStableApiCall: true): Tối đa 4 lần thử lại (1 lần ban đầu + 3 lần thử lại) với khoảng cách 5 giây.
  • Các lỗi tạm thời gây ra việc thử lại: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Không thể thử lại: HTTP 400, 401, 403, 404

Lưu trữ phản hồi

Bộ nhớ đệm LRU trong 5 phút dựa trên provider + model + temperature + prompt + content. Các yêu cầu giống nhau trong vòng 5 phút sẽ nhận kết quả đã được lưu trữ ngay lập tức.

Xử lý mô hình suy luận

Các mô hình không hỗ trợ vai trò system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) sẽ tự động kết hợp các prompt của hệ thống và người dùng thành một tin nhắn người dùng duy nhất.

DeepSeek-specific: thinkingEnabled thêm { thinking: { type: 'enabled' } } vào yêu cầu. reasoningEffort (thấp/trung/cao) được truyền dưới dạng reasoning_effort. Kiểm tra xem số token đầu ra tối đa có ≥ 8000 khi chức năng suy luận được bật hay không.

Dự đoán số token

estimateTokens(text): Math.ceil(text.length / 4) — phương pháp gợi ý 4 ký tự mỗi token. Được dùng để áp dụng maxResearchContentTokens trước khi gửi đến LLM.

Không có chức năng theo dõi chi phí được triển khai.

Khám phá mô hình

Chế độNhà cung cấpĐiểm cuối
ollama-tagsOllama/api/tags
google-modelsGoogleDanh sách mô hình API
anthropic-modelsAnthropicDanh sách mô hình API
openai-compatible-modelsDeepSeek, Qwen, Mistral, v.v./v1/models
openrouter-modelsOpenRouterDanh sách mô hình API
github-modelsGitHub ModelsSuy luận API
noneAzure OpenAIBị vô hiệu hóa (cần tên triển khai)

Khởi động nhanh

  1. Chọn nhà cung cấp — DeepSeek (Trung Quốc), OpenAI (Quốc tế), hoặc Ollama (Địa phương/Tự do)
  2. Nhập khóa API — Cài đặt → Notemd → Nhà cung cấp → Khóa API
  3. Kiểm tra kết nối — Nhấn nút kiểm tra
  4. Tùy chọn: Các mô hình theo nhiệm vụ — Kích hoạt useMultiModelSettings và cấu hình riêng lẻ

Đối với Ollama: không cần khóa API. Chỉ cần đảm bảo ollama serve đang chạy.


Các bước tiếp theo

  • 📝 Ghi chú ý tưởng — Sử dụng mô hình trích xuất theo nhiệm vụ
  • 🎨 Sơ đồ — Sử dụng mô hình sơ đồ theo nhiệm vụ
  • 🔍 Nghiên cứu — Sử dụng mô hình dành riêng cho nghiên cứu
  • ⚙️ Cấu hình — Tham chiếu toàn bộ thiết lập