Nhà cung cấp mô hình
Nhóm nhà cung cấp
Các giá trị sau lấy từ danh mục nhà cung cấp của dự án. Giữ đầy đủ giao thức URL và đường dẫn. Thay tên mô hình hoặc điểm cuối mẫu bằng giá trị triển khai thực tế. Quyền truy cập, giá và lịch ngừng mô hình do nhà cung cấp quyết định.
Dịch vụ đám mây
| Nhà cung cấp | Mô hình đặt sẵn | URL cơ sở đặt sẵn |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Cấu hình điểm cuối tài nguyên Azure của bạn |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
Cổng trung gian / proxy
| Nhà cung cấp | Mô hình đặt sẵn | URL cơ sở đặt sẵn |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
Máy chủ cục bộ
| Nhà cung cấp | Mô hình đặt sẵn | URL cơ sở đặt sẵn |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
Nhà cung cấp Trung Quốc
Xem thiết lập theo khu vực cho DeepSeek, Qwen, Doubao, Moonshot, GLM và hồ sơ liên quan. Phân nhóm mô tả cấu hình, không bảo đảm truy cập ở mọi khu vực hay chất lượng tiếng Trung. Khớp vùng tài khoản, điểm cuối và quyền dùng mô hình.
Mô hình theo tác vụ
Bật useMultiModelSettings để chọn nhà cung cấp và ghi đè mô hình riêng. Nếu tắt, tác vụ dùng activeProvider. Ghi đè mô hình rỗng dùng mô hình của nhà cung cấp tương ứng; lựa chọn nhà cung cấp đã lưu không hợp lệ được đối chiếu về nhà cung cấp đang chọn khi nạp cài đặt.
| Tác vụ | Trường nhà cung cấp | Ghi đè mô hình |
|---|---|---|
| Thêm liên kết | addLinksProvider | addLinksModel |
| Sinh theo tiêu đề | generateTitleProvider | generateTitleModel |
| Tóm tắt nghiên cứu | researchProvider | researchModel |
| Dịch | translateProvider | translateModel |
| Trích khái niệm | extractConceptsProvider | extractConceptsModel |
| Tóm tắt Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| Trích nguyên văn | extractOriginalTextProvider | extractOriginalTextModel |
Nhà cung cấp đang chọn và các lựa chọn tác vụ mặc định đều là DeepSeek. Kiểm tra từng tác vụ trước khi gửi dữ liệu riêng tư; đổi nhà cung cấp đang chọn không ghi đè các lựa chọn riêng đã bật.
Kiến trúc lời gọi API
Lớp giao vận
Tiện ích dùng phương tiện yêu cầu của Obsidian và đường dự phòng hiểu giao thức. Trên máy tính, đường dự phòng có thể dùng luồng Node HTTP; môi trường khác có thể dùng fetch. Giao thức nhà cung cấp khác với phương tiện giao vận lúc chạy. Claude qua cổng tương thích OpenAI dùng hồ sơ cổng đó, không dùng hồ sơ Anthropic gốc.
Thử lại
Chế độ yêu cầu ổn định mặc định tắt; cấu hình thử lại mặc định là ba lần với khoảng cách năm giây khi áp dụng. Lỗi giao vận tạm thời có thể vào đường thử lại/dự phòng chung. Cần sửa xác thực hoặc mô hình sai thay vì trông chờ thử lại. Yêu cầu dài vẫn có thể thất bại do thời gian chờ từ xa, giới hạn mô hình hoặc hết hạn mức.
Bộ nhớ đệm phản hồi
Phản hồi thành công có thể được dùng lại từ bộ nhớ đệm giới hạn trong RAM. Điểm cuối, mô hình, tham số sinh, lời nhắc và nội dung cùng xác định yêu cầu. Bộ nhớ đệm không phải lưu trữ bền vững, công cụ tính tiền hay bảo đảm lần chạy lại không gửi yêu cầu tính phí mới.
Mô hình suy luận
Điều khiển suy luận/tư duy xuất hiện theo khả năng hồ sơ và quy tắc mô hình. Không chép tham số riêng của giao thức sang nhà cung cấp khác. Thử đúng tác vụ; mô hình trò chuyện được vẫn có thể từ chối tham số suy luận, token hoặc lấy mẫu.
Ước lượng token
Ước lượng theo độ dài văn bản và giới hạn đầu ra không phải số token chính xác của nhà cung cấp. Xem mức dùng thực tế để tính phí. Tiện ích không có ước tính chi phí chung cho mọi dịch vụ.
Tìm mô hình
Fetch models tìm mô hình khi hồ sơ hỗ trợ. Một số triển khai cần nhập tên mô hình hoặc deployment bằng tay. Quyền liệt kê và quyền sinh nội dung độc lập.
Kiểm tra kết nối theo chế độ của hồ sơ. models-then-chat có thể thành công chỉ nhờ điểm cuối danh sách; chat-only gửi yêu cầu sinh nhỏ. Luôn chạy một tác vụ thật nhỏ với đúng mô hình và cấu trúc đầu ra cần dùng.
- Anthropic và Google có giao thức danh sách gốc.
- Ollama liệt kê tag đã tải; LM Studio liệt kê mô hình máy chủ cung cấp.
- Azure OpenAI cần deployment và phiên bản API; danh sách chung không thay thế cấu hình đó.
- Cổng trung gian có thể chặn tìm mô hình dù một mô hình cụ thể vẫn nhận chat.
Bắt đầu nhanh
- Chọn hồ sơ phù hợp trong Settings → Notemd.
- Nhập điểm cuối, thông tin xác thực và mô hình/deployment thực tế.
- Chạy Kiểm tra kết nối, rồi xử lý một ghi chú thử.
- Xem kết quả và báo cáo trước khi bật hàng loạt hoặc định tuyến riêng.
Với cục bộ, tải/nạp mô hình và chạy máy chủ trước. Ollama không yêu cầu khóa API; LM Studio nhận khóa tùy chọn, giá trị đặt sẵn EMPTY. Dùng token thật nếu máy chủ yêu cầu. Mô hình cục bộ không khiến tìm kiếm web hoặc các tác vụ phụ thuộc mạng thành ngoại tuyến.
Tiếp theo
- OpenAI, Anthropic, Google, nhà cung cấp Trung Quốc, mô hình cục bộ: cấu hình theo giao thức.
- Cấu hình: tác vụ và đích.
- Khắc phục sự cố: lỗi và bằng chứng an toàn.