Bỏ qua để đến nội dung chính

Nhà cung cấp mô hình

💡TL;DR
Notemd có 36 hồ sơ thuộc năm nhóm giao thức: tương thích OpenAI, Anthropic, Google, Azure OpenAI và Ollama. Chọn đúng giao thức điểm cuối, điền thông tin xác thực cần thiết và thử mô hình truy cập được bằng ghi chú nhỏ. Giá trị đặt sẵn là điểm bắt đầu có thể đổi, không bảo đảm mô hình còn được cung cấp.

Nhóm nhà cung cấp​

Các giá trị sau lấy từ danh mục nhà cung cấp của dự án. Giữ đầy đủ giao thức URL và đường dẫn. Thay tên mô hình hoặc điểm cuối mẫu bằng giá trị triển khai thực tế. Quyền truy cập, giá và lịch ngừng mô hình do nhà cung cấp quyết định.

Dịch vụ đám mây​

Nhà cung cấpMô hình đặt sẵnURL cơ sở đặt sẵn
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oCấu hình điểm cuối tài nguyên Azure của bạn
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

Cổng trung gian / proxy​

Nhà cung cấpMô hình đặt sẵnURL cơ sở đặt sẵn
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

Máy chủ cục bộ​

Nhà cung cấpMô hình đặt sẵnURL cơ sở đặt sẵn
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

Nhà cung cấp Trung Quốc​

Xem thiết lập theo khu vực cho DeepSeek, Qwen, Doubao, Moonshot, GLM và hồ sơ liên quan. Phân nhóm mô tả cấu hình, không bảo đảm truy cập ở mọi khu vực hay chất lượng tiếng Trung. Khớp vùng tài khoản, điểm cuối và quyền dùng mô hình.

Mô hình theo tác vụ​

Bật useMultiModelSettings để chọn nhà cung cấp và ghi đè mô hình riêng. Nếu tắt, tác vụ dùng activeProvider. Ghi đè mô hình rỗng dùng mô hình của nhà cung cấp tương ứng; lựa chọn nhà cung cấp đã lưu không hợp lệ được đối chiếu về nhà cung cấp đang chọn khi nạp cài đặt.

Tác vụTrường nhà cung cấpGhi đè mô hình
Thêm liên kếtaddLinksProvideraddLinksModel
Sinh theo tiêu đềgenerateTitleProvidergenerateTitleModel
Tóm tắt nghiên cứuresearchProviderresearchModel
DịchtranslateProvidertranslateModel
Trích khái niệmextractConceptsProviderextractConceptsModel
Tóm tắt MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
Trích nguyên vănextractOriginalTextProviderextractOriginalTextModel

Nhà cung cấp đang chọn và các lựa chọn tác vụ mặc định đều là DeepSeek. Kiểm tra từng tác vụ trước khi gửi dữ liệu riêng tư; đổi nhà cung cấp đang chọn không ghi đè các lựa chọn riêng đã bật.

Kiến trúc lời gọi API​

Lớp giao vận​

Tiện ích dùng phương tiện yêu cầu của Obsidian và đường dự phòng hiểu giao thức. Trên máy tính, đường dự phòng có thể dùng luồng Node HTTP; môi trường khác có thể dùng fetch. Giao thức nhà cung cấp khác với phương tiện giao vận lúc chạy. Claude qua cổng tương thích OpenAI dùng hồ sơ cổng đó, không dùng hồ sơ Anthropic gốc.

Thử lại​

Chế độ yêu cầu ổn định mặc định tắt; cấu hình thử lại mặc định là ba lần với khoảng cách năm giây khi áp dụng. Lỗi giao vận tạm thời có thể vào đường thử lại/dự phòng chung. Cần sửa xác thực hoặc mô hình sai thay vì trông chờ thử lại. Yêu cầu dài vẫn có thể thất bại do thời gian chờ từ xa, giới hạn mô hình hoặc hết hạn mức.

Bộ nhớ đệm phản hồi​

Phản hồi thành công có thể được dùng lại từ bộ nhớ đệm giới hạn trong RAM. Điểm cuối, mô hình, tham số sinh, lời nhắc và nội dung cùng xác định yêu cầu. Bộ nhớ đệm không phải lưu trữ bền vững, công cụ tính tiền hay bảo đảm lần chạy lại không gửi yêu cầu tính phí mới.

Mô hình suy luận​

Điều khiển suy luận/tư duy xuất hiện theo khả năng hồ sơ và quy tắc mô hình. Không chép tham số riêng của giao thức sang nhà cung cấp khác. Thử đúng tác vụ; mô hình trò chuyện được vẫn có thể từ chối tham số suy luận, token hoặc lấy mẫu.

Ước lượng token​

Ước lượng theo độ dài văn bản và giới hạn đầu ra không phải số token chính xác của nhà cung cấp. Xem mức dùng thực tế để tính phí. Tiện ích không có ước tính chi phí chung cho mọi dịch vụ.

Tìm mô hình​

Fetch models tìm mô hình khi hồ sơ hỗ trợ. Một số triển khai cần nhập tên mô hình hoặc deployment bằng tay. Quyền liệt kê và quyền sinh nội dung độc lập.

Kiểm tra kết nối theo chế độ của hồ sơ. models-then-chat có thể thành công chỉ nhờ điểm cuối danh sách; chat-only gửi yêu cầu sinh nhỏ. Luôn chạy một tác vụ thật nhỏ với đúng mô hình và cấu trúc đầu ra cần dùng.

  • Anthropic và Google có giao thức danh sách gốc.
  • Ollama liệt kê tag đã tải; LM Studio liệt kê mô hình máy chủ cung cấp.
  • Azure OpenAI cần deployment và phiên bản API; danh sách chung không thay thế cấu hình đó.
  • Cổng trung gian có thể chặn tìm mô hình dù một mô hình cụ thể vẫn nhận chat.

Bắt đầu nhanh​

  1. Chọn hồ sơ phù hợp trong Settings → Notemd.
  2. Nhập điểm cuối, thông tin xác thực và mô hình/deployment thực tế.
  3. Chạy Kiểm tra kết nối, rồi xử lý một ghi chú thử.
  4. Xem kết quả và báo cáo trước khi bật hàng loạt hoặc định tuyến riêng.

Với cục bộ, tải/nạp mô hình và chạy máy chủ trước. Ollama không yêu cầu khóa API; LM Studio nhận khóa tùy chọn, giá trị đặt sẵn EMPTY. Dùng token thật nếu máy chủ yêu cầu. Mô hình cục bộ không khiến tìm kiếm web hoặc các tác vụ phụ thuộc mạng thành ngoại tuyến.

Tiếp theo​