주요 콘텐츠로 이동

LLM provider

💡TL;DR
36개 프로필은 OpenAI-compatible, Anthropic, Google, Azure OpenAI, Ollama의 다섯 계열을 사용합니다. endpoint의 프로토콜에 맞춰 인증과 접근 가능한 모델을 설정하세요. 초기 값은 수정 가능한 출발점이며 현재 모델 가용성 보장이 아닙니다.

Provider 분류​

다음 값은 등록된 프로필에서 가져옵니다. URL의 scheme과 경로를 유지하고 placeholder는 실제 deployment로 바꾸세요. 이용 권한, 가격과 모델 퇴역은 provider가 결정합니다.

클라우드​

Provider초기 모델초기 URL
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oAzure 리소스 endpoint를 설정하세요
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

게이트웨이·프록시​

Provider초기 모델초기 URL
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

로컬​

Provider초기 모델초기 URL
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

중국 provider​

지역 설정을 참고하세요. 분류는 지리적 접근성이나 중국어 품질 보장이 아닙니다. 계정 지역, endpoint와 모델 권한을 맞추세요.

작업별 모델​

useMultiModelSettings를 켜면 provider와 모델 override를 나눌 수 있습니다. 끄면 activeProvider를 사용합니다. 빈 override는 provider 설정 모델을 사용하고 잘못 저장된 provider는 설정 로드 시 활성 provider로 조정합니다.

작업Provider 설정모델 override
링크addLinksProvideraddLinksModel
제목 생성generateTitleProvidergenerateTitleModel
연구 요약researchProviderresearchModel
번역translateProvidertranslateModel
개념 추출extractConceptsProviderextractConceptsModel
Mermaid 요약summarizeToMermaidProvidersummarizeToMermaidModel
원문 추출extractOriginalTextProviderextractOriginalTextModel

활성 provider와 저장된 작업별 초기 provider는 DeepSeek입니다. 개별 경로가 켜져 있으면 활성 provider만 바꿔도 대체되지 않습니다. 비공개 자료 전에 각각 확인하세요.

호출 구조​

전송 계층​

Obsidian 요청과 프로토콜을 이해하는 fallback을 사용합니다. 데스크톱은 Node HTTP stream, 다른 환경은 fetch가 가능합니다. OpenAI-compatible gateway의 Claude는 gateway 프로필을 사용하며 Anthropic 네이티브 프로필과 다릅니다.

재시도​

안정 요청 모드는 기본 꺼짐이며 적용되는 경우 재시도 3회, 간격 5초가 초기 설정입니다. 일시 오류는 공통 재시도/fallback을 사용할 수 있지만 인증·모델 오류는 수정해야 합니다. 원격 timeout, 모델 한계, quota로 긴 요청은 여전히 실패할 수 있습니다.

응답 캐시​

제한된 메모리 캐시가 성공 응답을 재사용할 수 있습니다. endpoint·모델·생성 설정·prompt·본문이 요청 식별에 포함됩니다. 영구 저장이나 비용 계측이 아니며 재실행 시 유료 요청이 없음을 보장하지 않습니다.

추론 모델​

지원 프로필/모델 규칙에 따라 reasoning/thinking을 설정합니다. 다른 프로토콜의 파라미터를 복사하지 마세요. 채팅이 되더라도 특정 추론·샘플링·token 설정을 거부할 수 있습니다.

Token 추정​

텍스트 길이와 출력 제한은 provider의 정확한 token 사용량이 아닙니다. 실제 과금은 provider 기록으로 확인하세요. 범용 비용 추정은 제공하지 않습니다.

모델 찾기​

지원 프로필은 Fetch models를 사용합니다. 일부는 모델/deployment를 직접 입력해야 합니다. 목록 권한과 생성 권한은 별도입니다. 연결 테스트의 models-then-chat는 목록만으로 성공할 수 있고 chat-only는 짧은 생성을 합니다. 실제 작업으로 모델/형식을 검증하세요.

  • Anthropic/Google은 네이티브 목록을 사용합니다.
  • Ollama는 받은 태그, LM Studio는 서버가 노출한 모델을 나열합니다.
  • Azure는 deployment와 API 버전이 필요합니다.
  • gateway는 특정 모델 생성이 가능해도 목록을 제한할 수 있습니다.

빠른 설정​

  1. Settings → Notemd에서 프로필을 선택합니다.
  2. endpoint·인증·실제 모델/deployment를 입력합니다.
  3. 연결 시험 후 임시 노트를 처리합니다.
  4. 출력과 보고서를 확인한 뒤 배치/작업별 경로를 켭니다.

로컬은 모델과 서버부터 준비하세요. Ollama는 키가 필요 없고 LM Studio는 선택적 키, 초기 EMPTY를 사용합니다. 서버 인증이 필요하면 실제 token을 설정하세요. 웹 검색까지 오프라인이 되는 것은 아닙니다.

다음 단계​