LLM provider
Provider 분류
다음 값은 등록된 프로필에서 가져옵니다. URL의 scheme과 경로를 유지하고 placeholder는 실제 deployment로 바꾸세요. 이용 권한, 가격과 모델 퇴역은 provider가 결정합니다.
클라우드
| Provider | 초기 모델 | 초기 URL |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | Azure 리소스 endpoint를 설정하세요 |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
게이트웨이·프록시
| Provider | 초기 모델 | 초기 URL |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
로컬
| Provider | 초기 모델 | 초기 URL |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
중국 provider
지역 설정을 참고하세요. 분류는 지리적 접근성이나 중국어 품질 보장이 아닙니다. 계정 지역, endpoint와 모델 권한을 맞추세요.
작업별 모델
useMultiModelSettings를 켜면 provider와 모델 override를 나눌 수 있습니다. 끄면 activeProvider를 사용합니다. 빈 override는 provider 설정 모델을 사용하고 잘못 저장된 provider는 설정 로드 시 활성 provider로 조정합니다.
| 작업 | Provider 설정 | 모델 override |
|---|---|---|
| 링크 | addLinksProvider | addLinksModel |
| 제목 생성 | generateTitleProvider | generateTitleModel |
| 연구 요약 | researchProvider | researchModel |
| 번역 | translateProvider | translateModel |
| 개념 추출 | extractConceptsProvider | extractConceptsModel |
| Mermaid 요약 | summarizeToMermaidProvider | summarizeToMermaidModel |
| 원문 추출 | extractOriginalTextProvider | extractOriginalTextModel |
활성 provider와 저장된 작업별 초기 provider는 DeepSeek입니다. 개별 경로가 켜져 있으면 활성 provider만 바꿔도 대체되지 않습니다. 비공개 자료 전에 각각 확인하세요.
호출 구조
전송 계층
Obsidian 요청과 프로토콜을 이해하는 fallback을 사용합니다. 데스크톱은 Node HTTP stream, 다른 환경은 fetch가 가능합니다. OpenAI-compatible gateway의 Claude는 gateway 프로필을 사용하며 Anthropic 네이티브 프로필과 다릅니다.
재시도
안정 요청 모드는 기본 꺼짐이며 적용되는 경우 재시도 3회, 간격 5초가 초기 설정입니다. 일시 오류는 공통 재시도/fallback을 사용할 수 있지만 인증·모델 오류는 수정해야 합니다. 원격 timeout, 모델 한계, quota로 긴 요청은 여전히 실패할 수 있습니다.
응답 캐시
제한된 메모리 캐시가 성공 응답을 재사용할 수 있습니다. endpoint·모델·생성 설정·prompt·본문이 요청 식별에 포함됩니다. 영구 저장이나 비용 계측이 아니며 재실행 시 유료 요청이 없음을 보장하지 않습니다.
추론 모델
지원 프로필/모델 규칙에 따라 reasoning/thinking을 설정합니다. 다른 프로토콜의 파라미터를 복사하지 마세요. 채팅이 되더라도 특정 추론·샘플링·token 설정을 거부할 수 있습니다.
Token 추정
텍스트 길이와 출력 제한은 provider의 정확한 token 사용량이 아닙니다. 실제 과금은 provider 기록으로 확인하세요. 범용 비용 추정은 제공하지 않습니다.
모델 찾기
지원 프로필은 Fetch models를 사용합니다. 일부는 모델/deployment를 직접 입력해야 합니다. 목록 권한과 생성 권한은 별도입니다. 연결 테스트의 models-then-chat는 목록만으로 성공할 수 있고 chat-only는 짧은 생성을 합니다. 실제 작업으로 모델/형식을 검증하세요.
- Anthropic/Google은 네이티브 목록을 사용합니다.
- Ollama는 받은 태그, LM Studio는 서버가 노출한 모델을 나열합니다.
- Azure는 deployment와 API 버전이 필요합니다.
- gateway는 특정 모델 생성이 가능해도 목록을 제한할 수 있습니다.
빠른 설정
- Settings → Notemd에서 프로필을 선택합니다.
- endpoint·인증·실제 모델/deployment를 입력합니다.
- 연결 시험 후 임시 노트를 처리합니다.
- 출력과 보고서를 확인한 뒤 배치/작업별 경로를 켭니다.
로컬은 모델과 서버부터 준비하세요. Ollama는 키가 필요 없고 LM Studio는 선택적 키, 초기 EMPTY를 사용합니다. 서버 인증이 필요하면 실제 token을 설정하세요. 웹 검색까지 오프라인이 되는 것은 아닙니다.