주요 콘텐츠로 이동

LLM 제공업체들

💡TL;DR

Notemd은 4가지 전송 유형에 걸쳐 36개의 LLM 제공업체를 지원합니다. 모든 API 호출은 SDK 없이 원시 HTTP 형태로 이루어지며, 자동 재시도, 전송 대체 기능, 그리고 5분간의 응답 캐싱이 적용됩니다. 작업별 모델 선택 기능을 통해 개념 추출에는 저렴한 모델을, 연구에는 강력한 모델을 사용할 수 있습니다. 로컬 제공업체(Ollama, LMStudio)의 경우 API 키가 필요하지 않습니다.

이것은 Obsidian AI 지식 관리 가이드의 일부입니다.

공급업체 카테고리

클라우드 제공업체

제공업체기본 베이스 URL기본 모델온도
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

게이트웨이 / 프록시 제공업체

제공업체기본 베이스 URL기본 모델메모들
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetHTTP-Referer + X-Title 헤더를 추가합니다
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniX-GitHub-Api-Version 헤더를 추가합니다.
AIHubMixaihubmix.com/v1gpt-4o-miniAPP-Code 헤더를 추가합니다.
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-model선택적 API 키
새로운 APIlocalhost:3000/v1gpt-4.1선택적 API 키
OpenAI Compatible(사용자가 설정함)your-model-id커스텀 엔드포인트

중국 공급업체들

제공업체기본 베이스 URL기본 모델메모들
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22b알리바바 다시스코프
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plus코딩 중심
Doubaoark.cn-beijing.volces.com/api/v3(엔드포인트 ID가 필요합니다.)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-preview킴이
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5중국의 지푸 엔드포인트
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, 국제 엔드포인트
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32B모델 호스팅 플랫폼
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao에는 Ark 엔드포인트 ID가 필요합니다 (형식: ep-xxxxxxxx-xxxx-xxxx). 기본으로 사용되는 플레이스홀더는 반드시 교체해야 합니다.

로컬 프로바이더

제공업체기본 베이스 URL기본 모델메모들
Ollamalocalhost:11434/apillama3API 키가 없습니다. NDJSON 스트리밍. /api/tags을 통한 모델 발견
LMStudiolocalhost:1234/v1local-model"EMPTY"을 베어러 토큰으로 전송합니다. OpenAI과 호환되는 디스커버리 기능입니다.
OVMSlocalhost:8000/v3openvino-modelOpenVINO 모델 서버
Azure OpenAI(사용자가 설정함)gpt-4oURL의 배포 이름입니다. api-key 헤더

작업별 모델 선택

Notemd은 각 작업에 대해 별도의 공급자와 모델을 지원합니다. useMultiModelSettings: true을 사용하여 활성화할 수 있습니다.

사용 가능한 작업들

작업설정 키기본 제공자
링크 추가 (위키 링크 삽입)addLinksProvider / addLinksModelDeepSeek
조사 (웹 검색 + 요약)researchProvider / researchModelDeepSeek
제목에서 생성하기generateTitleProvider / generateTitleModelDeepSeek
번역translateProvider / translateModelDeepSeek
다이어그램 생성summarizeToMermaidProvider / ModelDeepSeek
개념 추출extractConceptsProvider / ModelDeepSeek
원본 텍스트 추출extractOriginalTextProvider / ModelDeepSeek

해상도 순서

  1. useMultiModelSettings가 활성화된 경우 → 작업별 프로바이더와 모델을 사용합니다.
  2. 작업 모델 재정의가 비어 있으면 → 제공자의 기본 모델로 복귀
  3. 작업 제공자가 유효하지 않은 경우 → 전역 activeProvider으로 대체
  4. useMultiModelSettings가 꺼져 있으면 → 모든 작업이 전역 activeProvider을 사용합니다.

권장 설정

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API 호출 아키텍처

전송 계층

  1. Obsidian requestUrl — 기본 (내장형, 모든 플랫폼에서 작동)
  2. 데스크톱 HTTP — Node.js http/https 모듈 (스트리밍 + 장시간 요청)
  3. Web fetch — Node.js 모듈이 사용 불가능할 때의 대체 방안

이 플러그인은 일시적인 네트워크 오류가 발생할 때 자동으로 전송 방식 간에 전환합니다.

재시도 로직

  • 일반 모드 (enableStableApiCall: false): 한 번의 시도만 진행됩니다. 일시적인 실패가 발생하면 자동으로 안정적인 재시도로 전환됩니다.
  • 안정적 재시도 모드 (enableStableApiCall: true): 5초 간격으로 최대 4회 시도(1회 기본 시도 + 3회 재시도).
  • 재시도를 유발하는 일시적 오류: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • 재시도 불가능: HTTP 400, 401, 403, 404

응답 캐싱

제공자 + 모델 + 온도 + 프롬프트 + 콘텐츠를 키로 하는 5분간 유지되는 인메모리 LRU 캐시입니다. 5분 이내에 동일한 요청이 다시 들어오면 캐시된 결과가 즉시 반환됩니다.

추론 모델 처리

system 롤을 지원하지 않는 모델들(DeepSeek R1, OpenAI o1/o3/o4/gpt-5)의 경우 시스템 프롬프트와 사용자 프롬프트가 자동으로 하나의 사용자 메시지로 결합됩니다.

DeepSeek-specific: thinkingEnabled은 요청에 { thinking: { type: 'enabled' } }을 추가합니다. reasoningEffort(낮음/중간/높음)는 reasoning_effort로 전달됩니다. 사고 모드가 켜져 있을 때 최대 출력 토큰 수가 8000 이상인지 확인합니다.

토큰 추정

estimateTokens(text): Math.ceil(text.length / 4) — 토큰당 4자 규칙. LLM로 전송하기 전에 maxResearchContentTokens를 적용하기 위해 사용됨.

비용 추적 기능이 구현되어 있지 않습니다.

모델 발견

모드제공업체엔드포인트
ollama-tagsOllama/api/tags
google-modelsGoogle모델 목록 API
anthropic-modelsAnthropic모델 목록 API
openai-compatible-modelsDeepSeek, Qwen, Mistral 등./v1/models
openrouter-modelsOpenRouter모델 목록 API
github-modelsGitHub Models추론 API
noneAzure OpenAI비활성화됨 (배포 이름 필요)

빠른 시작

  1. 제공업체 선택 — DeepSeek (중국), OpenAI (국제), 또는 Ollama (지역/무료)
  2. API 키를 입력하세요 — 설정 → Notemd → 공급자 → API 키
  3. 연결 테스트 — 테스트 버튼을 클릭하세요
  4. 선택 사항: 작업별 모델useMultiModelSettings을 활성화하고 개별적으로 설정합니다.

Ollama의 경우: API 키는 필요하지 않습니다. ollama serve이 실행 중인지만 확인하면 됩니다.


다음 단계

  • 📝 Concept Notes — 작업별 추출 모델을 사용함
  • 🎨 Diagrams — 작업별 다이어그램 모델 사용
  • 🔍 Research — 연구용 모델을 사용함
  • ⚙️ Configuration — 전체 설정 참조