Skip to main content

LLM tarjoajat

💡TL;DR

Notemd toetaa 36 LLM tarjoajaa 4 liikennötyyppin kautta. Kaikki API kutsut käyttävät raakaa HTTP-a (ilman SDK:ja) automaattisen uudellepyynnön, liikennön varauksen ja 5 minuutin ajan vastauksen säilyttämisen kanssa. Työhön mukainen mallin valinta mahdollistaa käytettäväksi odottomia mallia kontsepttien poistamiseen ja voimakkaia mallia tutkimuksiin. Lokalisten tarjoajien (Ollama, LMStudio) tilalle ei tarvitse API-avainta.

Tämä kuuluu Obsidian AI-tietojen hallintasuunnitelmaan.

Tarjoajakategoriat

Pilvotarjoajat

TarjoajaVaikuttava alus URLVaihtoehtoinen malliTempertatuuri
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

Käyttöpöytä-/proxitarjoajat

TarjoajaVaikuttava alus URLVaihtoehtoinen malliHuomiot
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetLisää HTTP-Referer + X-Title-ohjeet
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniLisää X-GitHub-Api-Version-ohjeen
AIHubMixaihubmix.com/v1gpt-4o-miniLisää APP-Code-ohjeen
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelValittavasti API-avain
Uusi APIlocalhost:3000/v1gpt-4.1Valittavasti API-avain
OpenAI Compatible(käyttäjän määritetty)your-model-idOmakustannuslikki päätuspiste

Hiina tarjoajat

TarjoajaVaikuttavainen perus URLVaihtoehtoinen malliHuomiot
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusKoodin keskeisyys
Doubaoark.cn-beijing.volces.com/api/v3(Päätöspisteiden ID on vaativaa)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5Zhipu, China-päätuspiste
Z AIapi.z.ai/api/paas/v4glm-5Zhipu, internaatioonalinen päätuspiste
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32BMallien majottamisplatfoimi
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao vaatii Ark-päätuspisteiden tunnustetta (muoto: ep-xxxxxxxx-xxxx-xxxx). Vaikuttava asentuspaikka tulee asettaa.

Paikalliset tarjoajat

TarjoajaVaikuttavainen perus URLVaihtoehtoinen malliHuomiot
Ollamalocalhost:11434/apillama3Ei API-tunnusta. NDJSON-strimointi. Mallien löytö /api/tags kautta
LMStudiolocalhost:1234/v1local-modelLähetää "EMPTY" kertomistokenina. OpenAI-sovelluksellinen löytö
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(käyttäjän määritetty)gpt-4oAsentusnimi URL-ssä. api-key-ohje

Mallin valinta tehtävälle

Notemd tukee erillistä tarjoajaa ja mallia iga tehtävän için. Aktivoi useMultiModelSettings: true-lla.

Saadaolevat tehtävät

TehtäväAsetuksien avainVaikuttavainen tarjoaja
Linkkien lisääminen (wiki-linkin lisääminen)addLinksProvider / addLinksModelDeepSeek
Tutkimus (web-sirjaus + yhteenveto)researchProvider / researchModelDeepSeek
Luo tiiteltägenerateTitleProvider / generateTitleModelDeepSeek
KäännöstranslateProvider / translateModelDeepSeek
Diagrammin luontaminensummarizeToMermaidProvider / ModelDeepSeek
Konceptin erottaminenextractConceptsProvider / ModelDeepSeek
Alkuperäisen tekstin erottaminenextractOriginalTextProvider / ModelDeepSeek

Ratkaisun järjestyksesi

  1. Jos useMultiModelSettings on aktiivinen → käytä tehtävän omaa tarjoajaa + mallia
  2. Jos tehtävän mallin asetus on tyhjä → käytä tarjoajan vaikuttavaa mallia
  3. Jos tehtävän tarjoaja on epäsisällinen → käytä globaalia activeProvider-a
  4. Jos useMultiModelSettings on poissa → kaikki tehtävät käyttävät globaalia activeProvider

Suositeltu konfigurointi

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

API Call Architecture

Transport Layerit

  1. Obsidian requestUrl — perus (sisäistynyt, toimii kaikilla platfoimeilla)
  2. Desktop HTTP — Node.js http/https -moduulit (strimointi + pitkät pyytelut)
  3. Web fetch — varaus, kun Node.js -moduulit eivät ole saatavilla

Plugina automaattisesti vaihtaa transporttien välillä ajutettujen verkonvirheiden korjaamiseksi.

Uudellepyttämismallit

  • Normaali režiimi (enableStableApiCall: false): Yksi yrittö. Ajutetun virheen korjaamiseksi automaattisesti uudellepytetään stabiliseen režiimiin.
  • Stabilinen uudellepyttämismalli (enableStableApiCall: true): Kuni 4 yrittöä (1 + 3 uudellepyttämistä) 5 sekuntin välistyksillä.
  • Ajutetut virheet, jotka käynnistävät uudellepyttämisen: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • Ei uudellepytetä: HTTP 400, 401, 403, 404

Vastauspysähdyttäminen

5 minuutin ajan sisälläpysähdyttäminen LRU -mallilla, joka on tiedostettu tarjoajan, mallin, lämpötilan, pyyntön ja sisällön perusteella. Seuraavat samanlaiset pyytelut 5 minuutin sisällä palauttaavat heti pysähdyttämistulokset.

Mallien käyttö

Mallit, jotka ei tuke system -roolia (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), yhdistävät automaattisesti sistemän ja käyttäjän pyyntöt yhteen yksiköiseen käyttäjäpyyntöön.

DeepSeek-specific: thinkingEnabled lisää { thinking: { type: 'enabled' } } pyytäkseen. reasoningEffort (alhaa/mittelinen/korkea) lähetetään kuten reasoning_effort. Vahvistaa, että maksimilliset väljontitokenit ≥ 8000, kun mietintä on aktiivinen.

Token Estimation

estimateTokens(text): Math.ceil(text.length / 4) — 4-kirjain-tokenin heuristikka. Käytetään maxResearchContentTokens vaatimusten toteuttamiseen ennen lähetystä LLM.:

Kostennusturvaus ei ole rakentettu.

Mallien löytö

RežimiProvidersEndpoint
ollama-tagsOllama/api/tags
google-modelsGoogleMallien lista API
anthropic-modelsAnthropicMallien lista API
openai-compatible-modelsDeepSeek, Qwen, Mistral jne./v1/models
openrouter-modelsOpenRouterMallien lista API
github-modelsGitHub ModelsInference API
noneAzure OpenAIPoistossa (tarvitaan käyttöönpanon nimi)

Quick Start

  1. Valitse tarjoaja — DeepSeek (China), OpenAI (International) tai Ollama (Local/Free)
  2. Sisesta API-avain — Settings → Notemd → Provider → API Key
  3. Testaa yhteyttä — Paina testointipainikki
  4. Valinta: Tehtävän mukaiset mallit — Aktivoi useMultiModelSettings ja konfiguroi se erikseen

Ollama: API-avain ei ole tarpeen. Varmista vain, että ollama serve toimii.


Järguvät toimet

  • 📝 Konseptitiedot — Käytää tehtävän mukaista extraktiomallia
  • 🎨 Diagrammit — Käytää tehtävän mukaista diagrammallia
  • 🔍 Tutkimus — Käytää tutkimukseen suunniteltua mallia
  • ⚙️ Konfigurointi — Täysin asetusten viite