LLM tarjoajat
Notemd toetaa 36 LLM tarjoajaa 4 liikennötyyppin kautta. Kaikki API kutsut käyttävät raakaa HTTP-a (ilman SDK:ja) automaattisen uudellepyynnön, liikennön varauksen ja 5 minuutin ajan vastauksen säilyttämisen kanssa. Työhön mukainen mallin valinta mahdollistaa käytettäväksi odottomia mallia kontsepttien poistamiseen ja voimakkaia mallia tutkimuksiin. Lokalisten tarjoajien (Ollama, LMStudio) tilalle ei tarvitse API-avainta.
Tämä kuuluu Obsidian AI-tietojen hallintasuunnitelmaan.
Tarjoajakategoriat
Pilvotarjoajat
| Tarjoaja | Vaikuttava alus URL | Vaihtoehtoinen malli | Tempertatuuri |
|---|---|---|---|
| DeepSeek | api.deepseek.com | deepseek-v4-pro | 0.5 |
| OpenAI | api.openai.com/v1 | gpt-4o | 0.5 |
| Anthropic | api.anthropic.com | claude-3-5-sonnet-20240620 | 0.5 |
generativelanguage.googleapis.com/v1 | gemini-2.0-flash-exp | 0.5 | |
| Mistral | api.mistral.ai/v1 | mistral-large-latest | 0.5 |
| xAI | api.x.ai/v1 | grok-4 | 0.7 |
| Cerebras | api.cerebras.ai/v1 | gpt-oss-120b | 0.5 |
| Fireworks | api.fireworks.ai/inference/v1 | kimi-k2p5 | 0.5 |
| Nebius | api.studio.nebius.com/v1 | openai/gpt-oss-120b | 0.3 |
Käyttöpöytä-/proxitarjoajat
| Tarjoaja | Vaikuttava alus URL | Vaihtoehtoinen malli | Huomiot |
|---|---|---|---|
| OpenRouter | openrouter.ai/api/v1 | anthropic/claude-3.7-sonnet | Lisää HTTP-Referer + X-Title-ohjeet |
| GitHub Models | models.github.ai/inference | gpt-4o-mini | Lisää X-GitHub-Api-Version-ohjeen |
| AIHubMix | aihubmix.com/v1 | gpt-4o-mini | Lisää APP-Code-ohjeen |
| PPIO | api.ppinfra.com/v3/openai | qwen/qwen3-32b | |
| Hugging Face | router.huggingface.co/v1 | openai/gpt-oss-120b | |
| Vercel AI Gateway | ai-gateway.vercel.sh/v1 | anthropic/claude-sonnet-4.5 | |
| Requesty | router.requesty.ai/v1 | anthropic/claude-3-7-sonnet-latest | |
| Together | api.together.xyz/v1 | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | |
| LiteLLM | localhost:4000/v1 | your-proxy-model | Valittavasti API-avain |
| Uusi API | localhost:3000/v1 | gpt-4.1 | Valittavasti API-avain |
| OpenAI Compatible | (käyttäjän määritetty) | your-model-id | Omakustannuslikki päätuspiste |
Hiina tarjoajat
| Tarjoaja | Vaikuttavainen perus URL | Vaihtoehtoinen malli | Huomiot |
|---|---|---|---|
| Qwen | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-235b-a22b | Alibaba DashScope |
| Qwen Code | dashscope.aliyuncs.com/compatible-mode/v1 | qwen3-coder-plus | Koodin keskeisyys |
| Doubao | ark.cn-beijing.volces.com/api/v3 | (Päätöspisteiden ID on vaativaa) | ByteDance Volcengine |
| Moonshot | api.moonshot.cn/v1 | kimi-k2-0905-preview | Kimi |
| Xiaomi MiMo | api.xiaomimimo.com/v1 | mimo-v2.5-pro | |
| GLM | open.bigmodel.cn/api/paas/v4 | glm-5 | Zhipu, China-päätuspiste |
| Z AI | api.z.ai/api/paas/v4 | glm-5 | Zhipu, internaatioonalinen päätuspiste |
| MiniMax | api.minimaxi.com/v1 | MiniMax-M2.7 | |
| Baidu Qianfan | qianfan.baidubce.com/v2 | ernie-4.5-turbo-32k | |
| SiliconFlow | api.siliconflow.cn/v1 | Qwen/QwQ-32B | Mallien majottamisplatfoimi |
| Huawei Cloud MaaS | api.modelarts-maas.com/v1 | DeepSeek-V3 |
Doubao vaatii Ark-päätuspisteiden tunnustetta (muoto: ep-xxxxxxxx-xxxx-xxxx). Vaikuttava asentuspaikka tulee asettaa.
Paikalliset tarjoajat
| Tarjoaja | Vaikuttavainen perus URL | Vaihtoehtoinen malli | Huomiot |
|---|---|---|---|
| Ollama | localhost:11434/api | llama3 | Ei API-tunnusta. NDJSON-strimointi. Mallien löytö /api/tags kautta |
| LMStudio | localhost:1234/v1 | local-model | Lähetää "EMPTY" kertomistokenina. OpenAI-sovelluksellinen löytö |
| OVMS | localhost:8000/v3 | openvino-model | OpenVINO Model Server |
| Azure OpenAI | (käyttäjän määritetty) | gpt-4o | Asentusnimi URL-ssä. api-key-ohje |
Mallin valinta tehtävälle
Notemd tukee erillistä tarjoajaa ja mallia iga tehtävän için. Aktivoi useMultiModelSettings: true-lla.
Saadaolevat tehtävät
| Tehtävä | Asetuksien avain | Vaikuttavainen tarjoaja |
|---|---|---|
| Linkkien lisääminen (wiki-linkin lisääminen) | addLinksProvider / addLinksModel | DeepSeek |
| Tutkimus (web-sirjaus + yhteenveto) | researchProvider / researchModel | DeepSeek |
| Luo tiiteltä | generateTitleProvider / generateTitleModel | DeepSeek |
| Käännös | translateProvider / translateModel | DeepSeek |
| Diagrammin luontaminen | summarizeToMermaidProvider / Model | DeepSeek |
| Konceptin erottaminen | extractConceptsProvider / Model | DeepSeek |
| Alkuperäisen tekstin erottaminen | extractOriginalTextProvider / Model | DeepSeek |
Ratkaisun järjestyksesi
- Jos
useMultiModelSettingson aktiivinen → käytä tehtävän omaa tarjoajaa + mallia - Jos tehtävän mallin asetus on tyhjä → käytä tarjoajan vaikuttavaa mallia
- Jos tehtävän tarjoaja on epäsisällinen → käytä globaalia
activeProvider-a - Jos
useMultiModelSettingson poissa → kaikki tehtävät käyttävät globaaliaactiveProvider
Suositeltu konfigurointi
# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek
# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama
# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing
API Call Architecture
Transport Layerit
- Obsidian
requestUrl— perus (sisäistynyt, toimii kaikilla platfoimeilla) - Desktop HTTP — Node.js
http/https-moduulit (strimointi + pitkät pyytelut) - Web
fetch— varaus, kun Node.js -moduulit eivät ole saatavilla
Plugina automaattisesti vaihtaa transporttien välillä ajutettujen verkonvirheiden korjaamiseksi.
Uudellepyttämismallit
- Normaali režiimi (
enableStableApiCall: false): Yksi yrittö. Ajutetun virheen korjaamiseksi automaattisesti uudellepytetään stabiliseen režiimiin. - Stabilinen uudellepyttämismalli (
enableStableApiCall: true): Kuni 4 yrittöä (1 + 3 uudellepyttämistä) 5 sekuntin välistyksillä. - Ajutetut virheet, jotka käynnistävät uudellepyttämisen:
err_connection_closed,err_connection_reset,err_timed_out,econnreset,econnaborted,etimedout,socket hang up,network request failed - Ei uudellepytetä: HTTP 400, 401, 403, 404
Vastauspysähdyttäminen
5 minuutin ajan sisälläpysähdyttäminen LRU -mallilla, joka on tiedostettu tarjoajan, mallin, lämpötilan, pyyntön ja sisällön perusteella. Seuraavat samanlaiset pyytelut 5 minuutin sisällä palauttaavat heti pysähdyttämistulokset.
Mallien käyttö
Mallit, jotka ei tuke system -roolia (DeepSeek R1, OpenAI o1/o3/o4/gpt-5), yhdistävät automaattisesti sistemän ja käyttäjän pyyntöt yhteen yksiköiseen käyttäjäpyyntöön.
DeepSeek-specific: thinkingEnabled lisää { thinking: { type: 'enabled' } } pyytäkseen. reasoningEffort (alhaa/mittelinen/korkea) lähetetään kuten reasoning_effort. Vahvistaa, että maksimilliset väljontitokenit ≥ 8000, kun mietintä on aktiivinen.
Token Estimation
estimateTokens(text): Math.ceil(text.length / 4) — 4-kirjain-tokenin heuristikka. Käytetään maxResearchContentTokens vaatimusten toteuttamiseen ennen lähetystä LLM.:
Kostennusturvaus ei ole rakentettu.
Mallien löytö
| Režimi | Providers | Endpoint |
|---|---|---|
ollama-tags | Ollama | /api/tags |
google-models | Mallien lista API | |
anthropic-models | Anthropic | Mallien lista API |
openai-compatible-models | DeepSeek, Qwen, Mistral jne. | /v1/models |
openrouter-models | OpenRouter | Mallien lista API |
github-models | GitHub Models | Inference API |
none | Azure OpenAI | Poistossa (tarvitaan käyttöönpanon nimi) |
Quick Start
- Valitse tarjoaja — DeepSeek (China), OpenAI (International) tai Ollama (Local/Free)
- Sisesta API-avain — Settings → Notemd → Provider → API Key
- Testaa yhteyttä — Paina testointipainikki
- Valinta: Tehtävän mukaiset mallit — Aktivoi
useMultiModelSettingsja konfiguroi se erikseen
Ollama: API-avain ei ole tarpeen. Varmista vain, että ollama serve toimii.
Järguvät toimet
- 📝 Konseptitiedot — Käytää tehtävän mukaista extraktiomallia
- 🎨 Diagrammit — Käytää tehtävän mukaista diagrammallia
- 🔍 Tutkimus — Käytää tutkimukseen suunniteltua mallia
- ⚙️ Konfigurointi — Täysin asetusten viite