Modele locale
Pregătire
Instalați serverul/modelul pentru Ollama sau încărcați modelul și porniți API-ul în LM Studio. Pregătiți separat OVMS. Notemd nu instalează modele și nu pornește aceste servere. Alegeți exact numele/profilul și testați conexiunea și sarcina.
Endpoint și autentificare
| Profil | URL de bază | Model exemplu | Protocol / acces |
|---|---|---|---|
| Ollama | http://localhost:11434/api | llama3 | Ollama nativ; cheia nu este obligatorie |
| LMStudio | http://localhost:1234/v1 | local-model | OpenAI-compatible; cheie opțională, implicit EMPTY |
| OVMS | http://localhost:8000/v3 | openvino-model | OpenAI-compatible; modelul și accesul depind de instalare |
localhost indică dispozitivul cu Obsidian. Telefonul nu accesează astfel serverul calculatorului. Un endpoint LAN cere adresa reală și protecție adecvată. Nu expuneți servere neprotejate în rețele nesigure.
Modele
Ollama listează taguri prin /api/tags, LM Studio poate oferi /v1/models, iar OVMS urmează instalarea. Lista nu dovedește memorie suficientă sau format de ieșire corect. Testați o cerere reală.
Depanare
- Conexiune refuzată: server, adresă de ascultare și port.
- Model absent: descărcare/încărcare și alias exact.
- Autentificare: token real unde se cere, nu automat
EMPTY. - Lent/incomplet: memorie, context și buget; începeți cu o cerere.
- Format greșit: verificați protocolul, promptul și modelul înaintea optimizării lotului.
Când se potrivește
Când limitele datelor, accesul și măsurătorile corespund sarcinii. Pregătiți dependențele înainte de deconectare. Verificați toate rutele; fragmente locale pot ajunge la un LLM cloud. Tavily/DuckDuckGo rămân online, iar exportul poate necesita alte instrumente.