Modele lokalne
Przygotowanie
Zainstaluj serwer/model dla Ollama lub załaduj model i uruchom API w LM Studio. Osobno przygotuj wdrożenie OVMS. Notemd nie instaluje modeli ani nie uruchamia serwerów. Wybierz dokładną nazwę/profil i sprawdź połączenie oraz zadanie.
Endpoint i uwierzytelnianie
| Profil | Bazowy URL | Model przykładowy | Protokół / dostęp |
|---|---|---|---|
| Ollama | http://localhost:11434/api | llama3 | Natywne Ollama; klucz niewymagany |
| LMStudio | http://localhost:1234/v1 | local-model | OpenAI-compatible; klucz opcjonalny, początkowo EMPTY |
| OVMS | http://localhost:8000/v3 | openvino-model | OpenAI-compatible; model i dostęp zależą od wdrożenia |
localhost oznacza urządzenie z Obsidianem. Telefon nie dotrze nim do komputera. Endpoint w LAN wymaga faktycznego adresu i właściwego zabezpieczenia. Nie wystawiaj niechronionego serwera do niezaufanej sieci.
Modele
Ollama pokazuje tagi przez /api/tags, LM Studio może udostępniać /v1/models, OVMS zależy od wdrożenia. Lista nie dowodzi dostatecznej pamięci ani poprawnego formatu wyniku. Sprawdź rzeczywiste żądanie.
Problemy
- Odmowa połączenia: serwer, adres nasłuchiwania i port.
- Brak modelu: pobranie/załadowanie i dokładny alias.
- Uwierzytelnianie: prawdziwy token, jeśli wymagany, nie bezrefleksyjnie
EMPTY. - Wolno/niepełnie: pamięć, kontekst i budżet; zacznij od jednego żądania.
- Błędny format: sprawdź protokół, prompt i model przed strojeniem partii.
Kiedy wybrać
Gdy granice danych, dostępność i pomiary pasują do potrzeb. Przygotuj zależności przed odłączeniem sieci. Sprawdź każdą trasę zadania; lokalne fragmenty mogą trafić do LLM w chmurze. Tavily/DuckDuckGo pozostają online, a eksport natywny może wymagać osobnych narzędzi.