Przejdź do głównej treści

Modele lokalne

💡TL;DR
Działający serwer może wykonywać zadania na Twoim urządzeniu. Najpierw przygotuj model i protokół. Badanie internetu, zewnętrzne endpointy, instalowanie zależności i osobne zadania chmurowe nie stają się offline.

Przygotowanie​

Zainstaluj serwer/model dla Ollama lub załaduj model i uruchom API w LM Studio. Osobno przygotuj wdrożenie OVMS. Notemd nie instaluje modeli ani nie uruchamia serwerów. Wybierz dokładną nazwę/profil i sprawdź połączenie oraz zadanie.

Endpoint i uwierzytelnianie​

ProfilBazowy URLModel przykładowyProtokół / dostęp
Ollamahttp://localhost:11434/apillama3Natywne Ollama; klucz niewymagany
LMStudiohttp://localhost:1234/v1local-modelOpenAI-compatible; klucz opcjonalny, początkowo EMPTY
OVMShttp://localhost:8000/v3openvino-modelOpenAI-compatible; model i dostęp zależą od wdrożenia

localhost oznacza urządzenie z Obsidianem. Telefon nie dotrze nim do komputera. Endpoint w LAN wymaga faktycznego adresu i właściwego zabezpieczenia. Nie wystawiaj niechronionego serwera do niezaufanej sieci.

Modele​

Ollama pokazuje tagi przez /api/tags, LM Studio może udostępniać /v1/models, OVMS zależy od wdrożenia. Lista nie dowodzi dostatecznej pamięci ani poprawnego formatu wyniku. Sprawdź rzeczywiste żądanie.

Problemy​

  • Odmowa połączenia: serwer, adres nasłuchiwania i port.
  • Brak modelu: pobranie/załadowanie i dokładny alias.
  • Uwierzytelnianie: prawdziwy token, jeśli wymagany, nie bezrefleksyjnie EMPTY.
  • Wolno/niepełnie: pamięć, kontekst i budżet; zacznij od jednego żądania.
  • Błędny format: sprawdź protokół, prompt i model przed strojeniem partii.

Kiedy wybrać​

Gdy granice danych, dostępność i pomiary pasują do potrzeb. Przygotuj zależności przed odłączeniem sieci. Sprawdź każdą trasę zadania; lokalne fragmenty mogą trafić do LLM w chmurze. Tavily/DuckDuckGo pozostają online, a eksport natywny może wymagać osobnych narzędzi.

Dalej​