Hoppa till huvudinnehållet

Lokala modeller

💡TL;DR
En aktiv server kan köra uppgifter på din enhet. Förbered modell och protokoll. Webbforskning, externa endpoints, beroendeinstallation och separat molnstyrda uppgifter blir inte offline.

Förberedelse​

Installera server/modell för Ollama eller ladda modell och starta API i LM Studio. Förbered OVMS-deployment separat. Notemd installerar inte modeller och startar inte servrarna. Ange exakt namn/profil och testa anslutning samt uppgift.

Endpoint och autentisering​

ProfilBas-URLExempelmodellProtokoll / åtkomst
Ollamahttp://localhost:11434/apillama3Native Ollama; ingen obligatorisk nyckel
LMStudiohttp://localhost:1234/v1local-modelOpenAI-kompatibel; valfri nyckel, initialt EMPTY
OVMShttp://localhost:8000/v3openvino-modelOpenAI-kompatibel; deploymenten bestämmer modell och åtkomst

localhost avser Obsidian-enheten. Telefonen når inte datorn med den adressen. LAN kräver verklig adress och lämpligt skydd. Exponera inte oskyddade servrar mot opålitliga nätverk.

Modeller​

Ollama listar taggar via /api/tags; LM Studio kan erbjuda /v1/models; OVMS följer deploymenten. Lista bevisar inte tillräckligt minne eller rätt svarformat. Testa verkligt anrop.

Problem​

  • Anslutning nekas: server, lyssningsadress och port.
  • Modell saknas: hämta/ladda och kontrollera alias.
  • Autentisering: verklig token där den krävs, inte slentrianmässigt EMPTY.
  • Långsamt/ofullständigt: minne, kontext och budget; börja med ett anrop.
  • Fel format: kontrollera protokoll, prompt och modell före batchjustering.

När profilen passar​

När datagräns, tillgänglighet och uppmätt resultat passar. Förbered beroenden före nätverksfrånkoppling. Kontrollera varje uppgiftsväg; lokala utdrag kan skickas till moln-LLM. Tavily/DuckDuckGo är online och native export kan behöva separata verktyg.

Nästa steg​