মূল বিষয়বস্তুতে যান

স্থানীয় মডেল

💡TL;DR
চালু server আপনার device-এ inference করতে পারে। Model ও protocol আগে প্রস্তুত করুন। Web research, remote endpoints, dependency install ও আলাদা cloud tasks offline হয় না।

প্রস্তুতি​

Ollama-তে server/model install করুন; LM Studio-তে model load করে API start করুন। OVMS deployment আগে তৈরি করুন। Notemd model install বা server start করে না। Exact profile/name-এ connection ও task test করুন।

Endpoint ও authentication​

Profileপ্রাথমিক URLউদাহরণ modelProtocol / access
Ollamahttp://localhost:11434/apillama3Native Ollama; key আবশ্যিক নয়
LMStudiohttp://localhost:1234/v1local-modelOpenAI-compatible; optional key, শুরুতে EMPTY
OVMShttp://localhost:8000/v3openvino-modelOpenAI-compatible; deployment model ও access সেট করুন

localhost Obsidian device-কেই বোঝায়। ফোনের loopback কম্পিউটারের model পায় না। LAN-এ সঠিক address ও authentication দিন; অরক্ষিত server অবিশ্বস্ত network-এ খুলবেন না।

মডেল​

Ollama /api/tags-এ pulled tags, LM Studio /v1/models দিতে পারে। OVMS deployment rules অনুসরণ করে। তালিকায় থাকা যথেষ্ট memory বা structured output প্রমাণ করে না। বাস্তব request test করুন।

সমস্যা​

  • Connection refused: server, listen address ও port।
  • Model নেই: download/load ও exact alias।
  • Authentication: প্রয়োজনমতো বাস্তব token; EMPTY ধরে নয়।
  • Slow/incomplete: memory, context ও budget, আগে এক request।
  • ভুল format: batch tuning-এর আগে protocol, prompt ও model দেখুন।

কখন ব্যবহার করবেন​

Data boundary, availability ও measured output উপযুক্ত হলে নিন। Network ছাড়ার আগে model/dependencies প্রস্তুত করুন। সব task route দেখুন; local excerpts cloud LLM-এও যেতে পারে। Tavily/DuckDuckGo online থাকে, native exporters-এর আলাদা tools লাগতে পারে।

পরবর্তী ধাপ​