דלג לתוכן העיקרי

ספקי LLM

💡TL;DR
יש 36 פרופילים בחמש משפחות: OpenAI-compatible, Anthropic, Google, Azure OpenAI ו־Ollama. בחרו פרוטוקול מתאים לכתובת, מידע שמותר לשלוח ומודל נגיש. ערכי ההתחלה הם דוגמאות ניתנות לשינוי, לא הבטחת זמינות עדכנית.

קטגוריות​

הטבלאות משקפות את המרשם. שמרו סכמת URL ונתיב מלא; החליפו מצייני מקום בפריסה שלכם. הספק קובע הרשאות, מחירים והפסקת תמיכה במודלים.

ענן​

ספקמודל התחלתיכתובת בסיס
DeepSeekdeepseek-v4-prohttps://api.deepseek.com
Qwenqwen3-235b-a22bhttps://dashscope.aliyuncs.com/compatible-mode/v1
Qwen Codeqwen3-coder-plushttps://dashscope.aliyuncs.com/compatible-mode/v1
Doubaoep-xxxxxxxxxxxxxxxxhttps://ark.cn-beijing.volces.com/api/v3
Moonshotkimi-k2-0905-previewhttps://api.moonshot.cn/v1
Xiaomi MiMomimo-v2.5-prohttps://api.xiaomimimo.com/v1
GLMglm-5https://open.bigmodel.cn/api/paas/v4
Z AIglm-5https://api.z.ai/api/paas/v4
MiniMaxMiniMax-M2.7https://api.minimaxi.com/v1
Baidu Qianfanernie-4.5-turbo-32khttps://qianfan.baidubce.com/v2
SiliconFlowQwen/QwQ-32Bhttps://api.siliconflow.cn/v1
Huawei Cloud MaaSDeepSeek-V3https://api.modelarts-maas.com/v1
OpenAIgpt-4ohttps://api.openai.com/v1
Anthropicclaude-3-5-sonnet-20240620https://api.anthropic.com
Googlegemini-2.0-flash-exphttps://generativelanguage.googleapis.com/v1
Mistralmistral-large-latesthttps://api.mistral.ai/v1
Azure OpenAIgpt-4oהגדירו את כתובת משאב Azure שלכם
xAIgrok-4https://api.x.ai/v1
Groqmoonshotai/kimi-k2-instruct-0905https://api.groq.com/openai/v1
Togethermeta-llama/Meta-Llama-3.1-70B-Instruct-Turbohttps://api.together.xyz/v1
Fireworksaccounts/fireworks/models/kimi-k2p5https://api.fireworks.ai/inference/v1
Nebiusopenai/gpt-oss-120bhttps://api.studio.nebius.com/v1
Cerebrasgpt-oss-120bhttps://api.cerebras.ai/v1

שערים ושרתי תיווך​

ספקמודל התחלתיכתובת בסיס
OpenRouteranthropic/claude-3.7-sonnethttps://openrouter.ai/api/v1
AIHubMixgpt-4o-minihttps://aihubmix.com/v1
GitHub Modelsgpt-4o-minihttps://models.github.ai/inference
PPIOqwen/qwen3-32bhttps://api.ppinfra.com/v3/openai
New APIgpt-4.1http://localhost:3000/v1
LiteLLMyour-proxy-modelhttp://localhost:4000/v1
Hugging Faceopenai/gpt-oss-120bhttps://router.huggingface.co/v1
Vercel AI Gatewayanthropic/claude-sonnet-4.5https://ai-gateway.vercel.sh/v1
Requestyanthropic/claude-3-7-sonnet-latesthttps://router.requesty.ai/v1
OpenAI Compatibleyour-model-idhttps://your-openai-compatible-endpoint/v1

מקומי​

ספקמודל התחלתיכתובת בסיס
OVMSopenvino-modelhttp://localhost:8000/v3
LMStudiolocal-modelhttp://localhost:1234/v1
Ollamallama3http://localhost:11434/api

ספקים סיניים​

ראו הגדרה אזורית. הקטגוריה אינה מבטיחה גישה גאוגרפית או איכות בסינית. התאימו אזור חשבון, נקודת קצה והרשאות מודל.

בחירה לכל משימה​

useMultiModelSettings מאפשר ספקים ומודלים נפרדים; אחרת משתמשים ב־activeProvider. שדה מודל ריק משתמש במודל הספק. בחירות ספק שמורות ולא תקינות מותאמות לספק הפעיל בעת טעינה.

משימההגדרת ספקשדה מודל
קישוריםaddLinksProvideraddLinksModel
יצירה מכותרתgenerateTitleProvidergenerateTitleModel
סיכום מחקרresearchProviderresearchModel
תרגוםtranslateProvidertranslateModel
מושגיםextractConceptsProviderextractConceptsModel
סיכום MermaidsummarizeToMermaidProvidersummarizeToMermaidModel
טקסט מקוריextractOriginalTextProviderextractOriginalTextModel

הספק הפעיל וספקי המשימות השמורים מתחילים ב־DeepSeek. שינוי הספק הפעיל בלבד אינו מחליף ניתוב משימות שכבר הופעל. בדקו לפני שימוש פרטי.

ארכיטקטורת בקשות​

שכבות תעבורה​

Notemd משתמש בבקשות Obsidian וב־fallback שמכיר את הפרוטוקול. מחשב יכול להשתמש בזרמי Node HTTP, וסביבות אחרות ב־fetch. Claude דרך שער OpenAI-compatible משתמש בפרופיל השער ולא ב־API המקורי של Anthropic.

ניסיונות חוזרים​

מצב יציב כבוי; ברירות המחדל הרלוונטיות הן שלושה ניסיונות חוזרים בהפרש חמש שניות. שגיאות זמניות עשויות לעבור במסלול fallback/חזרה משותף. יש לתקן הרשאות והגדרות מודל בנפרד. בקשות ארוכות עדיין יכולות להיכשל במכסות, מגבלות או זמן קצוב.

מטמון תשובות​

מטמון זיכרון מוגבל יכול להשתמש שוב בתשובות שהצליחו. זהות כוללת כתובת, מודל, פרמטרי יצירה, הנחיה ותוכן. זה אינו אחסון קבוע או מד עלות ואינו מבטיח חזרה חינמית.

מודלים עם חשיבה​

Reasoning/thinking כפופים לכללי הפרופיל והמודל. אל תעתיקו פרמטרים ייעודיים לפרוטוקול בין שירותים. בדקו משימה אמיתית; מודל עשוי לדחות הגדרות tokens, דגימה או חשיבה.

הערכת tokens​

אורך טקסט ומגבלת פלט אינם ספירת tokens מדויקת של הספק. השתמשו בצריכה אמיתית להערכת חיוב. אין מחשבון עלות כללי שמבטיח דיוק.

מציאת מודלים​

Fetch models פועל בפרופילים תומכים. פריסות מסוימות דורשות מזהה ידני. הרשאות רשימה ויצירה נפרדות. Test connection יכול להצליח על רשימה בלבד ב־models-then-chat; chat-only מבצע יצירה קצרה. בדקו משימה ופורמט פלט אמיתיים.

  • Anthropic ו־Google מגלים מודלים דרך ה־API שלהם.
  • Ollama מציג תגיות שהורדו, LM Studio מודלים בשרת.
  • Azure דורש deployment וגרסת API.
  • שערים יכולים לחסום רשימות ולאפשר יצירה עם מזהה מפורש.

התחלה​

  1. בחרו פרופיל נכון ב־Settings → Notemd.
  2. הזינו כתובת, מפתח ומודל/deployment זמין.
  3. בדקו חיבור והערת ניסיון.
  4. בדקו פלט ודוח לפני אצוות או ניתוב לפי משימה.

שרת ומודל מקומיים חייבים להיות מוכנים. Ollama אינו דורש מפתח; LM Studio מקבל מפתח אופציונלי ומתחיל ב־EMPTY. השתמשו באסימון אמיתי אם נדרש. LLM מקומי אינו הופך חיפוש רשת למנותק.

המשך​