ספקי LLM
קטגוריות
הטבלאות משקפות את המרשם. שמרו סכמת URL ונתיב מלא; החליפו מצייני מקום בפריסה שלכם. הספק קובע הרשאות, מחירים והפסקת תמיכה במודלים.
ענן
| ספק | מודל התחלתי | כתובת בסיס |
|---|---|---|
| DeepSeek | deepseek-v4-pro | https://api.deepseek.com |
| Qwen | qwen3-235b-a22b | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Qwen Code | qwen3-coder-plus | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| Doubao | ep-xxxxxxxxxxxxxxxx | https://ark.cn-beijing.volces.com/api/v3 |
| Moonshot | kimi-k2-0905-preview | https://api.moonshot.cn/v1 |
| Xiaomi MiMo | mimo-v2.5-pro | https://api.xiaomimimo.com/v1 |
| GLM | glm-5 | https://open.bigmodel.cn/api/paas/v4 |
| Z AI | glm-5 | https://api.z.ai/api/paas/v4 |
| MiniMax | MiniMax-M2.7 | https://api.minimaxi.com/v1 |
| Baidu Qianfan | ernie-4.5-turbo-32k | https://qianfan.baidubce.com/v2 |
| SiliconFlow | Qwen/QwQ-32B | https://api.siliconflow.cn/v1 |
| Huawei Cloud MaaS | DeepSeek-V3 | https://api.modelarts-maas.com/v1 |
| OpenAI | gpt-4o | https://api.openai.com/v1 |
| Anthropic | claude-3-5-sonnet-20240620 | https://api.anthropic.com |
gemini-2.0-flash-exp | https://generativelanguage.googleapis.com/v1 | |
| Mistral | mistral-large-latest | https://api.mistral.ai/v1 |
| Azure OpenAI | gpt-4o | הגדירו את כתובת משאב Azure שלכם |
| xAI | grok-4 | https://api.x.ai/v1 |
| Groq | moonshotai/kimi-k2-instruct-0905 | https://api.groq.com/openai/v1 |
| Together | meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo | https://api.together.xyz/v1 |
| Fireworks | accounts/fireworks/models/kimi-k2p5 | https://api.fireworks.ai/inference/v1 |
| Nebius | openai/gpt-oss-120b | https://api.studio.nebius.com/v1 |
| Cerebras | gpt-oss-120b | https://api.cerebras.ai/v1 |
שערים ושרתי תיווך
| ספק | מודל התחלתי | כתובת בסיס |
|---|---|---|
| OpenRouter | anthropic/claude-3.7-sonnet | https://openrouter.ai/api/v1 |
| AIHubMix | gpt-4o-mini | https://aihubmix.com/v1 |
| GitHub Models | gpt-4o-mini | https://models.github.ai/inference |
| PPIO | qwen/qwen3-32b | https://api.ppinfra.com/v3/openai |
| New API | gpt-4.1 | http://localhost:3000/v1 |
| LiteLLM | your-proxy-model | http://localhost:4000/v1 |
| Hugging Face | openai/gpt-oss-120b | https://router.huggingface.co/v1 |
| Vercel AI Gateway | anthropic/claude-sonnet-4.5 | https://ai-gateway.vercel.sh/v1 |
| Requesty | anthropic/claude-3-7-sonnet-latest | https://router.requesty.ai/v1 |
| OpenAI Compatible | your-model-id | https://your-openai-compatible-endpoint/v1 |
מקומי
| ספק | מודל התחלתי | כתובת בסיס |
|---|---|---|
| OVMS | openvino-model | http://localhost:8000/v3 |
| LMStudio | local-model | http://localhost:1234/v1 |
| Ollama | llama3 | http://localhost:11434/api |
ספקים סיניים
ראו הגדרה אזורית. הקטגוריה אינה מבטיחה גישה גאוגרפית או איכות בסינית. התאימו אזור חשבון, נקודת קצה והרשאות מודל.
בחירה לכל משימה
useMultiModelSettings מאפשר ספקים ומודלים נפרדים; אחרת משתמשים ב־activeProvider. שדה מודל ריק משתמש במודל הספק. בחירות ספק שמורות ולא תקינות מותאמות לספק הפעיל בעת טעינה.
| משימה | הגדרת ספק | שדה מודל |
|---|---|---|
| קישורים | addLinksProvider | addLinksModel |
| יצירה מכותרת | generateTitleProvider | generateTitleModel |
| סיכום מחקר | researchProvider | researchModel |
| תרגום | translateProvider | translateModel |
| מושגים | extractConceptsProvider | extractConceptsModel |
| סיכום Mermaid | summarizeToMermaidProvider | summarizeToMermaidModel |
| טקסט מקורי | extractOriginalTextProvider | extractOriginalTextModel |
הספק הפעיל וספקי המשימות השמורים מתחילים ב־DeepSeek. שינוי הספק הפעיל בלבד אינו מחליף ניתוב משימות שכבר הופעל. בדקו לפני שימוש פרטי.
ארכיטקטורת בקשות
שכבות תעבורה
Notemd משתמש בבקשות Obsidian וב־fallback שמכיר את הפרוטוקול. מחשב יכול להשתמש בזרמי Node HTTP, וסביבות אחרות ב־fetch. Claude דרך שער OpenAI-compatible משתמש בפרופיל השער ולא ב־API המקורי של Anthropic.
ניסיונות חוזרים
מצב יציב כבוי; ברירות המחדל הרלוונטיות הן שלושה ניסיונות חוזרים בהפרש חמש שניות. שגיאות זמניות עשויות לעבור במסלול fallback/חזרה משותף. יש לתקן הרשאות והגדרות מודל בנפרד. בקשות ארוכות עדיין יכולות להיכשל במכסות, מגבלות או זמן קצוב.
מטמון תשובות
מטמון זיכרון מוגבל יכול להשתמש שוב בתשובות שהצליחו. זהות כוללת כתובת, מודל, פרמטרי יצירה, הנחיה ותוכן. זה אינו אחסון קבוע או מד עלות ואינו מבטיח חזרה חינמית.
מודלים עם חשיבה
Reasoning/thinking כפופים לכללי הפרופיל והמודל. אל תעתיקו פרמטרים ייעודיים לפרוטוקול בין שירותים. בדקו משימה אמיתית; מודל עשוי לדחות הגדרות tokens, דגימה או חשיבה.
הערכת tokens
אורך טקסט ומגבלת פלט אינם ספירת tokens מדויקת של הספק. השתמשו בצריכה אמיתית להערכת חיוב. אין מחשבון עלות כללי שמבטיח דיוק.
מציאת מודלים
Fetch models פועל בפרופילים תומכים. פריסות מסוימות דורשות מזהה ידני. הרשאות רשימה ויצירה נפרדות. Test connection יכול להצליח על רשימה בלבד ב־models-then-chat; chat-only מבצע יצירה קצרה. בדקו משימה ופורמט פלט אמיתיים.
- Anthropic ו־Google מגלים מודלים דרך ה־API שלהם.
- Ollama מציג תגיות שהורדו, LM Studio מודלים בשרת.
- Azure דורש deployment וגרסת API.
- שערים יכולים לחסום רשימות ולאפשר יצירה עם מזהה מפורש.
התחלה
- בחרו פרופיל נכון ב־Settings → Notemd.
- הזינו כתובת, מפתח ומודל/deployment זמין.
- בדקו חיבור והערת ניסיון.
- בדקו פלט ודוח לפני אצוות או ניתוב לפי משימה.
שרת ומודל מקומיים חייבים להיות מוכנים. Ollama אינו דורש מפתח; LM Studio מקבל מפתח אופציונלי ומתחיל ב־EMPTY. השתמשו באסימון אמיתי אם נדרש. LLM מקומי אינו הופך חיפוש רשת למנותק.