Skip to main content

ספקי LLM

💡TL;DR

Notemd תומך ב-36 ספקי LLM ב-4 סוגי תעבורה. כל הקריאות API משתמשות ב-HTTP גולמי (בלי SDKs) עם ניסיונות חוזרים אוטומטיים, חלופת תעבורה ואחסון תגובות ל-5 דקות. בחירת מודל לכל משימה מאפשרת להשתמש במודלים זולים לשליפת רעיונות ובמודלים חזקים למחקר. אין צורך במפתח API עבור ספקים מקומיים (Ollama, LMStudio).

זהו חלק מהObsidian מדריך ניהול ידע AI.

קטגוריות של ספקים

ספקי ענן

ספקבסיס URL ברירת מחדלמודל ברירת המחדלטמפרטורה
DeepSeekapi.deepseek.comdeepseek-v4-pro0.5
OpenAIapi.openai.com/v1gpt-4o0.5
Anthropicapi.anthropic.comclaude-3-5-sonnet-202406200.5
Googlegenerativelanguage.googleapis.com/v1gemini-2.0-flash-exp0.5
Mistralapi.mistral.ai/v1mistral-large-latest0.5
xAIapi.x.ai/v1grok-40.7
Cerebrasapi.cerebras.ai/v1gpt-oss-120b0.5
Fireworksapi.fireworks.ai/inference/v1kimi-k2p50.5
Nebiusapi.studio.nebius.com/v1openai/gpt-oss-120b0.3

ספקי שער/פרוקסי

ספקבסיס URL ברירת מחדלמודל ברירת המחדלהערות
OpenRouteropenrouter.ai/api/v1anthropic/claude-3.7-sonnetמוסיף כותרות HTTP-Referer + X-Title
GitHub Modelsmodels.github.ai/inferencegpt-4o-miniמוסיף כותרת X-GitHub-Api-Version
AIHubMixaihubmix.com/v1gpt-4o-miniמוסיף כותרת APP-Code
PPIOapi.ppinfra.com/v3/openaiqwen/qwen3-32b
Hugging Facerouter.huggingface.co/v1openai/gpt-oss-120b
Vercel AI Gatewayai-gateway.vercel.sh/v1anthropic/claude-sonnet-4.5
Requestyrouter.requesty.ai/v1anthropic/claude-3-7-sonnet-latest
Togetherapi.together.xyz/v1meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo
LiteLLMlocalhost:4000/v1your-proxy-modelמפתח API אופציונלי
New APIlocalhost:3000/v1gpt-4.1מפתח API אופציונלי
OpenAI Compatible(user-configured)your-model-idקצה מותאם אישית

ספקים בסין

ספקבסיס ברירת המחדל URLמודל ברירת המחדלהערות
Qwendashscope.aliyuncs.com/compatible-mode/v1qwen3-235b-a22bAlibaba DashScope
Qwen Codedashscope.aliyuncs.com/compatible-mode/v1qwen3-coder-plusממוקד קידוד
Doubaoark.cn-beijing.volces.com/api/v3(נדרש מזהה קצה)ByteDance Volcengine
Moonshotapi.moonshot.cn/v1kimi-k2-0905-previewKimi
Xiaomi MiMoapi.xiaomimimo.com/v1mimo-v2.5-pro
GLMopen.bigmodel.cn/api/paas/v4glm-5קצה Zhipu, סין
Z AIapi.z.ai/api/paas/v4glm-5קצה Zhipu, בינלאומי
MiniMaxapi.minimaxi.com/v1MiniMax-M2.7
Baidu Qianfanqianfan.baidubce.com/v2ernie-4.5-turbo-32k
SiliconFlowapi.siliconflow.cn/v1Qwen/QwQ-32Bפלטפורמת אחסון מודלים
Huawei Cloud MaaSapi.modelarts-maas.com/v1DeepSeek-V3

Doubao דורש מזהה קצה Ark (פורמט: ep-xxxxxxxx-xxxx-xxxx). יש להחליף את המקום התופס הברירתי.

ספקים מקומיים

ספקבסיס ברירת המחדל URLמודל ברירת המחדלהערות
Ollamalocalhost:11434/apillama3אין מפתח API. שידור NDJSON. גילוי מודלים דרך /api/tags
LMStudiolocalhost:1234/v1local-modelשולח "EMPTY" כטוקן בארר. גילוי תואם OpenAI
OVMSlocalhost:8000/v3openvino-modelOpenVINO Model Server
Azure OpenAI(מוגדר על ידי המשתמש)gpt-4oשם ההפצה ב- URL. כותרת api-key

בחירת מודל למשימה

Notemd תומך בספק ובמודל עצמאיים לכל משימה. הפעלה באמצעות useMultiModelSettings: true.

משימות זמינות

משימהמפתח הגדרותספק ברירת המחדל
הוספת לינקים (הכנסת לינק wiki)addLinksProvider / addLinksModelDeepSeek
מחקר (חיפוש אינטרנט + סיכום)researchProvider / researchModelDeepSeek
יצירה מהכותרתgenerateTitleProvider / generateTitleModelDeepSeek
תרגוםtranslateProvider / translateModelDeepSeek
ייצור דיאגרמותsummarizeToMermaidProvider / ModelDeepSeek
שליפת רעיונותextractConceptsProvider / ModelDeepSeek
שליפת טקסט מקוריextractOriginalTextProvider / ModelDeepSeek

סדר הפתרון

  1. אם useMultiModelSettings פעיל → השתמש בספק ובמודל הספציפיים למשימה
  2. אם עריכת מודל המשימה ריקה → חזור למודל הברירת המחדל של הספק
  3. אם ספק המשימה בלתי תקין → חזור ל- activeProvider הגלובלי
  4. אם useMultiModelSettings כבוי → כל המשימות משתמשות ב-activeProvider הגלובלי

תצורות מומלצות

# Researcher: power for research, cheap for everything else
activeProvider: DeepSeek
extractConceptsProvider: DeepSeek
researchProvider: OpenAI # GPT-4o for better research quality
summarizeToMermaidProvider: DeepSeek

# Privacy-first: local only
activeProvider: Ollama
addLinksProvider: Ollama
extractConceptsProvider: Ollama

# Budget bilingual
activeProvider: DeepSeek
translateProvider: Google # Gemini Flash for translation
researchProvider: SiliconFlow # Cheaper China-based routing

ארכיטקטורת הקריאה של API

שכבות ההעברה

  1. Obsidian requestUrl — ראשית (מובנה, עובד על כל הפלטפורמות)
  2. Desktop HTTP — מודולי Node.js http/https (שידור + בקשות ארוכות)
  3. Web fetch — חלופה כאשר מודולי Node.js אינם זמינים

התוסף מעביר אוטומטית בין שכבות ההעברה במקרה של שגיאות רשת זמניות.

לוגיקת ניסיונות מחדש

  • מצב רגיל (enableStableApiCall: false): ניסיון אחד. במקרה של כישלון זמני, הוא מעלה אוטומטית לניסיון חוזר יציב.
  • מצב ניסיונות מחדש יציב (enableStableApiCall: true): עד 4 ניסיונות (1 + 3 ניסיונות חוזרים) עם מרווחים של 5 שניות.
  • שגיאות זמניות הגורמות לניסיון מחדש: err_connection_closed, err_connection_reset, err_timed_out, econnreset, econnaborted, etimedout, socket hang up, network request failed
  • לא ניתנים לניסיון מחדש: HTTP 400, 401, 403, 404

אחסון בקשות בזיכרון

מאגר זיכרון LRU של 5 דקות המבוסס על מפתח של ספק + מודל + טמפרטורה + הודעה + תוכן. בקשות זהות שמגיעות לאחר 5 דקות מקבלות את התוצאות המאוחסנות מיד.

טיפול במודלי החשיבה

מודלים שאינם תומכים בתפקיד system (DeepSeek R1, OpenAI o1/o3/o4/gpt-5) משלבים אוטומטית את ההודעות של המערכת והמשתמש להודעת משתמש אחת.

DeepSeek-specific: thinkingEnabled מוסיף { thinking: { type: 'enabled' } } לבקשה. reasoningEffort (נמוך/בינוני/גבוה) נמסר כ- reasoning_effort. בודק שמספר הטוקנים המרבי בפלט ≥ 8000 כאשר החשיבה מופעלת.

הערכת טוקנים

estimateTokens(text): Math.ceil(text.length / 4) — הירור של 4 אותיות לכל טוקן. משמש לאכיפת maxResearchContentTokens לפני שליחה ל- LLM.

אין מעקב אחר עלויות מיושם.

גילוי מודלים

מצבספקיםקצה
ollama-tagsOllama/api/tags
google-modelsGoogleרשימת המודלים API
anthropic-modelsAnthropicרשימת המודלים API
openai-compatible-modelsDeepSeek, Qwen, Mistral, וכו'/v1/models
openrouter-modelsOpenRouterרשימת המודלים API
github-modelsGitHub Modelsהסקה API
noneAzure OpenAIמושבת (דורש שם פריסה)

התחלה מהירה

  1. בחרו ספק — DeepSeek (סין), OpenAI (בינלאומי), או Ollama (מקומי/חינמי)
  2. הזינו מפתח API — הגדרות → Notemd → ספק → מפתח API
  3. בדקו חיבור — לחצו על כפתור הבדיקה
  4. אופציונלי: מודלים לכל משימה — הפעילו useMultiModelSettings והגדירו אותו בנפרד

עבור Ollama: אין צורך במפתח API. רק ודאו שollama serve פועל.


צעדים באופק