GPT
E

EXAONE-Deep-2.4B

קוד פתוח

LGAI-EXAONEother2025-03-12

  • transformers
  • safetensors
  • exaone
  • text-generation
  • lg-ai

מודל הסקת מסקנות קטן במיוחד שמתמחה במתמטיקה ובקוד. הוא נבנה כדי לתת תוצאות חשיבה עמוקה על חומרה מקומית בסיסית.

  • 2.4Bפרמטרים
  • 32,768טוקנים בהקשר
  • 4.5 GBמשקל הקבצים
  • 933הורדות בחודש

מה זה

מדובר במודל שפת חשיבה קומפקטי מבית LG עם 2.4 מיליארד פרמטרים, שתומך רשמית באנגלית ובקוריאנית. במקום לענות מיד, הוא מייצר שרשרת מחשבה ארוכה בין תגיות ייעודיות לפני הפלט הסופי. הוא שונה מרוב המודלים הזעירים בכך שהוא אומן ספציפית למשימות הגיון כבדות, ומציע חלון הקשר של 32,768 טוקנים.

במבחני ביצועים מול דגמים מקבילים כמו DeepSeek-R1-Distill-Qwen-1.5B, הוא מציג פער ניכר. במבחן MATH-500 הוא מגיע ל־92.3 אחוזי הצלחה לעומת 83.9, ובמבחן התכנות Live Code Bench הוא עומד על 46.6 אחוזים לעומת 16.9 בלבד. המספרים האלה מראים שהוא מחזיק יכולת הבנה ופתרון בעיות שקשה למצוא במשקל נוצה כזה.

מתאים ל

  • פתרון בעיות מתמטיקה

    הוא מגיע ל־92.3 אחוזים ב־MATH-500 ומתאים לעיבוד תרגילים מורכבים במחשב מקומי.

  • כתיבת קוד על חומרה חלשה

    התוצאות שלו ב־Live Code Bench מאפשרות להשתמש בו להשלמת קוד במכשיר קצה ללא שרת.

  • מחקר והסקה לוגית

    חלון של כ־32 אלף טוקנים מאפשר לו לפרק בעיות הגיון מורכבות בעזרת שרשרת מחשבה ארוכה.

איפה זה נופל

היוצרים מבהירים שהמודל מוגבל לשפות אנגלית וקוריאנית, כך שעברית כלל לא נתמכת כאן באופן רשמי. הוא אינו מעודכן במידע אקטואלי, ועלול לפלוט שגיאות תחביריות, הטיות או מידע פוגעני. הכרטיס מזהיר במפורש שהפלט עלול להיות שגוי או סותר אם לא מכוונים אותו נכון עם הנחיות פתרון מדויקות צעד אחר צעד.

אותה משפחה

EXAONE-Deep יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם כדאי להשתמש בו ליישום בעברית?

לא. המודל אומן רשמית רק על אנגלית וקוריאנית. ניסיון להריץ עליו שאלות בעברית יביא לפלטים משובשים או חוסר הבנה מוחלט.

האם אפשר להשתמש במודל הזה בתוך מוצר מסחרי?

אי אפשר. הרישיון כולל הגבלת NC מפורשת, כלומר שימוש לא מסחרי. לחברות שמחפשות כלי לייצור הכנסה הוא לא רלוונטי.

למה התשובות שלו יוצאות ארוכות במיוחד?

הוא מתוכנן לייצר תהליך חשיבה שלם בין תגיות מחשבה לפני שהוא מציג תשובה. אם תמחקו את התגיות הללו, איכות התשובה שלו תרד משמעותית.

איך מריצים

המשקל הכולל של הקבצים עומד על כ־4.5 גיגה בייט בדיוק bfloat16, כך שכרטיס מסך ביתי פשוט עם 6 עד 8 גיגה בייט של זיכרון יריץ אותו בקלות. המפתחים מספקים גרסאות מכומתות בפורמטים כמו AWQ ו־GGUF, וקיימת תמיכה מובנית בכלים כמו Ollama, llama.cpp ו־vLLM. אם יש לכם מחשב נייד מודרני, תוכלו להריץ אותו ישירות עליו ללא שרתים חיצוניים.

המפתחים מדגישים שהרצה תקינה מחייבת שימוש בתבנית השיחה המקורית שפותחת תגית מחשבה, וממליצים להימנע משימוש בפרומפט מערכת. במענה לשיחות מתמשכות חובה לנקות את שלבי המחשבה הקודמים כדי לא לסתום את הזיכרון. במקרים שבהם המשימה דורשת ידע כללי רחב ולא הסקת מסקנות מתמטית, עדיף פשוט לקרוא ל־API חיצוני חזק יותר.

from transformers import pipeline

pipe = pipeline("text-generation", model="LGAI-EXAONE/EXAONE-Deep-2.4B")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־EXAONE AI Model License Agreement 1.1 - NC, והאותיות בסוף אומרות הכל: שימוש לא מסחרי בלבד. אי אפשר לשלב אותו במוצר שמייצר הכנסה, והוא מיועד למחקר, ניסויים פנימיים ופיתוח אישי בלבד.

הרישיון המלא בעמוד המודל ↗