GPT
E

EXAONE-4.0-32B

קוד פתוח

LGAI-EXAONEother2025-07-11

  • transformers
  • safetensors
  • exaone4
  • text-generation
  • lg-ai

שילוב של חשיבה עמוקה והפעלת כלים במודל פתוח של 32 מיליארד פרמטרים. פתרון חזק למשימות קוד ומתמטיקה מורכבות באנגלית, קוריאנית וספרדית.

  • 32Bפרמטרים
  • 131,072טוקנים בהקשר
  • 59.6 GBמשקל הקבצים
  • 21,467הורדות בחודש

מה זה

המודל מחבר בין מצב עבודה רגיל לבין מצב חשיבה מעמיקה, שבו הוא מייצר שלבי חשיבה פנימיים לפני מתן התשובה. השליטה במצב הזה נעשית באמצעות דגל בטוקנייזר, שפותח תגית ייעודית לתהליך ההיסק. הארכיטקטורה כוללת תשומת לב היברידית שמשלבת חלון מקומי וגלובלי ביחס של שלוש לאחת, לצד סידור מחדש של שכבות הנורמליזציה כדי לשפר דיוק במשימות קצה.

במדדי ביצועים המודל מציג תוצאות גבוהות במיוחד ביחס למשקל שלו. במבחני מתמטיקה כמו AIME 2025 הוא מגיע לציון 85.3 במצב חשיבה, ועוקף מודלים גדולים ממנו בהרבה. גם במבחני כתיבת קוד כמו LiveCodeBench הוא עומד על 72.6, ומציג יכולות הפעלת כלים ואוטומציה ברמה תחרותית מאוד מול משקלי 32B אחרים בשוק.

מתאים ל

  • פתרון בעיות מתמטיקה

    מצב החשיבה משיג 85.3 ב־AIME 2025, תוצאה שמקבילה למודלים ענקיים.

  • פיתוח ובדיקת קוד

    המודל מוביל בבנצ'מרקים של LiveCodeBench עם תוצאות חזקות למשקלו.

  • סוכני אוטומציה באנגלית

    תמיכה מובנית בקריאת כלים בתוך מנועי vLLM עם פרסר ייעודי.

איפה זה נופל

המודל אומן ונבדק בשלוש שפות בלבד: אנגלית, קוריאנית וספרדית. עברית אינה ברשימת השפות הנתמכות, ולכן אין לצפות לתחביר תקין או להבנה של טקסט מקומי. בנוסף, מצב החשיבה רגיש מאוד לפרמטרי דגימה כמו טמפרטורה, ושימוש בהגדרות לא מדויקות פוגע באיכות הפלט. ביצועי הפעלת הכלים במצב הרגיל חלשים משמעותית ממצב החשיבה, עם ציון של 25.5 בלבד במבחן Tau-Bench למשלחות תעופה.

אותה משפחה

EXAONE-4.0 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים לעיבוד טקסטים בעברית?

לא. המודל אומן ותועד עבור אנגלית, קוריאנית וספרדית בלבד. עיבוד שפות שאינן נתמכות רשמית עלול להניב שיבושים כבדים והזיות.

איך מפעילים את מצב החשיבה בקוד?

מעבירים את הארגומנט enable_thinking שווה ל־True אל הטוקנייזר בזמן יצירת התבנית. הפעולה הזו פותחת בלוק חשיבה עם תגית think ומפעילה את מנגנון ההיסק המעמיק.

איך מריצים

המשקל הגולמי עומד על 59.6 ג'יגה בייט בפורמט bfloat16, כך שהרצה מקומית מלאה דורשת לפחות שני כרטיסי 4090 או כרטיס A100 עם 80 ג'יגה זיכרון כדי להשאיר מקום לטוקנים ולהקשר הארוך. ספריית transformers תומכת בו החל מגרסה 4.54.0, ויש תמיכה רשמית בשרתי vLLM מגרסה 0.10.0 וכן בבנייה מותאמת של TensorRT-LLM.

אם אין לכם שרת ייעודי עם מספיק זיכרון וידאו, שווה להשתמש בנקודות קצה כמו FriendliAI שמציעות גישה ישירה למודל ללא צורך בתחזוקת חומרה. מנועי הסקה אחרים כמו sglang עדיין לא תומכים בו באופן רשמי.

from transformers import pipeline

pipe = pipeline("text-generation", model="LGAI-EXAONE/EXAONE-4.0-32B")
print(pipe("שלום"))

הרישיון

הרישיון מסומן בתור other ואינו רישיון קוד פתוח סטנדרטי כמו Apache או MIT. המפתחים פרסמו עדכון לתנאי הרישיון ומאפשרים גישה מסחרית דרך שירות ענן כמו FriendliAI, אך לפני שילוב ישיר של המשקלים בקוד או הפצה במוצר מסחרי עצמאי חובה לקרוא את קובץ הרישיון המקורי ולבדוק את תנאי ההפצה המדויקים.

הרישיון המלא בעמוד המודל ↗