GPT
E

EXAONE-4.0-1.2B-GGUF

קוד פתוח

LGAI-EXAONEother2025-07-11

  • transformers
  • gguf
  • lg-ai
  • exaone
  • exaone-4.0

מודל קטן של 1.2 מיליארד פרמטרים שמציע יכולות חשיבה והפעלת כלים על מכשיר הקצה. הוא מתאים למי שמחפש ריצה מקומית קלילה באנגלית, קוריאנית או ספרדית.

  • 7.0 GBמשקל הקבצים
  • 2,250הורדות בחודש
  • 48לייקים

מה זה

מדובר בגרסת GGUF של המודל הקטן בסדרת EXAONE 4.0 של חברת LG. הוא כולל 1.07 מיליארד פרמטרים ללא שכבות הוטמעות, 30 שכבות, וחלון הקשר של 65,536 טוקנים. המבנה שלו משלב נרמול שונה של שכבות הקשב כדי לסחוט ביצועים טובים יותר מממדים פיזיים קטנים.

הייחוד שלו בקטגוריה הזו הוא שילוב של מצב חשיבה יחד עם תמיכה בכלים לסוכנים אוטונומיים. במבחני קוד כמו LiveCodeBench v6 במצב חשיבה, הוא מקבל ציון של 45.3 לעומת 29.9 של Qwen 3 1.7B, ובמבחן המתמטיקה AIME 2025 הוא עומד על 45.2 לעומת 36.8 של אותו מתחרה. זה מראה יכולת לוגית חריגה ביחס לגודל, אבל חשוב לזכור שהבדיקות האלו נערכו על משקלי המקור ולא על גרסאות מכומתות.

מתאים ל

  • עיבוד מקומי בטלפונים

    הוא תוכנן במיוחד לעבודה על מכשירי קצה וצורך זיכרון מזערי בריצה מקומית.

  • סוכנים קטנים באנגלית

    הוא כולל יכולת מובנית להפעלת כלים לצד מצב חשיבה שלרוב לא קיים בגודל כזה.

  • פתרון בעיות היגיון וקוד

    הוא מציג ציונים טובים בפתרון בעיות מתמטיקה ותכנות ביחס למודלים של 1B.

איפה זה נופל

החיסרון המרכזי לקורא הישראלי הוא השפות, המודל אומן ותומך באנגלית, קוריאנית וספרדית בלבד, ואין לו תמיכה רשמית בעברית. בנוסף, עמידה בהוראות מדויקות היא נקודת תורפה, עם ציון IFEval של 67.8 במצב חשיבה, שנופל מזה של מתחרים כמו Qwen 3 1.7B שמגיע ל־72.5. מעבר לכך, התמיכה הטכנית בתוכנת ההרצה עדיין בשלבי פיתוח ומחייבת מעקפים ידניים כדי לעבד את תבנית השיחה.

אותה משפחה

EXAONE-4.0 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבין ועונה בעברית?

לא, הכרטיס מציין תמיכה באנגלית, קוריאנית וספרדית בלבד. ניסיון לפנות אליו בעברית יוביל לפלט משובש ולא אמין, ולכן הוא לא מתאים למשימות בשפה המקומית.

האם אפשר להריץ אותו ישר בתוך llama.cpp?

כן, אך יש צורך בגרסה b5932 ומעלה. בשל בעיות פתוחות בקוד המידול, ההרצה דורשת כרגע שימוש בקובץ תבנית Jinja ייעודי בשרת או עיבוד מוקדם של הפרומפט בספריית transformers.

איך מריצים

ההורדה כוללת קובצי GGUF בכימותים שונים, החל מגרסאות דחוסות כמו IQ4_XS ועד Q8_0 או משקלי BF16 מלאים. בשביל גרסת Q4_K_M סטנדרטית תצטרכו זיכרון וידאו או זיכרון מערכת מינימליים של פחות משני ג'יגה בייט, כך שכל מחשב נייד מודרני מריץ אותו בלי להרגיש.

ההרצה מתבצעת דרך llama.cpp מגרסה b5932 ומעלה, אך יש לשים לב לכך שהכרטיס דורש כרגע הכנת טקסט מראש בפייתון באמצעות transformers עבור שימוש ב־llama-cli, או הרצת llama-server עם תבנית Jinja ייעודית. אם אין לכם צורך מוחלט בריצה מקומית ומנותקת, חבל להתעסק עם ההגדרות והמגבלות של מודל קטנטן כשאפשר לקרוא למודלים גדולים בהרבה דרך API.

ollama run hf.co/LGAI-EXAONE/EXAONE-4.0-1.2B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other והמפתחים מציינים כי עדכנו אותו לתנאים גמישים יותר, אך הנוסח המלא וההגבלות המשפטיות המדויקות אינם מפורטים בעמוד. אם אתם מתכננים לשלב אותו במוצר מסחרי, חובה לבדוק את קובץ הרישיון המקורי במאגר כדי לא להסתכן בהפרת תנאי שימוש.

הרישיון המלא בעמוד המודל ↗