GPT
E

EXAONE-4.5-33B-GGUF

קוד פתוח

LGAI-EXAONEother2026-04-08

  • transformers
  • gguf
  • lg-ai
  • exaone
  • image-text-to-text

מודל מולטימודלי פתוח משקלים עם 33 מיליארד פרמטרים שמשלב עיבוד תמונה וטקסט עם יכולות חשיבה. הוא מתאים למי שצריך ניתוח מסמכים מורכבים וקוד בהרצה מקומית.

  • 187 GBמשקל הקבצים
  • 2,446הורדות בחודש
  • 52לייקים

מה זה

המודל פותח על ידי LG AI Research וכולל מודל שפה של 31.7 מיליארד פרמטרים לצד מקודד תמונה של 1.29 מיליארד פרמטרים. המבנה שלו מבוסס על שילוב שכבות קשב מסוג חלון נע וקשב גלובלי, עם תמיכה בחלון הקשר של עד 262,144 טוקנים. ברירת המחדל שלו היא מצב חשיבה שמופעל אוטומטית בכל בקשה.

במבחני ביצועים הוא עומד יפה מול מתחרים בקטגוריית הגודל שלו. במתמטיקה מבוססת ראייה כמו MathVision הוא קיבל 75.2 לעומת 70.2 ב־Qwen3-VL 32B, ובמבחני חשיבה טקסטואליים הוא מגיע ל־92.9 ב־AIME 2025 ו־81.4 ב־LiveCodeBench v6. עם זאת, הוא נבנה עם דגש חזק על קוריאנית לצד אנגלית, ספרדית, גרמנית, יפנית ווייטנאמית, ועברית אינה מופיעה ברשימת השפות הנתמכות שלו.

מתאים ל

  • ניתוח תרשימים ומסמכים טכניים

    הוא מציג תוצאות גבוהות במבחני מסמכים כמו AI2D ו־CharXiv, ומתאים לפענוח דוחות ותרשימים.

  • פתרון בעיות קוד מורכבות

    עם ציון 81.4 ב־LiveCodeBench ומצב חשיבה מובנה, הוא מתאים לסיוע וניתוח בעיות תכנות.

  • עיבוד פניות במספר שפות נתמכות

    הוא אומן רשמית על קוריאנית, אנגלית, גרמנית, ספרדית, יפנית ווייטנאמית לעבודה רב לשונית.

איפה זה נופל

במבחן BabyVision המודל קיבל ציון נמוך של 18.8, ובמבחן ההבנה בהקשר ארוך AA-LCR הוא השיג 50.6 לעומת 68.0 של GPT-5 mini. גם במבחן ההוראות IFBench הוא נעצר על 62.6 נקודות. היצרן מציין במפורש סיכון לפליטת מידע לא הולם עקב הסתמכות על הסתברויות אימון. בנוסף, חוסר התמיכה הרשמי בעברית מחייב בדיקה מעמיקה של פיענוח טקסט עברי מתמונות לפני שילוב שלו במערכת ייצור.

אותה משפחה

EXAONE-4.5 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איך מחברים תמונה לבקשת API דרך המודל?

המודל נתמך בממשק תואם OpenAI דרך llama-server, אך דורש טעינה של קובץ המודל וקובץ הפרויקטור הוויזואלי בנפרד בהגדרות ההפעלה. לאחר מכן פונים אליו כרגיל באמצעות לקוח ה־API.

האם חייבים להשתמש במצב החשיבה של המודל?

לא. מצב החשיבה מופעל כברירת מחדל, אבל אפשר לבטל אותו באמצעות העברת הפרמטר enable_thinking כ־False בהגדרות הבקשה כדי לחסוך בזמן תגובה.

האם המודל יפעל טוב על מסמכים בעברית?

עברית אינה מופיעה ברשימת השפות הנתמכות שפורסמה. המודל מתמקד בקוריאנית ובחמש שפות נוספות, כך שאין להסתמך עליו בעיבוד מסמכים בעברית בלי בדיקה מוקדמת.

איך מריצים

כדי להריץ אותו דרך llama.cpp בגרסה b9453 ומעלה, צריך להוריד את קובץ המודל המכומת בפורמט GGUF יחד עם קובץ מקודד התמונה הנפרד. המאגר מכיל מגוון כימותים של מודל השפה כמו Q4_K_M או Q8_0, לצד משקלי מקודד הראייה בפורמטים כמו BF16.

בשרתים מקצועיים היצרן מציין דרישה לכרטיס H200 בודד או ארבעה כרטיסי A100 של 40GB כדי לפתוח את מלוא חלון ההקשר של 256K. אם אין לכם חומרה ברמה הזו, כימות אגרסיבי יאפשר הרצה מקומית על זיכרון נמוך יותר, אבל פתיחת חלון הקשר ארוך עדיין תדרוש זיכרון רב.

ollama run hf.co/LGAI-EXAONE/EXAONE-4.5-33B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון של המודל מוגדר כ־other ואינו רישיון קוד פתוח סטנדרטי ומוכר. המשמעות היא שחייבים לבדוק את מסמך תנאי השימוש המדויק של LG לפני שמשלבים אותו במוצר מסחרי.

הרישיון המלא בעמוד המודל ↗