GPT
G

GLM-4.6

קוד פתוח

zai-orgmit2025-09-29

  • transformers
  • safetensors
  • glm4_moe
  • text-generation
  • conversational

מפלצת קוד והיגיון בקוד פתוח עם חלון עבודה עצום. הוא מיועד למי שרוצה אלטרנטיבה עצמאית למודלים המסחריים המובילים עבור משימות פיתוח וסוכנים אוטונומיים.

  • 357Bפרמטרים
  • 202,752טוקנים בהקשר
  • 665 GBמשקל הקבצים
  • 17,940הורדות בחודש

מה זה

מדובר במודל מבוסס MoE שמגיע לנפח כולל של כמעט 357 מיליארד פרמטרים, עם תמיכה באנגלית ובסינית בלבד. המוקד כאן הוא יכולות תכנות מתקדמות, הפעלת כלים בזמן ריצה ושימוש בסוכנים שמריצים חיפושים ברשת. לפי הפרסום, יש פה קפיצה ביחס לגרסה 4.5 הקודמת, בייחוד בכל הקשור להבנת הקשר רחב וכתיבת קוד לממשקי פרונטאנד.

חלון ההקשר שלו מגיע ליותר מ־202 אלף טוקנים, מה שמאפשר לזרוק אליו פרויקטים שלמים או היסטוריית שיחות כבדה בלי לחתוך באמצע. השילוב של תמיכה בכלי צד שלישי כמו Claude Code או Cline הופך אותו למועמד ישיר לתפקיד מנוע הפיתוח שלכם, אם אתם רוצים שליטה מלאה על המשקלים והמידע.

מתאים ל

  • סוכן כתיבת קוד עצמאי

    הוא מותאם ישירות לסביבות כמו Cline ומשלב שימוש בכלים וחיפוש בזמן ריצה כדי לתקן באגים בפרויקטים מורכבים.

  • ניתוח בסיסי קוד ענקיים

    חלון של מעל 202 אלף טוקנים מתאים לטעינה של ספריות שלמות ומסמכי ארכיטקטורה יחד עם הקוד בפועל.

  • מחקר ופיתוח פנימי מאובטח

    הוא מאפשר לארגונים עם חומרת שרתים מתאימה להריץ מודל חזק ברמת קוד פתוח מבלי להוציא מידע רגיש לענן.

איפה זה נופל

השפות הנתמכות רשמית הן אנגלית וסינית בלבד. עברית בכלל לא מופיעה ברשימה, כך שמי שבונה על פתרון מקומי למשימות בשפה שלנו ייתקל כנראה בביצועים ירודים או בהזיות. בנוסף, מדובר במודל שדורש טמפרטורה 1.0 ופרמטרים מוגדרים היטב כדי להוציא תוצאות יציבות, ואי אפשר להתעלם מהגודל המפלצתי שמונע מכל צוות פיתוח ממוצע להריץ אותו בלי תקציב ענן חריג.

אותה משפחה

GLM-4.6 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית לשימוש עסקי בישראל?

הכרטיס מציין תמיכה באנגלית ובסינית בלבד. אם תפנו אליו בעברית תקבלו כנראה תוצאות עילגות או שבורות, ולכן הוא לא מתאים לעיבוד טקסט בעברית.

אפשר להריץ את המודל הזה על תחנת עבודה יחידה במשרד?

לא. המשקלים תופסים 665 גיגה בייט בדיוק bfloat16, כך שגם מחשב חזק עם כמה כרטיסים צרכניים פשוט לא יוכל להעלות אותו לזיכרון ללא קווינטוט אגרסיבי או שרת ייעודי.

איך מריצים

כדי להריץ אותו מקומית צריך מערך שרתים רציני מאוד. הקבצים לבדם שוקלים 665 גיגה בייט בדיוק bfloat16 על פני 92 שכבות, מה שאומר שתצטרכו אשכול של כרטיסי H100 או A100 עם מאות גיגות של זיכרון וידאו רק כדי לטעון אותו לזיכרון לפני שבכלל חישבתם טוקן אחד.

לרוב המוחלט של המפתחים אין גישה לחומרה כזו במשרד, ולכן הרצה עצמית שווה את המאמץ רק אם הפרטיות קריטית ואתם מחזיקים תשתית ענן ייעודית. בכל תרחיש אחר, הגיוני בהרבה להתחבר ישירות ל־API שזמין דרך הפלטפורמה שלהם ולחסוך את כאב הראש התשתיתי.

from transformers import pipeline

pipe = pipeline("text-generation", model="zai-org/GLM-4.6")
print(pipe("שלום"))

הקבצים

101 קבצים במאגר, 665 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון כאן הוא MIT, וזה מעולה. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להטמיע אותו במוצר סגור ולהפיץ אותו הלאה בלי תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗