GPT
G

GLM-4.6-GGUF

קוד פתוח

unslothmit2025-09-30

  • transformers
  • gguf
  • unsloth
  • text-generation
  • en

גרסת GGUF שעברה כיול קוונטיזציה עבור מודל שמכוון לכתיבת קוד ומשימות סוכנים. מי שמוריד אותה מחפש חלון של 200 אלף טוקנים בלי לשלם על שירותי ענן.

  • 5.3 TBמשקל הקבצים
  • 4,086הורדות בחודש
  • 154לייקים

מה זה

המודל מציע חלון הקשר מורחב של 200 אלף טוקנים, שיפור ניכר לעומת 128 אלף בגרסה הקודמת, מה שנועד לתת מרחב עבודה גדול במיוחד לניתוח מאגרי קוד והרצת סוכנים. הדגש העיקרי כאן הוא תכנות והפעלת כלים בזמן חשיבה. לפי נתוני המפתחים, הביצועים שלו עוקפים את הגרסה הקודמת בשמונה מבחנים שונים בתחומי הקוד, הסקת המסקנות וסוכני רשת, ומציגים תחרות מול מודלים כמו DeepSeek-V3.1-Terminus ו־Claude Sonnet 4.

הוא מכוון ישירות לשילוב בתוך סביבות פיתוח וסוכני קוד כמו Cline או Roo Code, ומספק תוצאות חזקות יותר ביצירת דפי פרונטאנד ובכתיבה טבעית. ההבדל המרכזי מול מה שהכרנו מתבטא ביכולת לשלב חיפוש והפעלת כלים בצורה מובנית בתוך תהליך החשיבה, בלי לאבד את ההקשר במשימות ארוכות ומורכבות.

מתאים ל

  • סוכן לפיתוח פרונטאנד

    הוא מותאם ליצירת דפי ממשק visual ומיועד לשילוב ישיר בסביבות קוד כמו Roo Code ו־Cline.

  • ניתוח מסמכים ארוכים

    חלון הקשר של 200 אלף טוקנים מאפשר להזין תיעוד טכני נרחב או קבצי קוד מרובים בפנייה אחת.

  • סוכני חיפוש מבוססי כלים

    כולל תמיכה מובנית בחיפוש והפעלת כלים ישירות בתוך מצב החשיבה עבור משימות מחקר מורכבות.

איפה זה נופל

המודל אומן רק על אנגלית וסינית, כך שאין שום תמיכה רשמית בעברית ואי אפשר לבנות עליו לפרויקטים מקומיים בשפה זו. בנוסף, משימות מורכבות של הפעלת כלים וסוכני חיפוש דורשות פורמט קלט קפדני מאוד של תבניות חשיבה, ואם לא מגדירים אותו בדיוק לפי ההוראות, המודל מאבד את היכולת לתפעל כלים בצורה אמינה. תצטרכו לבדוק בעצמכם את איכות הקוד לפני שאתם סומכים עליו בפרודקשן.

שאלות
נפוצות

האם המודל מתאים לעבודה בעברית?

הכרטיס מצהיר על תמיכה באנגלית ובסינית בלבד. הוא לא אומן על עברית, ולכן לא מומלץ להסתמך עליו למשימות שדורשות הבנה או יצירה של טקסט בעברית.

איך מוודאים שהרצת ה־GGUF עובדת בלי שגיאות פלט?

חשוב לעבוד עם גרסה עדכנית של llama.cpp ולהפעיל את הדגל jinja בעת ההרצה. המפרסמים ציינו שהגרסה הזו מכילה תיקונים ייעודיים לתבנית השיחה שמחייבים את ההגדרה הזו.

איך מריצים

כדי להריץ את הקבצים האלה צריך גרסה עדכנית של llama.cpp עם הדגל jinja, כי המפרסמים עדכנו את תבנית השיחה כדי למנוע תקלות בפלט. המשקל הכולל של כלל הקבצים במאגר מגיע ל־5.3 טרה-בייט שמחולקים ל־133 קבצים, כך שברור שלא מורידים הכל אלא בוחרים קובץ קוונטיזציה בודד שמתאים למגבלות הזיכרון שלכם.

אם אין לכם שרת ייעודי עם מספיק זיכרון וידאו שיכול להחזיק משקלים כבדים וחלון של 200 אלף טוקנים, עדיף לא לנסות להרים את זה מקומית. עבור בדיקות נקודתיות או פרויקטים קטנים, שימוש ישיר ב־API של הפלטפורמה יחסוך שעות של תחזוקה והורדות כבדות.

ollama run hf.co/unsloth/GLM-4.6-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

133 קבצים במאגר, 5.3 TB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח כאן הוא MIT. זה אומר שמותר לעשות עם הקבצים כמעט הכל, כולל שימוש מסחרי, שינוי הקוד, שילוב במוצרים סגורים והפצה מחדש, בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים המקורית של הפרויקט בתוך המוצר שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗