GPT
Q

Qwen3.6-35B-A3B-UD-MLX-4bit

קוד פתוח

unslothapache-2.02026-04-17

  • mlx
  • safetensors
  • qwen3_5_moe
  • unsloth
  • qwen

גרסת 4 ביט של מודל תערובת מומחים שדורש רק 3 מיליארד פרמטרים פעילים מתוך 35 מיליארד. הוא מיועד להרצה מקומית על מחשבי אפל עם ביצועים שמכוונים לכתיבת קוד וסוכנים אוטונומיים.

  • 35Bפרמטרים
  • 262,144טוקנים בהקשר
  • 20.2 GBמשקל הקבצים
  • 20,474הורדות בחודש

מה זה

מדובר במודל שמשלב טקסט ותמונה ומבוסס על ארכיטקטורת תערובת מומחים. אף שיש לו 35 מיליארד פרמטרים בסך הכול, בכל צעד חישוב פועלים רק 3 מיליארד, 8 מומחים מנותבים ועוד מומחה אחד משותף מתוך 256. חלון ההקשר הטבעי עומד על 262,144 טוקנים וניתן להרחבה עד 1,010,000 טוקנים. הוא כולל תמיכה מובנית בשימור שרשרת חשיבה מהיסטוריית השיחה ובקריאה לפונקציות שמכילות מבנים מקוננים.

במדדי הביצועים הוא מתבלט במיוחד בפיתוח פרונטנד ובטרמינל. במבחן QwenWebBench הוא מגיע לציון של 1397, פער ניכר מול 978 של הגרסה הקודמת באותו גודל. במבחן Terminal-Bench 2.0 הוא רושם 51.5 לעומת 40.5 בגרסה הקודמת. במבחני סוכני תוכנה כמו SWE-bench Verified הוא עומד על 73.4, תוצאה חזקה שמראה יכולת אמינה יותר בפתרון תקלות בקוד מורכב.

מתאים ל

  • סוכן כתיבת קוד מקומי

    מתאים לתיקון באגים בספריות קוד שלמות עם תוצאה של 73.4 במבחן SWE-bench Verified.

  • אוטומציה בממשקי שורת פקודה

    מיועד להרצת תסריטים ופקודות מערכת בזכות ציון של 51.5 במדד Terminal-Bench 2.0.

  • ניתוח מסמכים עם תמונות

    תומך בקלט תמונה וטקסט יחד עם חלון הקשר נרחב של 262,144 טוקנים ללא ענן חיצוני.

איפה זה נופל

השליטה במשימות תכנון וכלים כלליים אינה אחידה. במבחן VITA-Bench המודל משיג 35.6 בלבד, ירידה מול מודלים קומפקטיים אחרים באותו סדר גודל. בבדיקת Tool Decathlon הוא מקבל 26.9, ובמבחן החשיבה המתמטית והמדעית HLE הוא נעצר על 21.4. במשימות שדורשות הבנה מדעית קיצונית או הפעלת סדרת כלים מורכבת שאינה קשורה ישירות לקוד, הוא עדיין טועה לא מעט וצריך לבדוק אותו בקפידה.

שאלות
נפוצות

איך המודל פועל מהר יחסית לגודל של 35 מיליארד פרמטרים?

בגלל מבנה תערובת המומחים, בכל טוקן פעילים רק 3 מיליארד פרמטרים. המחשב טוען את כל המשקלים לזיכרון אבל מבצע בפועל חישובים של מודל קטן בהרבה.

האם אפשר להריץ את הקבצים האלה במחשב עם כרטיס של אנבידיה?

הגרסה הזו נבנתה במיוחד עבור ספריית mlx של אפל. להרצה על כרטיסי מסך רגילים או בסביבות לינוקס צריך לחפש את משקלי המקור או גרסאות שתומכות בפורמט שונה.

איך מריצים

כדי להריץ אותו צריך מק עם שבב אפל סיליקון וספריית mlx מותקנת, מאחר שהמשקלים מומרים ומיועדים לסביבה זו. החבילה שוקלת 20.2 ג'יגה בייט בכימות של 4 ביט, כך שצריך זיכרון אחוד שיכול להכיל את המודל עצמו לצד ההקשר שרוצים לטעון. ההרצה נעשית ישירות דרך פקודת צ'אט של mlx_vlm במסוף.

אם אין לכם חומרת מק עם לפחות 32 ג'יגה בייט זיכרון אחוד, הקובץ פשוט יחנוק את המחשב או לא ייטען. במצב כזה אין היגיון להיאבק עם חומרה לא מתאימה, ועדיף להתחבר לשרת מרוחק או לשירות ענן שמריץ את המודל המלא.

pip install -U huggingface_hub
hf download unsloth/Qwen3.6-35B-A3B-UD-MLX-4bit

הרישיון

הקוד והמשקלים זמינים תחת רישיון apache-2.0. מותר להשתמש בהם לצרכים מסחריים, לשנות, להפיץ ולהטמיע במוצרים סגורים. התנאי המרכזי הוא שמירה על הצהרת זכויות היוצרים והרישיון המקורי בקבצים שמפיצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗