GPT
Q

Qwen3.6-27B-MLX-8bit

קוד פתוח

unslothapache-2.02026-04-22

  • mlx
  • safetensors
  • qwen3_5
  • unsloth
  • qwen

גרסת 8 ביט לסביבת אפל סיליקון של מודל קוד וראייה חזק, שמיועדת בעיקר למפתחים שרוצים סוכן תכנות מקומי ועצמאי בלי לשלוח שורות קוד לשרתים חיצוניים.

  • 27Bפרמטרים
  • 262,144טוקנים בהקשר
  • 32.3 GBמשקל הקבצים
  • 3,032הורדות בחודש

מה זה

מדובר במודל רב תחומי שמטפל בטקסט ובתמונות במקביל, ומכוון בעיקר למשימות פיתוח מורכבות. הארכיטקטורה שלו בנויה סביב שילוב שכבות של Gated DeltaNet ורשתות קשב, עם חלון הקשר טבעי עצום של 262,144 טוקנים שניתן להרחבה עד מעל מיליון טוקנים. המבנה הזה נועד לאפשר הבנה של מאגרי קוד שלמים וסביבות עבודה מלאות בלי לאבד הקשר של קבצים היסטוריים.

במבחני ביצועי תכנות, הגרסה המלאה של המודל עוקפת את הדור הקודם ומציגה תוצאות מרשימות עבור הגודל שלה, עם 77.2 ב־SWE-bench Verified ו־59.3 ב־Terminal-Bench 2.0. המספרים האלה אומרים שבמשימות טרמינל ותיקון באגים אמיתיים הוא מתקרב לביצועים של מודלים ענקיים וסגורים, במיוחד בכל הקשור להרצת פקודות מורכבות והבנת ממשקי משתמש.

מתאים ל

  • סוכן בדיקות ותיקון תוכנה

    ניתוח באגים מורכבים ברמת הריפו והרצת פקודות בטרמינל באופן מקומי בלי לחשוף קוד רגיש לרשת.

  • פיתוח ממשקי פרונטאנד

    הזנת צילומי מסך של עיצובים ותרגומם לקוד, בזכות שילוב יכולות הראייה ודיוק גבוה במבחני ווב.

  • סריקת מאגרי קוד גדולים

    טעינת פרויקטים שלמים לחלון הקשר של מאות אלפי טוקנים לצורך מיפוי ארכיטקטורה ושאילתות.

איפה זה נופל

למרות השדרוג ביכולות הראייה והפיתוח, במשימות היגיון קיצוניות כמו מבחן HLE הוא משיג 24 בלבד, מה שמראה שהוא עדיין מתקשה בבעיות מחקריות עמוקות מאוד. בנוסף, מדובר בהמרה ספציפית ל־MLX, כך שמי שעובד על לינוקס או חומרת Nvidia לא יכול להשתמש בחבילה הזו ישירות וצריך לחפש משקולות בפורמט אחר. נקודה נוספת שדורשת בדיקה לפני שמשלבים אותו היא האופן שבו גרסת 8 ביט מתמודדת בפועל עם חלונות הקשר מקסימליים, שכן צריכת הזיכרון מתנפחת במהירות ככל שמתקרבים לקצה החלון.

אותה משפחה

Qwen3.6 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה על שרת לינוקס עם כרטיסי Nvidia?

לא, הקבצים בחבילה הזו מותאמים אך ורק לספריית MLX של אפל ולחומרת אפל סיליקון. עבור שרתי לינוקס וכרטיסי מסך רגילים תצטרכו להוריד את המשקולות הרגילות בפורמט Transformers או גרסאות GGUF.

האם מקבוק פרו עם 36 גיגה בייט זיכרון מאוחד יספיק לשימוש שוטף?

זה יהיה צפוף מאוד. המשקולות לבדן תופסות מעל 32 גיגה בייט, כך שלא יישאר זיכרון למערכת ההפעלה, לטעינת תמונות או לחלון הקשר משמעותי, והמחשב יתחיל להשתמש בזיכרון הווירטואלי בדיסק.

איך מריצים

המשקל הכולל של הקבצים עומד על 32.3 גיגה בייט, והוא ארוז בריצת MLX שמיועדת למחשבי מק. כדי להריץ את גרסת ה־8 ביט הזו בצורה חלקה, יחד עם חלון הקשר סביר ועיבוד תמונות, תצטרכו מחשב מק עם לפחות 48 או 64 גיגה בייט זיכרון מאוחד. הרצה על 36 גיגה תהיה גבולית מאוד ותחנוק את המערכת ברגע שהשיחה תתארך.

ההפעלה פשוטה ומתבצעת ישירות מהטרמינל בעזרת סקריפט ההתקנה של Unsloth והרצת mlx_vlm.chat. אם אין לכם מק חזק עם מספיק זיכרון, עדיף להשתמש ב־API מרוחק או בגרסאות קוונטיזציה נמוכות יותר, כי חריגה מהזיכרון המאוחד תגרום להאטה קיצונית בקצב יצירת הטוקנים.

pip install -U huggingface_hub
hf download unsloth/Qwen3.6-27B-MLX-8bit

הרישיון

המודל מופץ תחת רישיון apache-2.0, שזה מעולה למי שבונה מוצרים מסחריים. אפשר להשתמש בו בחופשיות, לשנות את הקוד והמשקולות, להטמיע אותו בשירותים פנימיים או מסחריים, ובלבד ששומרים על הודעת הרישיון המקורית ומציינים שינויים אם בוצעו כאלה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗