GPT
Q

Qwen3.6-35B-A3B-GGUF

קוד פתוח

unslothapache-2.02026-04-16

  • transformers
  • gguf
  • unsloth
  • qwen
  • qwen3_5_moe

זה מודל שפה עם ראייה שמפעיל רק 3 מיליארד פרמטרים מתוך 35 בפועל. מי שיבחר בו מחפש כוח של מודל תכנות מודרני בלי לשלם עלויות עיבוד של מודל ענק.

  • 513 GBמשקל הקבצים
  • 1,284,115הורדות בחודש
  • 1,594לייקים

מה זה

הארכיטקטורה כאן מחלקת 35 מיליארד פרמטרים לרשת מומחים, כך שבכל צעד חישוב רק שלושה מיליארד פרמטרים פעילים, שמחולקים בין שמונה מומחים מנותבים ואחד משותף. הוא משלב שכבות היברידיות של תשומת לב ליניארית ותשומת לב מונחית יחד עם רכיב ראייה, ותומך בהקשר בסיסי של 262,144 טוקנים עם אפשרות הרחבה מעבר למיליון.

במבחני תכנות סוכן הוא רושם 73.4 במבחן סווי בנץ' מאומת וציון של 1397 בקוון ווב בנץ', מה שמציב אותו מעל גרסאות קודמות בגודל הזה בבניית קוד לקבצי פרונטנד והבנת מבנה של מאגרים שלמים. המודל כולל גם תמיכה בהעברת הקשר מחשבתי משיחות קודמות ושיפור בניתוח אובייקטים מקוננים לקריאות כלים.

מתאים ל

  • סוכן לפיתוח וקוד

    הוא מותאם למעבר על מאגרי קוד, תיקון באגים ופיתוח פרונטנד בזכות שיפורים ייעודיים לתפקידי מפתח.

  • קריאות כלים מקוננות

    ניתוח משופר של מבני נתונים מורכבים עוזר לו להפעיל פונקציות וכלים חיצוניים בלי שגיאות פענוח.

  • ניתוח מסמכים ארוכים

    חלון הקשר שנמתח מעבר לרבע מיליון טוקנים מאפשר לטעון תיעוד מלא יחד עם קבצי תמונה לתוך שיחה אחת.

איפה זה נופל

הנתונים מראים נפילה ברורה ביכולות מסוימות. במבחן תכנון עמוק הוא משיג 25.9 בלבד, ובמבחן שאלות קשות הוא עומד על 21.4, שזה נמוך יותר מגרסת 27B הצפופה מאותה משפחה. גם במבחני סוכנים כלליים כמו טאו 3 בנץ' ודקתלון כלים הוא נשאר מאחור או לא מציג שיפור, כך שאם הפרויקט שלכם דורש תכנון לוגי מורכב שאינו כתיבת קוד ישירה, הוא עלול לאכזב.

אותה משפחה

Qwen3.6 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים למחשב נייד חזק?

לא ממש. למרות שבפועל מחושבים רק שלושה מיליארד פרמטרים בכל רגע, כל 35 מיליארד הפרמטרים חייבים לשבת בזיכרון, מה שדורש חומרת תחנת עבודה או שרת ייעודי כדי לפעול בקצב סביר.

האם יש הבדל בינו לבין מודל צפוף רגיל בתכנות?

כן. התוצאות מראות שהוא עוקף מודלים צפופים במשימות סוכני קוד ופרונטנד, אבל במשימות של תכנון כללי או שאלות רב תחומיות קשות הוא מציג ציונים נמוכים יותר מחלק מהחלופות הצפופות.

איך מריצים

המודל מגיע בפורמט ג'י ג'י יו אף דרך אנזלות', ונתמך בספריות שנשענות על טרנספורמרס, וי אל אל אם, אס ג'י לאנג וקיי טרנספורמרס. למרות שהמשקל הכולל של הקבצים במאגר הזה מגיע ל־513 גיגה בייט שמתפרסים על פני 31 קבצים, הוא מיועד לכימות של ארבע ביט שמאפשר ריצה חסכונית בהרבה.

בגלל שרק שלושה מיליארד פרמטרים פעילים בו זמנית, זמני התגובה של החישוב מהירים, אבל עדיין צריך מספיק זיכרון כדי להחזיק את כל המשקולות במערכת. מי שאין לו שרת ייעודי עם מספיק זיכרון וידאו או זיכרון מערכת מהיר יעדיף להשתמש בנקודת קצה מנוהלת בענן במקום להילחם בטעינת קבצים עצומים כאלה מקומית.

ollama run hf.co/unsloth/Qwen3.6-35B-A3B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל משוחרר תחת רישיון אפאצ'י 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של המשקולות והפצה בתוך מוצרים, כל עוד אתם שומרים על הודעת זכויות היוצרים ומצרפים עותק של תנאי הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗