GPT
Q

Qwen3.6-27B

קוד פתוח

Qwenapache-2.02026-04-21

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • conversational

יש כאן גם סקירה על Qwen עצמו.

גרסה פתוחה וממוקדת קוד וראייה ממוחשבת בנפח 28 מיליארד פרמטרים. היא נותנת ביצועי תכנות של סוכנים שמתקרבים לדגמי ענק סגורים, בלי לצאת מהתשתית המקומית שלכם.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 4,876,260הורדות בחודש

מה זה

מדובר במודל רב-מודאלי שמשלב יכולות שפה, עיבוד תמונה וקוד. החידוש העיקרי כאן מול גרסאות קודמות בגודל הזה הוא הדגש על סוכני פיתוח, הבנת ריפוזיטורי שלם ושמירה של שרשרת החשיבה בין פניות, מה שחוסך זמן בשיחות פיתוח ארוכות.

במבחני ביצועים הוא עוקף את הדור הקודם כמעט בכל מדד תכנותי. במבחן SWE-bench Verified הוא הגיע ל־77.2 לעומת 75.0 בדגם הקודם, וב־Terminal-Bench 2.0 הוא קפץ מ־41.6 ל־59.3, תוצאה שמשתווה ל־Claude 4.5 Opus. זה אומר שבמשימות טרמינל ותיקון באגים מעשיים יש פה שיפור מורגש מאוד ביחס למשקל שלו.

מתאים ל

  • סוכן תכנות אוטונומי

    התוצאה 59.3 ב־Terminal-Bench 2.0 מאפשרת לו לפתור תקלות בסביבות לינוקס מקומיות בצורה אמינה.

  • פיתוח ממשקי פרונטאנד

    הוא כולל יכולות ראייה ממוחשבת מובנות ומכוון לבניית יישומי רשת ו־UI לפי עיצוב קיים.

  • סריקת מאגרי קוד גדולים

    חלון הקשר של 262,144 טוקנים מאפשר להזין תיקיות פרויקט שלמות בלי לקטוע את הקונטקסט.

איפה זה נופל

למרות השדרוג בקוד, במבחני ידע כללי מורכבים כמו HLE הוא עומד על 24.0 בלבד, רחוק מדגמים סגורים גדולים. בנוסף, חלון ההקשר העצום של 262,144 טוקנים ידרוש כמויות זיכרון אדירות ל־KV cache, ואם תנסו לדחוף ריפו ענק בלי מספיק חומרה תקבלו שגיאות זיכרון מהר מאוד.

אותה משפחה

Qwen3.6 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב נייד חזק לפיתוח יומיומי?

לא בצורה גולמית. הקבצים שוקלים 51.8 גיגה-בייט ודורשים חומרת שרתים עם זיכרון גרפי ייעודי גבוה. למחשב אישי תצטרכו לחכות לגרסאות מכומתות מאוד או להשתמש בפתרון מרוחק.

מה המשמעות של שמירת חשיבה בהקשר של סוכני קוד?

הכרטיס מציין אפשרות לשמור את הקשר החשיבה מהודעות קודמות. זה מונע מהמודל לחשב מחדש את כל שלבי ההיגיון בכל איטרציה של תיקון באגים ומקצר את זמני המענה.

איך מריצים

המשקל הגולמי מגיע ל־51.8 גיגה-בייט בפורמט Transformers, מה שאומר שכדי להריץ אותו בלי כימות תצטרכו לפחות 64 גיגה-בייט של זיכרון וידאו, כלומר שני כרטיסי RTX 4090 או כרטיס A100/H100 בודד. אפשר להריץ אותו עם vLLM, SGLang או KTransformers לתפוקה מהירה יותר.

אם אין לכם שרת ייעודי זמין 24/7 ואתם צריכים רק שאילתות פיתוח מדי פעם, עדיף להשתמש ב־API קיים במקום לשלם על שרת ענן כבד רק בשביל להחזיק את המשקלים בזיכרון.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="Qwen/Qwen3.6-27B")
print(pipe("שלום"))

הרישיון

הפרויקט משוחרר תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו במוצר שלכם, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗