GPT
Q

Qwen3.6-27B-AWQ-BF16-INT4

קוד פתוח

cyankiwiapache-2.02026-04-22

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • conversational

גרסה מכווצת בקוונטיזציית AWQ של מודל קוד וראייה עם 29 מיליארד פרמטרים. הוא מיועד למי שרוצה ביצועי פיתוח חזקים על כרטיס גרפי בודד עם 24 גיגה זיכרון.

  • 29Bפרמטרים
  • 262,144טוקנים בהקשר
  • 26.4 GBמשקל הקבצים
  • 17,801הורדות בחודש

מה זה

מדובר במודל שמשלב טקסט ותמונה בארכיטקטורת DeltaNet היברידית, עם דגש מובהק על כתיבת קוד וסוכני תוכנה אוטונומיים. הוא מחזיק בחלון הקשר טבעי עצום של 262,144 טוקנים, שמאפשר לטעון לתוכו ריפוזיטורי שלם בבת אחת מבלי לאבד את הקשר השיחה.

במבחני SWE-bench Verified המודל מגיע לתוצאה של 77.2, וב־LiveCodeBench הוא עומד על 83.9 נקודות. המשמעות המעשית היא שבמשימות של תיקון באגים מורכבים וקריאת קוד קיים, הוא עוקף את הגרסה הקודמת של אותה סדרה ומציג יכולת שמגרדת מודלים מסחריים סגורים, בעיקר סביב פקודות טרמינל וממשקי ווב.

מתאים ל

  • סוכן לתיקון באגים בריפו

    ניתוח בסיס קוד שלם ותיקון תקלות בסביבת טרמינל בזכות חלון הקשר עצום וציונים גבוהים במבחני שורת פקודה.

  • בניית ממשקי פרונטנד מתמונה

    תרגום צילומי מסך או סקיצות של ממשקי משתמש לקוד ווב עובד בעזרת השילוב בין מפענח התמונה ליכולות קוד מתקדמות.

  • פתרון בעיות מתמטיקה וקוד

    התמודדות עם אלגוריתמים מורכבים ומשימות STEM שמצריכות שימור שרשרת חשיבה ארוכה לאורך הדיאלוג.

איפה זה נופל

למרות שהוא תומך בעשר שפות כמו אנגלית, סינית, ערבית ורוסית, עברית לא מופיעה ברשימת השפות הרשמית של המודל, מה שאומר שהבנת שפה מקומית עלולה להיות בעייתית. בנוסף, המודל הזה כויל על קבוצת נתונים צרה שמתמקדת במדעים מדויקים וסוכני קוד, ולכן אינו בחירה טובה למשימות כתיבה כלליות או תרגום שוטף. יש לבדוק היטב את אמינות הפלט לפני שנותנים לו גישה ישירה להרצת פקודות בסביבת עבודה אמיתית.

אותה משפחה

Qwen3.6 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו על כרטיס RTX 4090 יחיד?

המודל שוקל מעל 26 גיגה, כך שהוא לא ייכנס במלואו לתוך 24 גיגה של הכרטיס. תצטרכו להגביל את חלון ההקשר בצורה משמעותית ולפרוק שכבות לזיכרון המחשב, מה שיאט את מהירות הריצה באופן דרסטי, או לעבוד עם שני כרטיסים במקביל.

האם הוא מתאים לעבודה באפליקציה שפונה למשתמשים בישראל?

עברית אינה מופיעה ברשימת השפות הרשמית של המודל. אפשר להשתמש בו כדי לעבד קוד, לנתח נתונים או לבנות מערכות פנימיות, אך לא מומלץ להסתמך עליו כממשק שיחה ראשי בעברית ללא בדיקות מעמיקות מראש.

איך מריצים

המשקל הכולל של הקבצים עומד על 26.4 גיגה, ולכן תצטרכו כרטיס מסך עם לפחות 32 גיגה זיכרון וידאו, או שילוב של שני כרטיסי 24 גיגה כדי להריץ אותו עם הקשר מלא בלי לקרוס. אם תנסו לדחוף אותו לכרטיס 24 גיגה בודד, תצטרכו לקצץ דרסטית את חלון ההקשר או להסתמך על שיטות פריקה לזיכרון הראשי.

ההרצה מתבצעת דרך vLLM, SGLang או ישירות דרך ספריית transformers של פייתון. אם הפרויקט שלכם לא דורש פרטיות מלאה או פעולה אופליין מקומית, הקמה ותחזוקה של מכונה כזו בענן תעלה יותר מקריאות API ייעודיות לשירות מנוהל.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="cyankiwi/Qwen3.6-27B-AWQ-BF16-INT4")
print(pipe("שלום"))

הרישיון

המודל משוחרר ברישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים, לשלב אותו במוצרים פנימיים או פומביים, ולהפיץ אותו הלאה, בתנאי ששומרים על הצהרת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗