GPT
Q

Qwopus3.6-27B-Coder-GGUF

קוד פתוח

Jackrongapache-2.02026-06-12

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסת קוד עצמאית המבוססת על מודל של 27 מיליארד פרמטרים. היא נועדה להריץ סוכני פיתוח אוטונומיים מקומית על כרטיס גרפי יחיד, בלי לחכות לשרתי ענן חיצוניים.

  • 93.8 GBמשקל הקבצים
  • 1,723הורדות בחודש
  • 84לייקים

מה זה

המודל אומן במיוחד עבור משימות תכנות מורכבות, הפעלת כלים רב שלבית וניווט במאגרי קוד מלאים. הבסיס שלו נשען על Qwen3.6-27B שעבר תהליך זיקוק מותאם שנקרא Trace Inversion, המנסה לשחזר מסלולי חשיבה מפורטים מתוך דגימות של מודלים סגורים כמו Claude Opus, לצד עשרות אלפי מסלולי עבודה מעשיים של סוכני קוד.

הייחוד המרכזי כאן מול מודלים אחרים בגודל הזה הוא היכולת לפעול ישירות בלי שרשרת חשיבה גלויה. במבחן SWE-bench Verified שבודק פתרון תקלות אמיתיות מגיטהאב, גרסת ה־Q5_K_M הצליחה לפתור 335 מתוך 500 בעיות, שהם 67 אחוז הצלחה, במצב שבו החשיבה הגלויה כבויה לחלוטין. זה אומר שהוא מוציא פתרונות וקריאות לכלים בלי לייצר פסקאות ארוכות ומאטות של הרהורים לפני כל פעולה.

מתאים ל

  • הרצת סוכן לתיקון באגים

    מתאים לפתרון תקלות בתוך מאגרי קוד מקומיים בקצב מהיר, בזכות 67 אחוזי הצלחה במבחן SWE-bench ללא צורך בהמתנה לחשיבה גלויה.

  • אוטומציה של פקודות מסוף

    שימושי לתסריטי בדיקות והפעלת כלים רציפה, כיוון שאומן על אלפי מסלולי עבודה שכוללים משוב אמיתי מסביבת ההרצה.

  • סביבות פיתוח מנותקות רשת

    מאפשר עבודה על קוד פנימי ורגיש בארגונים, על גבי כרטיס מסך בודד וללא תלות בשרתים חיצוניים.

איפה זה נופל

זהו שחרור קהילתי ניסיוני, והמפתח מצהיר במפורש שהמודל לא עבר בדיקות בטיחות מקיפות ואין לו הערכות ביצועים בתחומים שאינם קוד. מבחן SWE-bench הוא היחיד שפורסם במלואו, ושאר המבחנים טרם הושלמו. בנוסף, חבילת הקבצים הכוללת בעמוד שוקלת 93.8 גיגה בייט, והמודל אינו תומך בעברית אלא רק באנגלית, סינית, ספרדית, רוסית ויפנית, כך שאינו מתאים לפיתוח מבוסס הנחיות מקומיות.

אותה משפחה

Qwopus3.6-27B-Coder יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבין וכותב הערות בעברית?

לא. רשימת השפות הנתמכות כוללת אנגלית, סינית, ספרדית, רוסית ויפנית בלבד. אם תפנו אליו בעברית, הביצועים שלו ואיכות הקוד ירדו באופן משמעותי.

מה המשמעות של תוצאת SWE-bench ללא חשיבה?

הוא פותר בעיות קוד מעשיות ישירות בלי לייצר טקסט חשיבה ארוך לפני התשובה. זה חוסך זמן ריצה יקר, ומאפשר לסוכן להגיב במהירות כמעט כפולה בסביבת עבודה אינטראקטיבית.

איך מריצים

כדי להריץ את המודל המכווץ בפורמט GGUF באופן מקומי ויציב, נדרש כרטיס מסך חזק עם זיכרון ייעודי נדיב. המפתחים מציינים כרטיס בודד ברמה של RTX 5090, שבו גרסה בעלת Multi-Token Prediction מגיעה לקצב של כ־100 טוקנים לשנייה.

אם יש לכם מחשב עם פחות זיכרון וידאו, או שאתם עובדים על מחשב נייד פשוט, אין שום היגיון לנסות להריץ אותו מקומית. במקרה כזה עדיף לשלם לפי שימוש ב־API מסחרי של מודל קוד גדול, במקום לקבל זמני תגובה איטיים להחריד מהרצה על מעבד רגיל.

ollama run hf.co/Jackrong/Qwopus3.6-27B-Coder-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון Apache 2.0. זהו רישיון קוד פתוח מתירני מאוד שמאפשר שימוש מסחרי חופשי, שינוי הקוד והפצה פנימית או חיצונית בתוך מוצרים. התנאי העיקרי הוא שמירה על הצהרת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗