GPT
Q

Qwopus3.6-27B-Coder-MTP-GGUF

קוד פתוח

Jackrongapache-2.02026-06-11

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסת קוד מקומית בגודל בינוני שתוכננה לסוכנים אוטונומיים ופועלת מהר בלי שרשראות חשיבה ארוכות. היא מתאימה למי שרוצה להריץ תיקוני באגים אמיתיים על כרטיס מסך יחיד בלי לשלם לפי טוקן.

  • 95.2 GBמשקל הקבצים
  • 402,526הורדות בחודש
  • 335לייקים

מה זה

המודל מבוסס על Qwen3.6-27B ועבר אימון ייעודי למשימות פיתוח, תיקון באגים והפעלת כלים. הדגש כאן הוא על שילוב של חיזוי מרובה טוקנים יחד עם שחזור שלבי חשיבה ממודלים סגורים, במטרה לשמור על היגיון רציף בלי לפלוט פסקאות הסבר אינסופיות לפני כל פעולה.

במבחן SWE-bench Verified שבדק 500 תקלות גיטהאב אמיתיות, גרסת הקוונטיזציה Q5_K_M פתרה 67 אחוז מהמשימות כאשר מנגנון החשיבה הגלוי היה כבוי לחלוטין. המשמעות בפועל היא יכולת לגעת בקבצים, להריץ פקודות טרמינל ולתקן קוד ישירות, בלי להמתין שניות ארוכות ליצירת טקסט מקדים שרק מנתח את הבעיה.

מתאים ל

  • סוכן תיקון באגים אוטונומי

    פותר 67 אחוז ממשימות SWE-bench ישירות מול הקוד בלי לחכות לשרשראות חשיבה.

  • אוטומציה בטרמינל ובדיקות

    מאומן על קריאות כלים, הרצת סקריפטים ועדכון סביבות פיתוח בסבבים מרובים.

  • פיתוח מקומי על כרטיס יחיד

    מנגנון חיזוי מרובה טוקנים מאפשר מהירות של כ־100 טוקנים לשנייה על חומרה תואמת.

איפה זה נופל

מדובר בשחרור קהילתי מוגדר כניסיוני שלא עבר בדיקות בטיחות מסודרות או מבחני ביצועים כלליים מעבר לתכנות. המפרסם מדווח כרגע רק על מבחן יחיד שנערך, ללא בדיקות השוואה נוספות בתחומים רחבים. חובה לבדוק אותו בסביבה מבודדת לפני שנותנים לו להריץ פקודות טרמינל או לגעת בקבצי הפקה, במיוחד בהיעדר תמיכה רשמית בעברית.

שאלות
נפוצות

האם אפשר לעבוד איתו בעברית?

המודל מצהיר על תמיכה באנגלית, סינית, ספרדית, רוסית ויפנית בלבד. הוא לא אומן לעבודה בעברית ולא כדאי להסתמך עליו לפרויקטים שדורשים הבנת שפה מקומית.

למה המבחן בוצע כשהחשיבה כבויה?

המטרה הייתה לבדוק ביצועים של סוכן מהיר שמייצר פקודות ועריכות קוד ישירות. זה חוסך זמן חישוב ומאפשר תגובה מהירה בתהליכי עבודה אינטראקטיביים.

איך מריצים

אתם צריכים סביבה שתומכת בפורמט GGUF ובספריית transformers כדי לטעון את המשקלים. בשביל להריץ אותו בקצב טוב של כמעט מאה טוקנים לשנייה תצטרכו כרטיס מסך חזק כמו RTX 5090 שמסוגל להחזיק מודל צפוף של 27 מיליארד פרמטרים יחד עם הקשר עבודה רחב.

אם יש לכם כרטיסים ישנים יותר עם זיכרון וידאו מוגבל, חלוקת השכבות בין המעבד לכרטיס תפגע בקצב העבודה ותהפוך את האינטראקציה לאיטית. במצב כזה, או אם אתם צריכים רק תיקונים מזדמנים ולא סוכן מקומי שרץ ברקע כל היום, עדיף להשתמש ב־API מסחרי ולחסוך את עלות החומרה.

ollama run hf.co/Jackrong/Qwopus3.6-27B-Coder-MTP-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

רישיון apache-2.0 מאפשר שימוש מסחרי חופשי, שינוי של הקוד והפצה מחדש בתוך מוצרים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים וציון השינויים שביצעתם, ללא חובת פתיחת קוד המקור של היישום שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗