GPT
Q

Qwopus3.5-4B-Coder-MTP-GGUF

קוד פתוח

Jackrongapache-2.02026-05-26

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסה מכווצת של מודל קוד שמיועדת לאיתור באגים והפעלת כלים ישירות מהמחשב הנייד. הוא מתאים למי שרוצה עבודה מקומית ומהירה בלי תלות ברשת.

  • 37.8 GBמשקל הקבצים
  • 5,589הורדות בחודש
  • 62לייקים

מה זה

מדובר במודל צפוף בגודל 4 מיליארד פרמטרים שמבוסס על משפחת Qwen3.5, ועבר אימון ייעודי להתנהגות סוכנים, מעקב אחרי הוראות וכתיבת קוד. המטרה של המפתחים הייתה לייצר כלי שמסוגל לרוץ מקומית בלי לזלול זיכרון, אבל עדיין להחזיק מסלולי חשיבה מורכבים. הם השתמשו בשיטה בשם Trace Inversion כדי לשחזר תהליכי מחשבה מלאים, ואימנו אותו על תרחישים שכוללים הפעלת כלים עם משוב חוזר מהסביבה ולא רק שאלות ותשובות בודדות.

במבחני benchlocal המודל השיג ציון ממוצע של 82.0% מול 74.0% של מודל הבסיס. במבחן BugFind-15 הוא קיבל 71 נקודות מתוך 100 לעומת 52 של מודל הבסיס, ובמבחן ניתוב הכלים ToolCall-15 הגיע לציון 100 מלא. הנתונים האלה מראים שיפור מעשי ביכולת לתפוס שגיאות בקוד ולהוציא פקודות מדויקות למערכת, אם כי המדידות התבססו על בדיקה שאישרה מענה אם לפחות אחד משלושה ניסיונות הצליח.

מתאים ל

  • איתור באגים מקומי

    מאתר שגיאות ומציע תיקונים נקודתיים בקוד ישירות על המחשב הנייד, בלי להעלות קבצים לרשת.

  • ניתוב קריאות לכלים

    קיבל ציון מושלם במבחן ToolCall-15 ומתאים לפענוח פקודות ותרגומן לקריאות לפונקציות פנימיות.

  • סקריפטים לניטור שרתים

    גודל קומפקטי של 4B שמתאים להרצה על מכונות פיתוח לצורך אוטומציה של תחזוקה וסריקת לוגים.

איפה זה נופל

זהו שחרור קהילתי ניסיוני שלא עבר בדיקות בטיחות מקיפות או בחינה על משימות כלליות מעבר לקוד. במבחן הסוכנים HermesAgent-20 הוא השיג ציון של 64 מתוך 100 בלבד, כך שלא כדאי לסמוך עליו בתהליכים מרובי שלבים ללא השגחה. בנוסף, תוצאות הבנצ'מרק חושבו לפי שלושה ניסיונות לכל תרחיש, מה שאומר שהיציבות במכה ראשונה נמוכה יותר. בעברית אין לו תמיכה רשמית לפי רשימת השפות של הפרויקט, שכוללת רק אנגלית, סינית, ספרדית, רוסית ויפנית.

שאלות
נפוצות

האם המודל תומך בעבודה בעברית?

הכרטיס מפרט תמיכה באנגלית, סינית, ספרדית, רוסית ויפנית בלבד. הוא עשוי להבין מילים בודדות בעברית עקב אימון הרקע של רשתות הבסיס, אבל הוא לא מיועד לפיתוח או תיעוד בשפה הזו.

מה נדרש כדי להריץ את המודל על מחשב אישי?

המודל מיועד לחומרה צנועה ורץ בצורה סבירה על מחשבים עם 16GB זיכרון עבודה. אפשר לטעון את קובצי ה־GGUF דרך תוכנות כמו LM Studio בסביבת Apple Silicon או כרטיסי מסך ביתיים.

איך מריצים

המודל מחולק ל־15 קבצים בנפח כולל של 37.8 גיגה בייט, שכוללים ככל הנראה רמות כימות שונות בפורמט GGUF. גודל של 4B תוכנן מראש למחשבים ניידים עם 16GB זיכרון, ורץ בקלות יחסית על שבבי Apple Silicon דרך LM Studio או כלים דומים בלי להעמיס על החומרה.

אם אתם מחפשים אוטומציה של בדיקות שרתים או סיוע מקומי בעריכת קוד, שווה להריץ אותו ישירות על המכונה שלכם. מנגד, אם אתם מפתחים מוצר שדורש ארכיטקטורה עמוקה או כתיבת פרויקטים שלמים מאפס, מודלים גדולים דרך API מסחרי יתנו תוצאות אמינות בהרבה.

ollama run hf.co/Jackrong/Qwopus3.5-4B-Coder-MTP-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה מחדש בתוך מוצרים סגורים. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והצהרת הוויתור על אחריות, כך שמבחינה משפטית מותר לשלב אותו במערכות פנימיות או מסחריות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗