GPT
Q

Qwopus3.5-9B-Coder-MTP-GGUF

קוד פתוח

Jackrongapache-2.02026-05-18

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסת קוד וראייה בגודל תשעה מיליארד פרמטרים שמשלבת חיזוי מרובה תווים. היא פותרת בעיות חשיבה מהר יותר מגרסאות רגילות של אותה משפחה.

  • 33.0 GBמשקל הקבצים
  • 328,214הורדות בחודש
  • 214לייקים

מה זה

מדובר במודל שמיועד לכתיבת קוד ולפתרון בעיות לוגיות, המשלב יכולות טקסט ותמונה ומבוסס על ארכיטקטורת חיזוי מרובה תווים בתצורה של שני טוקנים קדימה. בזמן שהרשת הראשית מייצרת את הטוקן הנוכחי, ראשים ייעודיים חוזים במקביל את שני הטוקנים הבאים והמודל מאמת אותם במעבר יחיד. המנגנון הזה מכריח אותו לתכנן קדימה ומקטין לולאות חזרתיות בקוד.

בבדיקות הביצועים של המפתח מול גרסת הבסיס בחמישה תחומים, קצב ההסקה הכולל עלה מ 4.94 טוקנים לשנייה ל 6.71 טוקנים לשנייה, שיפור של מעל שלושים וחמישה אחוזים. מעבר למהירות, במבחני קוד ומתמטיקה מורכבים הוא הגיע למאה אחוז דיוק ולא סבל מחיתוך קוד באמצע התשובה, לעומת שמונים אחוז דיוק כולל בגרסה הרגילה.

מתאים ל

  • ייצור והשלמת קוד מקומי

    מתאים לסביבות פיתוח מקומיות בזכות מהירות פלט גבוהה ומניעת שבירות בלולאות קוד.

  • קריאות לפונקציות וכלים

    במבחן קהילתי השיג מעל תשעים וחמישה אחוזי דיוק בבחירת כלים מול שמות מתחרים.

  • פתרון בעיות חישוב ולוגיקה

    תכנון קדימה באמצעות חיזוי מרובה תווים משפר הוכחות רב שלביות ומקטין שגיאות.

איפה זה נופל

המודל תומך רשמית באנגלית, סינית, קוריאנית, רוסית, יפנית וספרדית בלבד. עברית לא מופיעה ברשימת השפות הנתמכות, ולכן אין לצפות לתמיכה תקינה או ליכולת שיחה מקומית בלי שבירות והזיות. בנוסף, אף שהמבחנים העצמיים מראים מאה אחוזי דיוק בקוד, מדובר במדגם קטן של שלושים שאלות שנבדקו בתנאי מעבדה ספציפיים.

שאלות
נפוצות

האם המודל יבין הנחיות בעברית?

עברית אינה מופיעה ברשימת השפות הנתמכות של המודל. אפשר לנסות להזין לו טקסט בעברית, אבל הוא צפוי להתקשות בניסוח, לשבור תחביר או להחזיר פלט באנגלית בלבד.

איך ארכיטקטורת החיזוי משפיעה על מהירות הכתיבה?

במקום לחשב כל מילה בנפרד, ראשים משניים מנחשים שני תווים קדימה והמודל בודק אותם בבת אחת. במבחני המפתח הפעולה הזו חסכה רבע מזמן הריצה הכולל.

איך מריצים

המשקל הכולל של הקבצים מגיע ל 33 גיגה בייט המחולקים לשמונה קבצים, כך שאי אפשר להריץ אותו בנוחות על כרטיס מסך ביתי ממוצע בלי לחלק את המשאבים או להשתמש בשרת ייעודי. בבדיקות הרשמיות הריצו אותו תחת עומס של חמש פניות במקביל על גבי שרת ייעודי כדי לדמות שימוש בעולם האמיתי.

אם יש לכם כרטיס מקצועי או שרת ענן עם שפע זיכרון וידאו, יש היגיון בהרצה מקומית בגלל הפרטיות והמהירות של מנגנון החיזוי. לכל שימוש מזדמן אחר, תשלום לפי קריאה למודל מרוחק יחסוך את כאב הראש של תחזוקת חומרה יקרה וכבדה.

ollama run hf.co/Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י 2.0. זהו רישיון מתירני שמאפשר שימוש מסחרי מלא, שינוי של הקוד והפצה מחדש במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗