GPT
Q

Qwopus3.5-9B-v3-GGUF

קוד פתוח

Jackrongapache-2.02026-03-31

  • gguf
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

זה כיוונון של קוון לתכנות וחשיבה שמקצר את שרשרת המחשבה ברבע. מי שרוצה תשובות קוד מהירות בלי שהמודל יחפור לעצמו שעות ימצא בו עניין.

  • 262,144טוקנים בהקשר
  • 21.8 GBמשקל הקבצים
  • 5,584הורדות בחודש
  • 375לייקים

מה זה

הבסיס כאן הוא Qwen3.5-9B שעבר כיוונון עדין בעזרת Unsloth עם זיקוק של דפוסי חשיבה מסגנון קלוד אופוס. המטרה של המפתח היתה לפתור את הנטייה המוכרת של מודלי חשיבה להימרח על פני אלפי תווים מיותרים בשאלות פשוטות, והוא עשה את זה דרך אימון שמאלץ מבנה שלבי תמציתי.

במבחן HumanEval המודל מגיע לתוצאת pass@1 של 87.80% לעומת 82.93% במודל הבסיס, ובמבחן הפלוס המחמיר יותר הוא עומד על 82.93%. במבחן MMLU-Pro על 280 שאלות נרשם יתרון קל בלבד של 81.79% לעומת 80.36%, כשהוא מוביל בעיקר בפיזיקה ובכימיה ומפגר מעט במדעי המחשב ובמתמטיקה מול הבסיס. ההבדל המעשי הוא באורך הפלט, אורך המחשבה הממוצע התקצר מ־7,116 תווים ל־5,313 תווים, ירידה של 25.3% שמקטינה את מספר הטוקנים שמתבזבזים על כל תשובה נכונה.

מתאים ל

  • פתרון בעיות קוד במחשב מקומי

    משיג 87.8% ב־HumanEval ומקצר את תהליך החשיבה ברבע, מה שחוסך זמן בריצה מקומית.

  • ניתוח משימות מדעיות ופיזיקה

    מציג שיפור יציב בפתרון בעיות מורכבות בכימיה ופיזיקה לעומת מודל הבסיס במבחן MMLU-Pro.

  • מחקר על ייעול שרשראות חשיבה

    המפתח שחרר מחברת אימון וקוד מלא, מתאים למי שרוצה לשחזר תהליך זיקוק מחשבתי של LLM.

איפה זה נופל

למרות שהמפתח מעיד על שיפור בתחביר, הפלטים הגולמיים במבחנים עדיין כללו בעיות עיטוף של מרקדאון, ערבוב בין קוד להסברים וקטעי טקסט חתוכים. בנוסף, המפתח עצמו מדגיש שהמודל מיועד לצורכי למידה, מחקר אקדמי והדגמה בלבד, ולא למוצר ייצורי. הוא מודה מפורשות שהעובדות החיצוניות שהמודל שולף בתוך שלבי החשיבה עלולות לכלול הזיות כשמדובר באירועים אמיתיים. נקודה קריטית למשתמש הישראלי, התמיכה המוצהרת היא באנגלית, סינית וקוריאנית, כך שעברית כלל לא נבדקה ולא מוגדרת כשפה נתמכת.

אותה משפחה

Qwopus3.5 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

המודל מוגדר רשמית עבור אנגלית, סינית וקוריאנית בלבד. הוא לא אומן או נבדק לעבודה בעברית, ולכן לא מומלץ להסתמך עליו לפרויקטים שדורשים שפה מקומית.

האם אפשר להשתמש במודל הזה במוצר מסחרי?

הרישיון הוא Apache 2.0 שמתיר שימוש מסחרי באופן עקרוני, אבל המפתח ציין במפורש שהגרסה נועדה לצורכי מחקר והדגמה בלבד. בנוסף, קיימות בעיות של פלט חתוך וערבוב קוד בטקסט שמחייבות בדיקה קפדנית לפני שילוב במערכת פעילה.

במה הוא עדיף על Qwen3.5-9B הרגיל?

הוא מדויק יותר בכתיבת קוד עם עלייה של כחמישה אחוזים בבדיקות המחמירות, ומגיע לתוצאה בפחות שלבי סרק. המשמעות היא פחות טוקנים מבוזבזים על חשיבה עצמית וזמן תגובה קצר יותר בכל שאלה.

איך מריצים

הקבצים שוקלים 21.8 גיגה בייט ומיועדים להרצה עם ספריות שתומכות בפורמט GGUF ובמשימות טקסט ותמונה. כדי להריץ את המודל ברמת הדיוק המקורית של bfloat16 תצטרכו כרטיס מסך עם לפחות 24 גיגה זיכרון וידאו, או שתצטרכו לחכות לגרסאות מכווצות של 4 ביט כדי לדחוף אותו לחומרה ביתית פשוטה יותר.

אם אתם שוקלים להרים שרת ייעודי בענן רק בשביל הרצה מקומית, זה שווה את זה רק אם יש לכם צורך בפרטיות מוחלטת או ניתוח קוד מקומי שרץ שעות. לכל שימוש מזדמן אחר, קריאה ל־API מסחרי תהיה זולה ופשוטה בהרבה מתחזוקת תשתית עבור מודל 9B עצמאי.

ollama run hf.co/Jackrong/Qwopus3.5-9B-v3-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

7 קבצים במאגר, 21.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0 שמאפשר שימוש מסחרי, שינוי והפצה חופשית ללא תמלוגים, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. עם זאת, קיים פער בין הרישיון המשפטי לבין הצהרת המפתח בכרטיס המודל, שם הוא כותב שמדובר בגרסת בדיקה לצורכי מחקר והדגמה בלבד. מי שרוצה לשלב את זה במוצר מסחרי צריך לקחת בחשבון את ההסתייגות הזו של היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗