GPT
Q

Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-GGUF

קוד פתוח

Jackrongapache-2.02026-03-03

  • transformers
  • gguf
  • qwen3_5
  • image-text-to-text
  • llama.cpp

הכלאה בין בסיס של Qwen בגודל 9B לבין שרשראות חשיבה שזוקקו מקלוד אופוס. מיועד למי שרוצה חשיבה מובנית בתגיות ייעודיות בלי לשלם על API חיצוני.

  • 262,144טוקנים בהקשר
  • 32.2 GBמשקל הקבצים
  • 18,938הורדות בחודש
  • 353לייקים

מה זה

מדובר בכיוונון עדין למודל Qwen3.5-9B, שהמטרה העיקרית שלו היא לשפר את תהליך החשיבה הפנימי בתוך תגיות ייעודיות. במקום ללכת לאיבוד בלופים חוזרים כמו מודלים קודמים במשפחה, הוא אומן לחקות שלבי ניתוח מסודרים מנתוני זיקוק של קלוד אופוס ו־Qwen 27B.

האימון נעשה בעזרת Unsloth על תשובות בלבד, כך שהמשקל עבר ישירות להסבר לוגי לפני מתן התשובה. מבחינת מדדים, יוצר המודל לא פרסם מבחני ביצועים סטנדרטיים אלא רק את עקומת האימון, שירדה מ־0.5138 ל־0.35786, נתון שמראה התכנסות תקינה בלמידת הפורמט אך לא מוכיח עליונות מול מודלים מתחרים בגודל הזה.

מתאים ל

  • פתרון בעיות מתמטיות

    פירוק משימות חישוביות לשלבים עוקבים בתוך תגיות חשיבה סגורות לפני פליטת התוצאה.

  • ניתוח לוגיקה ובדיקת קוד

    מעקב שקוף אחרי תהליך המחשבה של המודל כדי לזהות כשלי היגיון בקוד ובמערכות.

  • עיבוד טקסט באנגלית ובסינית

    ביצוע משימות מורכבות והבנת הנחיות בשפות הנתמכות רשמית על ידי הדאטהסטים.

איפה זה נופל

הכרטיס מודה במפורש בקיומן של הזיות, בעיקר כשמדובר באימות עובדות אמיתיות מהעולם בתוך בלוק החשיבה. המודל תומך רשמית רק באנגלית ובסינית, כך ששימוש בעברית אינו נתמך וסביר שיניב טעויות או ג'יבריש. בנוסף, חלון האימון בפועל הוגבל ל־16,384 טוקנים, ולכן אין להסתמך על חלון ההקשר המלא של מודל הבסיס במשימות מורכבות.

אותה משפחה

Qwen3.5-9B-Claude-4.6-Opus-Reasoning יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יפעל טוב בעברית?

לא. נתוני האימון והשפות המוגדרות כוללים רק אנגלית וסינית. הוא עלול לפלוט טקסט משובש או לערבב שפות בתוך בלוק החשיבה.

למה בלוק החשיבה מאריך את זמן הריצה?

המודל מייצר סדרה ארוכה של טוקנים פנימיים לפני שהוא כותב את הפלט הסופי. הדבר מעמיס על המעבד הגרפי וגוזל זמן רב לעומת מודל שפולט תשובה מיידית.

איך מריצים

נפח הקבצים הכולל עומד על 32.2 ג'יגה בייט, כך שתצטרכו כרטיס מסך עם זיכרון משמעותי כדי להריץ את גרסת הדיוק המקורית. אם יש לכם חומרה ביתית צנועה יותר, עדיף להמתין לקווינטוטים בפורמט קל יותר או לבצע המרה עצמאית.

אם אתם צריכים זמני תגובה מיידיים, שרשרת החשיבה הארוכה תאט אתכם. במקרים שבהם אין חומרה מתאימה ורוצים חיסכון במשאבים, עדיף לפנות ישירות למודל מקורי דרך שירות ענן מסודר.

ollama run hf.co/Jackrong/Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא אפאצ'י 2.0, שמתיר שימוש מסחרי חופשי, שינוי קוד והפצה. עם זאת, המודל מתבסס על זיקוק נתונים של קלוד, דבר שעלול להתנגש עם תנאי השימוש של ספקיות הדאטה אם אתם משלבים אותו במוצר מסחרי רחב.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗