GPT
Q

Qwen3.5-9B-Gemini-3.1-Pro-Reasoning-Distill-GGUF

קוד פתוח

Jackrongapache-2.02026-03-10

  • gguf
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

התאמה של מודל תשעה מיליארד פרמטרים שעבר זיכוך חשיבה ממודלים חזקים כמו ג'מיני. המטרה היא פירוק בעיות מובנה ומתוכנן בלי להרים תשתית של מודל ענק.

  • 262,144טוקנים בהקשר
  • 32.3 GBמשקל הקבצים
  • 8,407הורדות בחודש
  • 48לייקים

מה זה

הבסיס כאן הוא מודל קוון של תשעה מיליארד פרמטרים, שעבר אימון על עקבות חשיבה שנלקחו בעיקר מג'מיני 3.1 פרו, לצד נתונים מג'מיני 3 פרו ומודל קוון של 27 מיליארד פרמטרים. במקום לזרוק תשובה מיידית, הוא מאומן לעצור, להגדיר את מטרת העל, לבודד כשלים אפשריים ולתכנן את הפתרון שלב אחרי שלב.

ערכת הנתונים שלו ממוקדת במשימות אנליטיות קשות. 28.5 אחוז ממנה מוקדשים למתמטיקה ולוגיקה, 21.8 אחוז למדעי המחשב ומערכות, ועוד 11.2 אחוז לתרחישי אבטחה וחשיבה יריבית. זה אומר שהוא נבנה ספציפית לבעיות שדורשות מעקב אחרי אילוצים ולא לשיחה חופשית וקלילה.

מתאים ל

  • פתרון בעיות קוד ומערכות

    מעל חמישית מנתוני האימון הוקדשו למדעי המחשב, מה שעוזר לו לתכנן ארכיטקטורה ולבודד תקלות.

  • ניתוח לוגי ואילוצים

    מתאים למשימות מתמטיות או מסמכים משפטיים ופיננסיים שמחייבים מעקב קפדני אחרי חוקים.

  • בדיקות חוסן ואבטחה

    כולל נתונים ייעודיים על חשיבה יריבית, ולכן מתאים לבחינת תרחישי כשל ומעקפי אבטחה בלוגיקה.

איפה זה נופל

הכרטיס מודה בפירוש בתופעת לוואי של זיכוך: תהליך האימון עלול להוביל לשכחה חלקית של ידע כללי שהיה קיים במודל המקורי, ולפגוע ביכולת ההכללה במשימות רחבות. יש לו נטייה לחשיבת יתר, והוא עלול לחפור ולהחזיר מבנה ארוך ומסורבל גם כשביקשתם תשובה של מילה אחת. בנוסף, קיימת סכנה להזיות של עובדות וציטוטים, והתאימות של תבניות השיחה עשויה לדרוש כוונון ידני בסביבות ריצה שונות.

שאלות
נפוצות

האם הוא תומך בעברית לפי המפרט?

השפות שצוינו במפורש בדף המודל הן אנגלית, סינית וקוריאנית בלבד. אם תפנו אליו בעברית אתם עלולים לקבל תוצאות שבורות, תרגום עילג או פגיעה בלוגיקה, ולכן עדיף להזין לו פרומפטים באנגלית.

האם הוא מתאים לצ'אט שירות לקוחות מהיר?

לא. האימון שלו כוון ליצירת שרשרת חשיבה מעמיקה ומובנית, ולכן הוא מייצר תשובות ארוכות ומנותחות גם לשאלות פשוטות. לצ'אט מהיר עדיף לקחת מודל שיחה רגיל.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־32.3 גיגה בייט בפורמט בי פלוט 16 שמחולק לתשעה קבצים. כדי להריץ את המשקלים הגולמיים בלי כימות תצטרכו כרטיס מסך עם לפחות 40 גיגה בייט זיכרון, או לחלופין להשתמש בגרסאות מכומתות שמיועדות לריצה מקומית על מעבדים או כרטיסים צרכניים קטנים יותר.

אם אתם צריכים רק שאילתות בודדות פעם בכמה שעות, עדיף לפנות לשרת מרוחק דרך ממשק חיצוני במקום להחזיק שרת ייעודי שדולק סתם. הרצה עצמית משתלמת כשיש לכם נפח עבודה רציף, דרישות פרטיות של מידע פנימי, או צורך בחלון ההקשר הגדול שמגיע ל־262,144 טוקנים.

ollama run hf.co/Jackrong/Qwen3.5-9B-Gemini-3.1-Pro-Reasoning-Distill-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא אפאצ'י 2.0. זה רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והמשקלים והפצה בתוך מוצר סגור, בלי חובה לחשוף את הפיתוחים שלכם. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗