GPT
Q

Qwen3.5-9B-GLM5.1-Distill-v1-GGUF

קוד פתוח

Jackrongapache-2.02026-04-16

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסת זיקוק של Qwen3.5 בתשעה מיליארד פרמטרים שאומנה על דאטה של GLM-5.1. המטרה כאן היא לייצב תהליכי חשיבה ולפרק בעיות מורכבות בלי לקפוץ למודלים ענקיים וכבדים.

  • 32.2 GBמשקל הקבצים
  • 320,375הורדות בחודש
  • 112לייקים

מה זה

מדובר במודל Qwen3.5-9B שעבר כוונון עדין בשיטת זיקוק בעזרת Unsloth ו־LoRA, על גבי נתוני הסקת מסקנות שנוצרו על ידי מודל המורה GLM-5.1. האימון התבסס על גרסה מסוננת של מאגר נתונים הכולל כמיליון דוגמאות חשיבה, במטרה להטמיע דפוס עבודה מובנה של פירוק בעיות, בדיקת אילוצים ואימות הנחות לפני הפקת התשובה הסופית. המשימה המוגדרת שלו היא עיבוד תמונה וטקסט לטקסט.

היוצר מדגיש שלא מדובר בזינוק פתאומי ביכולות הגולמיות לעומת מודל הבסיס, אלא בשיפור הדרגתי ביציבות. השינוי מורגש בעיקר בסדר הלוגי של התוצרים, בעמידה בהוראות מורכבות ובשרשראות חשיבה מאורגנות יותר באנגלית, סינית, יפנית וספרדית.

מתאים ל

  • פירוק משימות בקוד ומתמטיקה

    מתאים לפתרון תרגילים וניתוח אלגוריתמי שדורשים מעקב צעד אחר צעד לפני קבלת הפלט.

  • ניתוח לוגי אופליין

    פתרון טוב לעיבוד מקומי של נתונים בסביבה מבודדת שבה אסור להוציא מידע לרשת חיצונית.

  • מחקר על זיקוק מודלים

    משמש בסיס להבנת ההשפעה של דאטה מ־GLM-5.1 על מבנה החשיבה של מודל קטן יחסית.

איפה זה נופל

זהו פרויקט עצמאי של מפתח יחיד ללא תשתית של מעבדת מחקר, והיוצר מבהיר שהמודל מוגדר כגרסת בדיקה למטרות לימוד ומחקר בלבד. שרשרת החשיבה שלו עלולה לסבול לעיתים מאי יציבות, לולאות לוגיות וסטייה מהנושא במהלך פתרון הבעיה.

בנוסף, עובדות חיצוניות שנכללות בתוך שלבי החשיבה עלולות להכיל הזיות, בעיקר כשמדובר באירועים מהעולם האמיתי. עברית אינה מופיעה ברשימת השפות הנתמכות של הפרויקט, כך שאי אפשר לבנות עליו לפעולות הדורשות הבנה מקומית מדויקת.

אותה משפחה

Qwen3.5-9B-GLM5.1 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה שוטפת בעברית?

השפות שצוינו במפורש במפרט הן אנגלית, סינית, יפנית וספרדית בלבד. ייתכן שהוא יגיב בעברית בסיסית בגלל מודל הבסיס, אבל תהליכי החשיבה ופירוק המשימות לא אומנו לשפה זו ולא הייתי מסתמך עליו למשימות מקומיות.

האם הוא חכם יותר ממודל הבסיס של Qwen?

הוא לא בהכרח יודע יותר עובדות, אלא מציג תהליך חשיבה מובנה יותר שנלמד מהמורה GLM-5.1. השיפור מתבטא בעיקר ביציבות של שלבי ההסקה ובסדר שבו התשובה מנוסחת, ולא בתוספת של ידע חדש.

איך מריצים

המאגר כולל 8 קבצים בנפח כולל של 32.2 גיגה בייט בפורמט GGUF, מה שאומר שאפשר להריץ אותו מקומית על מגוון מנועים מבוססי llama.cpp. כדי להריץ את הגרסאות הכבדות יותר בחבילה בצורה חלקה תצטרכו כרטיס מסך עם לפחות 16 עד 24 גיגה בייט זיכרון, או מעבד חזק עם מספיק זיכרון מערכת פנוי אם מוותרים על מהירות.

אם אתם מחפשים מענה מהיר בייצור בלי לתחזק שרתים ייעודיים, קריאה ל־API של מודל מסחרי גדול תהיה פשוטה וזולה יותר. הרצה עצמית כאן משתלמת בעיקר כשעובדים בסביבה סגורה ללא רשת או כשיש צורך בניתוח אופליין שלא תלוי בספק חיצוני.

ollama run hf.co/Jackrong/Qwen3.5-9B-GLM5.1-Distill-v1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח בפרויקט הוא Apache 2.0, שמאפשר שימוש חופשי, שינוי הקוד והפצה מסחרית תחת תנאי מתן קרדיט והצהרת שינויים. יחד עם זאת, בדף המודל נכתב במפורש כי מדובר בגרסת ניסוי שנועדה לצורכי מחקר אקדמי ולמידה בלבד. סתירה זו מחייבת בדיקה זהירה לפני שמשלבים את המשקולות במוצר מסחרי פעיל.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗