GPT
Q

Qwen3.5-9B-GLM5.1-Distill-v1

קוד פתוח

Jackrongapache-2.02026-04-15

  • gguf
  • safetensors
  • qwen3_5
  • llama.cpp
  • local-inference

גרסת זיקוק עצמאית של מודל פתוח ממוקד חשיבה, שנועדה לתת יכולת פתרון בעיות מובנית בלי לשלם על מודלי ענק. הוא מתאים למי שרוצה הרצה מקומית יציבה למשימות הגיון.

  • 9.7Bפרמטרים
  • 262,144טוקנים בהקשר
  • 18.0 GBמשקל הקבצים
  • 1,922הורדות בחודש

מה זה

מדובר בהתאמה של מודל בסיס בגודל תשעה מיליארד פרמטרים, שעבר אימון מונחה בשיטת זיקוק ידע בעזרת נתונים שנלקחו ממודל גדול יותר. המטרה כאן היא לא להוסיף ידע עובדתי חדש, אלא לשנות את האופן שבו המודל מפרק שאלות מורכבות לחלקים קטנים. במקום לענות מיד, הוא בונה שלבי עבודה שכוללים זיהוי אילוצים, חיבור מושגים ובדיקת הנחות יסוד לפני הפלט הסופי.

ההבדל מול מודלים אחרים בקטגוריית המשקל הזו הוא סגנון החשיבה המובנה שנלקח מנתוני המורה. היוצר מבהיר שהשיפורים הדרגתיים ומתמקדים בעיקר בעמידה בהוראות ובארגון התשובה, ולא בזינוק חד ביכולות הגולמיות. אין בעמוד ציוני מבחנים מספריים סטנדרטיים, ולכן אי אפשר להוכיח שהוא מנצח מודלים אחרים במבחני ביצועים מקובלים מעבר למבנה התשובה המסודר.

מבחינת שפות, הרשימה הרשמית כוללת אנגלית, סינית, יפנית וספרדית. עברית לא מצוינת במפרט התמיכה של המאמן, ולכן כל שימוש בשפה המקומית דורש בדיקה מעשית שלכם לפני שמתכננים עליו.

מתאים ל

  • פירוק בעיות לוגיות במחשב

    הוא מתוכנן לעבוד לפי שלבים מוגדרים ולנתח תנאים מורכבים באופן מסודר.

  • עבודה עצמאית ללא רשת

    הגודל מאפשר פריסה מקומית מלאה על חומרה ייעודית בלי להוציא נתונים החוצה.

  • מחקר על זיקוק הסברים

    הוא נבנה כגרסת מבחן שנועדה לבחון העברת מבנה חשיבה ממודל מורה למודל קטן.

איפה זה נופל

היוצר מצהיר בגלוי שמדובר בפרויקט ניסיוני של אדם פרטי ללא תשתית של מעבדת מחקר גדולה. שרשרת המחשבה עלולה לסבול מחוסר יציבות, לולאות לוגיות וסטיות מהנושא, לצד הזיות בעובדות מציאותיות בזמן החשיבה. בנוסף, חומר האימון נשען על מחקר שמצביע על ירידה אפשרית במנגנוני הבטיחות בעקבות אימון חשיבה ממושך. הטקסט מגדיר את הכלי למחקר אקדמי בלבד ולא למערכות ייצור רגישות.

אותה משפחה

Qwen3.5-9B-GLM5.1 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים ליישום עסקי שפונה ללקוחות קצה?

לא מומלץ כרגע. היוצר מציין במפורש שמדובר בגרסת בדיקה ניסיונית למחקר ולמידה, שעלולה להיכנס ללולאות מחשבה ולהמציא עובדות.

איך הביצועים שלו בהשוואה לגרסת הבסיס הרגילה?

השינוי העיקרי הוא בסדר החשיבה ובארגון הפלט לפי שלבים. אין בעמוד נתוני מדידה רשמיים, והיוצר מבהיר שהשיפורים הדרגתיים ולא דרמטיים.

איך מריצים

המשקל בפורמט המקורי תופס 18 ג'יגה בייט בזיכרון, מה שמחייב כרטיס מסך מקצועי עם 24 ג'יגה זיכרון כדי להריץ אותו בלי לחנוק את המערכת. מי שרוצה לעבוד על חומרה ביתית צנועה יותר או על מחשב נייד יצטרך גרסאות מכווצות שמתאימות לספרייה הרשומה, שם אפשר לרדת לכרטיסים נגישים בהרבה.

אם אתם לא צריכים פרטיות מלאה או פעולה מקומית בלי רשת, שווה לשקול פנייה לשירותי ענן של מודלים מוכנים. זה חוסך תחזוקת שרתים ומספק לרוב ביצועים עקביים יותר בלי להתעסק בהגדרות תשתית עצמאיות.

pip install -U huggingface_hub
hf download Jackrong/Qwen3.5-9B-GLM5.1-Distill-v1

הרישיון

הרישיון הוא אפאצ'י שתיים, שמאפשר שימוש חופשי כולל הטמעה במוצרים מסחריים ושינוי קוד. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, והסרת אחריות משפטית מיוצרי המודל.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗