GPT
Q

Qwythos-9B-v2

קוד פתוח

empero-aiapache-2.02026-07-09

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • qwythos

גרסה נטולת צנזורה על בסיס Qwen3.5 שפותרת בעיות חזרתיות ומיועדת להסקה עמוקה. היא מציעה חלון הקשר ענק של מיליון טוקנים בלי לחסום בקשות מחקר רגישות.

  • 9.7Bפרמטרים
  • 1,048,576טוקנים בהקשר
  • 18.0 GBמשקל הקבצים
  • 4,334הורדות בחודש

מה זה

המודל מבוסס על Qwen3.5 ומשתמש בארכיטקטורה היברידית של Gated-DeltaNet ותשומת לב מלאה, יחד עם מנגנון חיזוי מרובה טוקנים. השינוי המרכזי כאן לעומת הגרסה הראשונה הוא תיקון התנהגות הלופים. בבדיקות דגימה גרידית, שיעור החזרות ירד משישה נקודה שבעה אחוזים לאפס עגול, מה שמאפשר להריץ אותו בלי תלות בענישת חזרות מלאכותית.

מבחינת ביצועים, הוא שומר על רמת החשיבה של קודמו. במבחן MMLU הוא מגיע ל־83.8% בשרשרת מחשבה לעומת 69.6% במדידה רגילה של חמש דוגמאות, מה שמראה שהוא זקוק למרחב יצירה כדי להגיע לתוצאות טובות. בבדיקות מתמטיקה ומדעים כמו GSM8K ו־ARC-Challenge הוא מציג ציונים של 93.6% ו־96.4%, אבל בקוד הוא רושם ירידה קלה לעומת מודל הבסיס המקורי.

מתאים ל

  • מחקר אבטחה וסייבר

    מדיניות אפס סירובים מאפשרת ניתוח חולשות וסימולציות תקיפה בלי שהמודל יחסום את השאילתות.

  • מחקר פרמקולוגי ורפואי

    מתאים לניתוח מנגנוני פעולה של תרופות וחומרים פעילים ללא חסימות בטיחות מיותרות.

  • עיבוד מסמכים ארוכים

    תמיכה מובנית בחלון הקשר מורחב מאפשרת לנתח תיעוד טכני נרחב בריצה אחת.

איפה זה נופל

היוצרים מודים שמדובר בעדכון תחזוקה ולא בקפיצת יכולת. במבחן הקוד HumanEval המודל ירד ל־77.4% לעומת 81.7% במודל הבסיס של Qwen3.5, ירידה שהיא תוצר לוואי של אימוני ההסקה. בנוסף, ראש החיזוי נלקח ישירות ממודל הבסיס ולא אומן מחדש יחד עם המשקלים המעודכנים, כך ששיעור הקבלה שלו בניפוי ספקולטיבי עשוי להיות נמוך. המודל גם מוגדר באנגלית בלבד, וכל המדדים הופקו במערכת בדיקה פנימית של החברה ולא במבחנים רשמיים חיצוניים.

אותה משפחה

Qwythos יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל עובד טוב בעברית?

הכרטיס מגדיר את המודל לשפה האנגלית בלבד. מודלי הבסיס מסדרה זו כוללים לעיתים תמיכה רב־לשונית מסוימת, אבל כאן המפתחים לא ייעדו אותו לעברית ולא ביצעו עליה בדיקות.

האם חייבים להגדיר repetition_penalty בהרצה?

לא. מטרת העדכון הייתה ביטול תופעת החזרתיות מהשורש, והיוצרים מציינים שאפשר להריץ אותו בדגימה גרידית או בטמפרטורה נמוכה בלי להסתמך על ענישת חזרות.

איך מריצים

המשקלים תופסים 18.0 גיגה בייט בפורמט bfloat16, כך שצריך כרטיס גרפי עם מספיק זיכרון וידאו ייעודי כדי לטעון אותם במלואם. למרות שהמימוש הטכני יושב על מחלקת תמונה וטקסט, המפתחים מציינים שמדובר בטקסט בלבד בפועל וממליצים להגדיר אפס תמונות ווידאו בזמן הפעלה דרך vLLM.

אם אתם מתכננים לנצל את מלוא חלון ההקשר, צריכת הזיכרון עבור שכבות התשומת לב תגדל מאוד מעבר למשקל הבסיסי של המודל. במצב כזה, או אם אין לכם חומרה ייעודית מתאימה, שירותי אירוח חיצוניים שמחזיקים תשתית מוכנה יחסכו את כאב הראש התפעולי.

from transformers import pipeline

pipe = pipeline("text-generation", model="empero-ai/Qwythos-9B-v2")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מתיר שימוש מסחרי חופשי, שינוי הקוד והפצה של המודל בתוך מוצרים. התנאי המרכזי הוא שמירה על הודעות זכויות היוצרים וצירוף עותק של הרישיון המקורי בכל הפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗