GPT
Q

Qwythos-9B-Claude-Mythos-5-1M

קוד פתוח

empero-aiapache-2.02026-06-19

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • qwen3.5

התאמה מלאה של קוון לתהליכי חשיבה ארוכים ושימוש בכלים. הוא פונה למי שמחפש הרצה מקומית קומפקטית עם חלון של מיליון טוקנים וללא מנגנוני סירוב מובנים.

  • 9.4Bפרמטרים
  • 1,048,576טוקנים בהקשר
  • 17.5 GBמשקל הקבצים
  • 22,944הורדות בחודש

מה זה

היוצרים לקחו את בסיס הטקסט של קוון ואימנו אותו מחדש על חצי מיליארד טוקנים של שיחות חשיבה מורכבות. המטרה כאן היא להכניס יכולת חשיבה מפורטת לתוך משקל של תשעה מיליארד פרמטרים. השילוב של ארכיטקטורת קשב היברידית עם הרחבת יארן מובנית מאפשר לו לקבל קלט באורך חריג של עד מיליון טוקנים, בלי להזדקק לשינויי קונפיגורציה בזמן ריצה.

במבחני הביצועים הוא מציג שיפור חד מול מודל הבסיס, עם זינוק לציון של 0.575 בבחינת הידע הכללי ומעבר של 80% בפתרון בעיות מתמטיות. עם זאת, במבחני שאלות מומחה הוא קיבל 0.580 לעומת 0.630 בבסיס, ירידה קלה שמראה שהאימון התמקד בעיקר במעקב אחרי הנחיות, הפעלת כלי פייתון וחיפוש, ולא בהכרח בשינון עובדות סגורות.

מתאים ל

  • ניתוח מאגרי קוד

    חלון הטוקנים העצום קולט עשרות קבצים במקביל ומבצע מעקב ארכיטקטוני ללא חלוקה למקטעים.

  • סוכני אוטומציה ובדיקות

    המבנה הפנימי מפיק קריאות פונקציה מסודרות ומריץ קוד לאימות נתונים בסבבי עבודה ארוכים.

  • מחקר אבטחה ורפואה

    היעדר מנגנוני סירוב מאפשר תחקור מעמיק של פגיעויות, מנגנוני הגנה ותרכובות ללא חסימות.

איפה זה נופל

האימון נעשה ללא סינון תוכן, כך שהוא עונה ישירות על נושאים כמו אבטחת מידע ורפואה בלי להציב מחסומים. אם המוצר שלכם פונה למשתמשי קצה, תצטרכו לבנות שכבת בדיקות משלכם. בנוסף, הוא כותב תמיד בלוק חשיבה פנימי שצריך לחתוך לפני שמציגים את הפלט, ובטמפרטורה נמוכה מדי הוא נוטה להיתקע בלולאות חזרתיות. שימוש בהרחבת ההקשר המלאה גורר ירידה מסוימת באיכות הטקסט בקלטים קצרים, ואימון המודל נגע רק בטקסט והשאיר את רכיב התמונה המקורי ללא בדיקה.

אותה משפחה

Qwythos-9B-Claude-Mythos-5 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

הכרטיס מדווח על אנגלית בלבד. הבסיס מכיל יכולות רב לשוניות מסוימות, אך אימון ההמשך התמקד בטקסט אנגלי ולכן פלט בעברית עלול להיות משובש או לא יציב.

איך מונעים ממנו להיתקע בחזרות?

היוצרים ממליצים להגדיר טמפרטורה של 0.6 ועונש חזרתיות של 1.05. קידוד גרידי או טמפרטורה נמוכה מדי גורמים למנגנון החשיבה להסתובב סביב עצמו.

איך מריצים

המשקל עומד על 17.5 גיגה בייט בקבצים מקוריים. כרטיס בודד של 24 גיגה יספיק לטעינה בסיסית, אבל ניצול החלון המלא דורש מאיצים חזקים בהרבה, כמו כרטיס שרת של 80 גיגה או שרשור מספר כרטיסים. השרתים של וי אל אל אם או אס ג'י לאנג מריצים אותו ישירות עם דגלי האורך המתאימים, ומחייבים התקנת קרנלים ייעודיים לתשתיות קשב לינארי כדי למנוע זחילה בביצועים.

אם השימוש שלכם קצר ממאתיים אלף טוקנים ולא דורש הרצה מקומית מטעמי פרטיות, פנייה לשרת מרוחק תחסוך את כאב הראש של תפעול הזיכרון והתלויות הטכניות.

from transformers import pipeline

pipe = pipeline("text-generation", model="empero-ai/Qwythos-9B-Claude-Mythos-5-1M")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י שתיים, שמתיר שימוש מסחרי, שינוי קוד והפצה של המשקלים במוצרים סגורים. התנאי המרכזי הוא שמירה על הודעות זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗