GPT
Q

Qwen3.8-27B-OBLITERATED-Mythos-Class-Agentic

קוד פתוח

medismeraapache-2.02026-09-06

  • safetensors
  • qwen3_5
  • qwen
  • qwen3.8
  • abliterated

גרסה נטולת סינונים של Qwen בגודל 28 מיליארד פרמטרים שמתקנת קריאות לכלים ולולאות מחשבה אינסופיות. מי שבוחר בה מחפש סוכן טכני עצמאי שלא מסרב לפקודות סייבר ותכנות נמוך.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 1,304הורדות בחודש

מה זה

הבסיס כאן הוא מודל של עליבאבא שעבר הסרת מנגנוני סירוב וקיבל עדכון מקיף לתבנית השיחה. הבעיה המרכזית בגרסאות קודמות הייתה זריקה שקטה של קריאות לכלים וכניסה ללולאות של תגיות חשיבה ללא עצירה. היוצר הוסיף תבנית Jinja2 בנפח 9.4 קילובייט עם 22 נתיבי הפעלה לכלים, יחד עם שיטת פירוק משימות שמאלצת את המודל לבדוק את עצמו ולעצור.

מבחינת מבנה, שולבו 5.56 מיליארד פרמטרים של Linear Attention ומודל מצב לצד שכבות תשומת הלב הרגילות, במטרה להחזיק הקשר ארוך בלי קריסה. במבחן הסירוב הוא השיג מאה אחוזי היענות על שלושים שאילתות בדיקה, כלומר אפס סירובים בנושאי אבטחה ורשתות. במבחני כתיבת קוד עצמאית הוא הגיע לציון 98 בניתוח מערכת הפעלה וציון 96 במימוש מודול קריפטוגרפי של 640 שורות.

מתאים ל

  • סוכני בדיקות חדירה ואבטחה

    הוא לא מסרב לפקודות בדיקה, פונה ישירות לפקודות מערכת כמו nmap וסוקטים, ומחזיק הקשר ארוך של יומני שרת.

  • פיתוח כלי קוד בארכיטקטורת סוכן

    תבנית השיחה שלו תומכת ב־Hermes וב־Aider בלי לאבד קריאות לכלים, עם יצירה של עד 16,384 טוקנים במענה בודד.

  • ניתוח מערכות והנדסה לאחור

    אוצר המילים של המודל עבר אופטימיזציה לשפות כמו אסמבלי, C ו־Rust, והוא יודע לעקוב אחר תהליכי מערכת הפעלה.

איפה זה נופל

המודל הזה אינו כולל מנגנוני בטיחות, וקצב הסירוב שלו עומד על אפס עגול. הוא יריץ פקודות בדיקת חדירות וקוד רגיש בלי שום אזהרה, מה שהופך אותו למסוכן בסביבות שדורשות בקרת תוכן. בנוסף, חלון ההקשר מוגדר תיאורטית ל־256 אלף טוקנים, אבל נבדק בפועל בייצור רק עד 128 אלף. תמיכת השפות המוצהרת מוגבלת לאנגלית, סינית וערבית, כך שביצועיו בעברית לא נבדקו כלל בחומר הטכני ודורשים בדיקה זהירה לפני שימוש.

שאלות
נפוצות

האם אפשר להריץ אותו על כרטיס מסך ביתי רגיל?

כן, אבל רק אם יש לכם כרטיס עם 24 גיגה זיכרון כמו RTX 3090 או 4090. תצטרכו להשתמש בענף ה־AWQ שדורש כ־16 גיגה זיכרון, כי גרסת המקור דורשת שני כרטיסים כאלה לפחות.

איך פותרים את בעיית לולאות החשיבה שהייתה בגרסאות הקודמות?

הגרסה הזו מכילה פרוטוקול מובנה בתוך ה־tokenizer שמאלץ את המודל לפרק משימות, לבדוק כשלים ולסגור את תגית החשיבה. בנוסף מומלץ להריץ אותו עם טמפרטורה של 0.65 וקנס חזרתיות של 1.15 לפי הגדרות המפתח.

איך מריצים

כדי להריץ את גרסת הדיוק המלא בפורמט Safetensors צריך שני כרטיסי A100 או שני RTX 4090, מאחר והיא דורשת סביב 60 גיגה זיכרון גרפי. אם יש לכם כרטיס יחיד של 24 גיגה כמו RTX 3090 או 4090, ענף ה־AWQ בארבעה ביט נכנס ב־16 גיגה זיכרון ועובד ישירות מעל vLLM או SGLang. מנוע ההרצה מסתמך על Safetensors בלבד, ללא קובצי GGUF.

אם אין לכם שרת ייעודי או כרטיס מתאים עם 24 גיגה פנויים, עדיף לחבר שירות ענן שמחזיק את המודל כנקודת קצה של vLLM, במיוחד אם מתכוונים לנצל את חלון ההקשר המלא שמגיע עד 256 אלף טוקנים.

pip install -U huggingface_hub
hf download medismera/Qwen3.8-27B-OBLITERATED-Mythos-Class-Agentic

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד והמשקלים, להפיץ אותם מחדש ולשלב אותם במוצרים סגורים. התנאי העיקרי הוא מתן קרדיט ברור ושמירה על הצהרת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗