GPT
Q

Qwen3.8-27B-heretic-ara

קוד פתוח

trohrbaughapache-2.02026-08-14

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • heretic

גרסה נטולת סינון למודל של 27 מיליארד פרמטרים, שמיועדת למשימות תכנות וסוכנים בלי סירובים מלאכותיים. היא מבינה תמונות ווידאו ישירות ומציעה חלון הקשר עצום.

  • 27Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 11,991הורדות בחודש

מה זה

מדובר בעיבוד של Qwen3.8-27B שעבר הסרת סינון באמצעות שיטת ARA של Heretic בין שכבות 26 ל־56. הבסיס הוא מודל ראייה ושפה רב-אופני צפוף, עם תמיכה מובנית בטקסט, דיאגרמות ווידאו באורך שעות, לצד מצב חשיבה שמופעל כברירת מחדל וניתן לכוונון לפי עומק.

הבדיקה המרכזית בכרטיס מראה שהמודל המקורי סירב ל־99 מתוך 100 בקשות, בעוד שהגרסה הנוכחית ירדה לאפס סירובים מוחלט, תוך שמירה על מדד KL divergence נמוך של 0.0535. מבחינת יכולות טהורות, מודל המקור הציג ציונים חזקים מאוד בקוד ובסוכנות, כמו 90.3 ב־LiveCodeBench ו־61.7 ב־SWE-bench Pro, אך המפרסם הנוכחי לא צירף בדיקות מקיפות שמוכיחות שהציונים האלה נשמרו במלואם אחרי הפשטת המשקולות.

מתאים ל

  • סוכני בדיקות אבטחה

    כתיבת סקריפטים ומחקר חולשות בלי לחטוף סירובים על בקשות שמכילות קוד זדוני.

  • סביבות פיתוח לא מפוקחות

    ניתוח מאגרי קוד וביצוע פקודות טרמינל ללא חסימות תאגידיות שמפריעות לרצף העבודה.

  • פענוח מסמכים טכניים ווידאו

    שילוב הבנת מדיה וטקסט בחלון ארוך של 262 אלף טוקנים לניתוח שעות הקלטה או דיאגרמות.

איפה זה נופל

הסרת סירובים באמצעות מניפולציה על השכבות עלולה לפגוע ביציבות ההסקה ובדיוק של משימות מורכבות. בכרטיס המודל לא מופיעים מבחני ביצועים שמראים אם יכולות התכנות החזקות של מודל המקור נשחקו, למעט מדידת הסטייה הכללית. בנוסף, מודל כזה יפלוט תוכן פוגעני, מסוכן או שגוי בלי שום מנגנון בלימה עצמי.

שאלות
נפוצות

האם המודל באמת לא מסרב לשום פקודה?

לפי מבחן של 100 בקשות שהמפתח הריץ, המודל ענה על כולן ולא סירב לאף אחת. עם זאת, הוא עבר שינוי נקודתי בשכבות הפנימיות, כך שבמקרים מסוימים הוא עשוי להגיב בצורה פחות קוהרנטית במקום לסרב.

האם כדאי לשים אותו ישר בסביבת ייצור מול לקוחות?

לא מומלץ בכלל בלי שכבת הגנה חיצונית משלכם. המודל איבד את מנגנוני הסינון המובנים, וכל קלט עוין של משתמש קצה יכול לגרום לו לייצר תוכן לא הולם או בעייתי משפטית.

איך מריצים

המשקל הגולמי עומד על 51.8 גיגה-בייט בפורמט Transformers, כך שלהרצה מלאה ללא כימות תצטרכו לפחות 60 עד 80 גיגה-בייט של VRAM. מערך של שני כרטיסי RTX 4090 יחייב כימות, בעוד כרטיס בודד של A100 או H100 בנפח 80 גיגה-בייט יוכל להחזיק אותו בבטחה.

אם כל מה שאתם צריכים זה את ביצועי הקוד והסוכנות הרשמיים, שימוש ב־API של Qwen Cloud יחסוך את כאב הראש התשתיתי ויעניק חלון של מיליון טוקנים. לעומת זאת, אם אתם חייבים תוצרים ללא מעצורי בטיחות ובלי ניטור של ספק ענן, ההרצה המקומית היא האפשרות היחידה.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="trohrbaugh/Qwen3.8-27B-heretic-ara")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא Apache 2.0. הוא מתיר שימוש מסחרי, שינוי קוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. אפשר לשלב אותו במוצרים מסחריים בלי לחשוף את קוד המקור שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗