GPT
Q

Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NM-DAU

קוד פתוח

DavidAUapache-2.02026-08-25

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • heretic

כיול ללא חסימות על בסיס ארכיטקטורת Qwen3.8 בגודל 28 מיליארד פרמטרים. הוא מיועד למי שמחפש הסרת מגבלות בטיחות לצד חלון הקשר ענק וקיצור זמני החשיבה.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 4,469הורדות בחודש

מה זה

המודל הוא שילוב של מספר כיולים על גבי Qwen בגודל 28B, שעבר תהליך הסרת חסמי בטיחות ולאחריו שלב אימון מתקן. המטרה המרכזית בפיתוח הייתה לפתור את בעיית החשיבה העודפת, כלומר לייצר פחות טוקנים של תהליך חשיבה פנימי, בין חצי לעשירית מהרגיל, בלי לאבד מעומק התשובות.

במדדי ההסקה נרשם שיפור ניכר מול דגמי המקור. במבחן ARC-C בפורמט mxfp8 הוא השיג ציון של 0.732 לעומת 0.591 במודל הבסיס, ובמבחן ARC-E הגיע ל־0.888 לעומת 0.782. בבדיקות של המפתח, גרסאות מקווצות ב־4 ביט שמרו על קרוב ל־99 אחוז מהביצועים של 8 ביט. בנוסף למלל, הארכיטקטורה מוגדרת למשימות שמשלבות תמונה וטקסט ומציעה חלון הקשר של 262,144 טוקנים.

מתאים ל

  • כתיבה יצירתית ללא סינון

    יצירת דיאלוגים ופרוזה חופשית בלי שהמודל יסרב לייצר שפה בוטה, קונפליקטים חריפים או תוכן לא מצונזר.

  • ניתוח מסמכים ארוכים באנגלית

    ניצול חלון הקשר של 262 אלף טוקנים לעיבוד טקסטים ארוכים, כשהמודל מקצר את תהליך החשיבה וחוסך זמן יצירה.

  • חקר בטיחות במודלי שפה

    בדיקת התנהגות מודלים שעברו הסרת הגנות מוחלטת והערכת היעילות של אימוני תיקון לאחר decensoring.

איפה זה נופל

ההסרה האגרסיבית של מנגנוני הבטיחות גורמת למודל לפלוט קללות, שפה בוטה ותכנים לא מבוקרים ללא שום סינון עצמי, כפי שמוצג בדוגמאות הרשמיות. מעבר לזה, המודל מסומן לתמיכה באנגלית בלבד. התיעוד מציג עשר גרסאות שונות בשלבי בדיקה שונים, מה שמעיד על פרויקט ניסיוני מאוד ולא על מוצר יציב שהושלם.

שאלות
נפוצות

האם המודל מתאים לשימוש בצ'אטבוט שפונה ללקוחות?

ממש לא. המודל עבר הסרת הגנות מכוונת ומייצר שפה גסה ובוטה בלי שום מחסום. שימוש בו מול לקוחות קצה יחשוף אתכם לתשובות פוגעניות ללא התרעה מוקדמת.

האם אפשר להריץ אותו ישירות מהקבצים במאגר הזה על מחשב ביתי?

לא בקלות. הקבצים כאן שוקלים 51.8 גיגה בייט בפורמט מלא. למחשב ביתי תצטרכו להוריד את גרסאות ה־GGUF המקווצות ל־4 ביט מהמאגר המקביל שהיוצר פרסם.

איך מריצים

במשקל מלא של 51.8 גיגה בייט ב־bfloat16, המודל דורש לפחות שני כרטיסי מסך מקצועיים עם 32 עד 48 גיגה זיכרון כדי לרוץ בצורה סבירה, במיוחד אם רוצים לנצל חלון הקשר רחב. לרוב המשתמשים ההרצה הזו לא מעשית על חומרה מקומית רגילה.

מי שמתכוון להריץ אותו על כרטיס בודד של 16 או 24 גיגה יצטרך לפנות ישירות לגרסאות ה־GGUF המקווצות ב־4 ביט, שזמינות במאגר נפרד. אם אין לכם שרת ייעודי או צורך מובהק בעיבוד מקומי של תכנים ללא סינון, החזקת תשתית מקומית למודל בגודל הזה יקרה מדי ומורכבת ביחס לחלופות ענן.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NM-DAU")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. אפשר לשלב אותו במוצרים מסחריים בלי לחשוף את השינויים שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗