GPT
Q

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-MTP

קוד פתוח

DavidAUapache-2.02026-07-28

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • unsloth

גרסה מכווננת וחסרת צנזורה של מודל 28 מיליארד פרמטרים שפותחה בידי הקהילה. מתאים למי שרוצה ביצועי פתרון בעיות גבוהים יחד עם הסרת סירובים כמעט מוחלטת בלי תלות בספק ענן.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 7,868הורדות בחודש

מה זה

מדובר באיחוד וכוונון רב שלבי על בסיס משפחת המודלים של Qwen, תוך שימוש במאגרי מידע שונים וטכניקות איטרטיביות שנבחנו בעזרת Unsloth. המודל שומר על יכולות הראייה וההקשר של מעל 262 אלף טוקנים מהמקור, ומביא ארכיטקטורה היברידית שמשלבת שכבות תשומת לב מסוג DeltaNet. הוא כולל תמיכה בחיזוי מרובה טוקנים כדי להאיץ את מהירות הפליטה בהרצה מקומית.

במדד ARC-C לפתרון בעיות והיגיון, המודל חצה את רף 700 הנקודות גם בקוונטיזציה של 8 ביט (0.711) וגם ב־4 ביט (0.701), לעומת 0.647 במודל הבסיס המקורי. המשמעות בפועל היא יכולת טובה יותר להבין הוראות מורכבות ולהתמודד עם שאלות היגיון רב שלביות בלי לאבד דיוק ברמות דיחוס נמוכות.

בנוסף, המודל עבר תהליך הסרת צנזורה בעזרת כלי Heretic ושיטת ARA. לפי המדידות, שיעור הסירובים לבקשות משתמש צנח מ־99 מתוך 100 במודל הרשמי ל־4 מתוך 100 בלבד בגרסה זו, כמעט בלי פגיעה במבנה המשקלים המקורי.

מתאים ל

  • פתרון בעיות לוגיות מורכבות

    ציוני ARC-C גבוהים בקוונטיזציה של 4 ו־8 ביט מאפשרים להריץ משימות היגיון מקומיות בדיוק מרשים.

  • מחקר וניתוח טקסט ללא סירוב

    שיעור סירובים של 4 אחוזים מתאים למי שחוקר תכנים גולמיים בלי חסימות מערכתיות של שרתי ענן.

  • ניתוח מסמכים ותמונות ארוכים

    חלון הקשר של 262,144 טוקנים בשילוב קובץ ראייה מאפשר סריקה של קבצים מרובי עמודים ברצף.

איפה זה נופל

למרות שהסירובים הוסרו כמעט לגמרי, ברירת המחדל שלו נותרה מתונה מאוד. יצירת תכנים בוטים, קללות או אימה דורשת הנחיה ישירה ומפורטת, ואם לא תגדירו מילים ספציפיות הטקסט יצא יבש ואנמי. בנוסף, יכולת הראייה אינה מובנית בקובץ השפה עצמו, וחובה להוריד קובץ נפרד כדי לעבד תמונות. המודל מתועד באנגלית ובסינית בלבד ואינו כולל התאמה ייעודית לעברית.

שאלות
נפוצות

האם המודל תומך בעברית באופן שוטף?

האימון והתיעוד מתמקדים באנגלית ובסינית בלבד. המודל מסוגל לפלוט עברית בזכות משקלי הבסיס של Qwen, אך לא בוצע בו כוונון מיוחד לשפה וייתכנו שגיאות ניסוח בהקשרים מורכבים.

מה ההבדל בין גרסאות MTP לגרסאות רגילות?

גרסאות MTP מאפשרות חיזוי של שני טוקנים במקביל ומגיעות למהירות פליטה גבוהה יותר. עם זאת, אם שיעור הקבלה שלהן יורד מתחת ל־50 אחוזים עקב טמפרטורה גבוהה, הגרסאות הרגילות יפעלו מהר ויציב יותר.

האם אפשר להשתמש בו ישירות לניתוח תמונות?

ארכיטקטורת המודל תומכת בראייה, אבל משקלי השפה לבדם אינם מספיקים. כדי לנתח תמונות ביישומי צד לקוח חובה להוריד ולהגדיר קובץ mmproj תואם לצד קובץ המודל.

איך מריצים

המשקלים המקוריים בפורמט Transformers שוקלים 51.8 גיגה בייט ומחייבים לפחות שני כרטיסי מסך של 32 או 48 גיגה בייט כדי לטעון אותם לזיכרון בבטחה. כדי להריץ על חומרה ביתית סבירה יש להשתמש בגרסאות GGUF מקוונטטות, כאשר גרסת 4 ביט תרוץ היטב על כרטיס עם 24 גיגה בייט זיכרון דוגמת RTX 3090 או 4090.

אם אתם משתמשים בגרסאות MTP לחיזוי מרובה טוקנים, יש לשמור על טמפרטורה וקנס חזרתיות על 1.0 כדי למנוע ירידה בשיעור קבלת הטוקנים מתחת ל־50 אחוזים. אם אינכם זקוקים לראיית תמונה מקומית או להסרת צנזורה ודרוש לכם שירות יציב בריבוי משתמשים, קריאה ל־API מסחרי תחסוך את עלויות החומרה והתחזוקה.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-MTP")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון Apache 2.0 המאפשר שימוש מסחרי, שינוי קוד והפצה חופשית ללא תשלום תמלוגים. התנאי העיקרי הוא שמירת הודעות זכויות היוצרים והרישיון המקורי בכל הפצה של התוכנה או התוצרים הנגזרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗