GPT
Q

Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved

קוד פתוח

llmfan46apache-2.02026-05-06

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • heretic

גרסה לא מצונזרת של דגם 27 מיליארד פרמטרים שנועדה לענות בלי סירובים והטפות מוסר. מתאימה למי שבונה אוטומציות לפיתוח תוכנה וצריך תגובות ישירות על כל בקשה.

  • 27Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 2,530הורדות בחודש

מה זה

הבסיס כאן הוא מודל שפה ותמונה עם 27 מיליארד פרמטרים, שעבר תהליך הסרת צנזורה באמצעות כלי בשם Heretic בשיטת אבלציה אורתוגונלית ששומרת על גודל המשקלים. הדגש העיקרי בגרסה הזו הוא שמירה מלאה על 15 רכיבי הניבוי מרובה הצעדים, מה שמבטיח פעולה תקינה של מנגנוני הריצה המתקדמים שתוכננו במקור.

ההבדל המרכזי מול המודל המקורי מתבטא בנכונות לענות. לפי הבדיקה בכרטיס, שיעור הסירובים צנח מ־92 מתוך 100 ל־6 בלבד, ירידה של 94 אחוזים בסירובים. התהליך הזה כמעט ולא פגע ביכולת הכללית, כפי שנמדד במבחן הידע MMLU שבו הציון ירד מ־86.65 אחוזים ל־85.67 אחוזים, עם מרחק סטטיסטי מזערי של 0.0021 מהמקור.

מתאים ל

  • סוכן כתיבת קוד עצמאי

    מאפשר הרצת משימות פיתוח ואוטומציה ללא עצירות עקב סירובים שגויים על פקודות מערכת.

  • ניתוח מסמכים רגישים

    מנתח טקסטים משפטיים או ביטחוניים מורכבים בחלון הקשר ארוך בלי לחסום תוכן בוטה.

  • מחקר אבטחת מידע

    מסייע בבדיקת חולשות ופגיעויות תוכנה בלי לסרב לבקשות שמכילות דוגמאות קוד מתקיף.

איפה זה נופל

למרות השמירה על היכולות הכלליות, הורדת החסימות גוררת ירידה קלה בחלק מהתחומים המקצועיים. במבחן MMLU ניכרת שחיקה של אחוזים בודדים בנושאים כמו משפטים, חשבונאות ולימודי ביטחון, מה שאומר שבמשימות הדורשות דיוק משפטי או עובדתי קפדני צריך לבדוק את הפלט ביסודיות.

בנוסף, מודל כזה יפלוט טקסט פוגעני, קוד זדוני או תוכן לא הולם בלי להתריע ובלי לעצור. אם אתם משלבים אותו במוצר שמשרת משתמשי קצה, תצטרכו לבנות בעצמכם מנגנוני סינון ובקרה חיצוניים.

אותה משפחה

Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

מה המשמעות של שמירת רכיבי MTP?

השמירה על 15 רכיבי הניבוי הרב שלבי מאפשרת למודל לנצל מנגנוני האצה וייצור טוקנים מהיר בסביבות ריצה תומכות. בגרסאות קודמות של אבלציה רכיבים אלו נשחקו, מה שפגע ביעילות הפריסה.

האם המודל בטוח לחיבור ישיר לצ'אט של לקוחות?

לא מומלץ לחבר אותו ישירות למשתמשי קצה ללא שכבת הגנה. המודל עונה על כמעט כל הנחיה ולא כולל חסימות מובנות, כך שמשתמשים יכולים לחלץ ממנו תכנים לא ראויים בקלות.

איך מריצים

כדי להריץ את קובצי המשקלים המלאים בפורמט Transformers, תצטרכו להוריד 51.8 גיגה בייט המחולקים ל־23 קבצים. זה דורש שרת עם כרטיס תצוגה מקצועי של לפחות 80 גיגה בייט זיכרון וידאו, או מערך של שני כרטיסים חזקים, במיוחד אם אתם מתכננים לנצל את חלון ההקשר העצום שמגיע עד 262,144 טוקנים.

אם אין לכם חומרה כזו, המפרסם הוציא גם גרסאות מכומתות כמו GGUF ו־GPTQ ב־4 ביט וב־8 ביט, שמאפשרות לרוץ על כרטיסים ביתיים עם 16 עד 24 גיגה בייט זיכרון. מי שלא מחזיק שרת ייעודי שפועל ברציפות יגלה ששכירת שרת ענן לפי שעה או פנייה ל־API חיצוני זולה ונוחה בהרבה מהחזקת ברזל מקומי.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא אפאצ'י 2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי קוד והפצה חופשית של המשקלים בתוך מוצרים. הדרישה העיקרית היא לכלול את הודעת זכויות היוצרים ואת תנאי הרישיון המקוריים בכל הפצה של התוכנה או של המודל.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗