GPT
Q

Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking

קוד פתוח

DavidAUapache-2.02026-04-29

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • unsloth

גרסה מורחבת של דגם פתוח שעברה הסרת מגבלות ואימון ייעודי לחשיבה עמוקה. מי שמוריד אותו מחפש ניתוח מורכב, כתיבה ישירה וחופש מוחלט מצנזורה בלי סירובים.

  • 40Bפרמטרים
  • 262,144טוקנים בהקשר
  • 73.7 GBמשקל הקבצים
  • 1,626הורדות בחודש

מה זה

בבסיס נמצאת ארכיטקטורה של עשרים ושבעה מיליארד פרמטרים שהורחבה לארבעים מיליארד פרמטרים צפופים, ללא חלוקה למומחים, עם תשעים ושישה שכבות. תהליך הפיתוח כלל הסרת חסמי בטיחות, אימון בספריית אנזלות על מערכי נתונים פנימיים לאופי ועומק, ולבסוף כוונון עם נתוני זיקוק מדגם אופוס כדי לייצב את החשיבה.

הוא מתוכנן לחשיבה באורך משתנה, עם תמיכה בעיבוד תמונה לצד טקסט וחלון הקשר גדול. במבחני השוואה במצב פקודה ישיר הוא עוקף את דגם המקור בשישה מתוך שבעה מדדים, כולל יתרון קל במבחני ידע והיגיון כמו ארק צ'אלנג' ובול קיו, אם כי היתרון העיקרי שלו הוא סגנון כתיבה בוטה ויכולת לנתח קוד ומשימות סוכנים בלי מעצורים.

מתאים ל

  • כתיבה יצירתית ללא סינון

    מייצר טקסטים בעלי אופי מחוספס וביקורת עלילתית חדה, בלי לחסום תכנים למבוגרים או שפה בוטה.

  • ניתוח קוד וסוכני פיתוח

    מתמודד עם פתרון תקלות עמוק במאגרי קוד הודות לחלון הקשר עצום ויכולות תכנות מתקדמות.

  • הסרת מגבלות וחקירה

    עונה על שאלות מורכבות ומחקר רגיש בלי לסרב או להטיף מוסר על נושא הפנייה.

איפה זה נופל

ההסרה המוחלטת של מנגנוני הבטיחות הופכת אותו לבלתי מתאים לשירות לקוחות או למוצרים ציבוריים, כי הוא ייצר תוכן פוגעני או בלתי הולם בלי להסס. בעבודה עם קוונטים נמוכים או פרומפטים קצרים מדי קיימת נטייה להיכנס ללולאות ולחזרות, מה שמחייב הוספת עונש חזרתיות או פרומפט מערכת קבוע כדי לייצב את הפלט.

שאלות
נפוצות

איך מונעים ממנו לחשוב יותר מדי או להיתקע בלולאות?

אפשר לערוך את תבנית הג'ינג'ה ולקבוע את ביטול החשיבה למצב שקר כדי להפוך אותו למודל פקודות ישיר. בנוסף, מומלץ להגדיר בפרומפט המערכת הנחיה ברורה, ולהעלות את מקדם עונש החזרתיות במידה ומשתמשים בגרסה מכווצת.

האם הדגם תומך בשפה העברית?

האימון הרשמי מוגדר עבור אנגלית וסינית בלבד. הוא מסוגל להבין ולפלוט עברית בסיסית בגלל ארכיטקטורת הבסיס, אך לא מומלץ להסתמך עליו למשימות ניסוח מורכבות בעברית.

איך מריצים

המשקל המלא בדיוק המקורי מגיע ל־73.7 ג'יגה־בייט ב־31 קבצים, מה שמחייב לפחות 80 עד 96 ג'יגה זיכרון גרפי, כלומר שני כרטיסי שלושים ותשעים או שרת ענן ייעודי. כדי להריץ מקומית על חומרה צנועה יותר חייבים קוונטיזציה, כשהיוצר ממליץ על רמת דיוק מינימלית של ארבעה ביטים או פורמט שלוש ביטים עם מטריצת חשיבות.

אם אתם צריכים רק תגובות קצרות ומהירות או שאין לכם חומרה ייעודית, עדיף להשתמש בשרותי ענן חיצוניים. הדגם תומך בשינוי תבנית הג'ינג'ה כדי לכבות את מנגנון החשיבה ולעבור למצב פקודה רגיל, מה שמקצר את זמני המענה.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא אפאצ'י שתיים אפס. הוא מתיר שימוש מסחרי, שינוי קוד והפצה חופשית בלי תמלוגים, בתנאי ששומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗