GPT
Q

Qwen3.5-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking

קוד פתוח

DavidAUapache-2.02026-03-15

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • unsloth

גרסה מורחבת של קוון ל־40 מיליארד פרמטרים שעברה הסרת מגבלות מוחלטת. היא משלבת חשיבה פנימית מתקדמת עם אופי ישיר שלא מסנן שום נושא.

  • 40Bפרמטרים
  • 262,144טוקנים בהקשר
  • 73.7 GBמשקל הקבצים
  • 336הורדות בחודש

מה זה

הבסיס כאן הוא דגם של 27 מיליארד פרמטרים שהורחב ל־40 מיליארד עם 96 שכבות, ואז עבר כוונון בעזרת דאטה-סטים של קלוד אופוס כדי לייצר חשיבה עמוקה באורך משתנה. ההבדל המרכזי מול מודלים רגילים בגודל הזה הוא שאין פה שכבת בטיחות. הוא לא מתחמק, לא מרצה, ומסוגל לייצר טקסטים גסים, אלימים או טכניים בלי לחסום את המשתמש.

במבחני הביצועים הרשמיים המצורפים הוא עוקף את דגם ה־27 מיליארד המקורי ברוב המדדים, כולל ארק והלסוואג, מה שמראה שההרחבה והאימון הנוסף חידדו את היכולת להסיק מסקנות ולא שברו את המבנה. הוא כולל תמיכה בעיבוד תמונה ומאפשר לכבות את מצב החשיבה דרך תבנית הפרומפט כדי לקבל תשובות ישירות ומהירות יותר.

מתאים ל

  • כתיבה יצירתית ללא צנזורה

    מתאים לדיאלוגים קשוחים, ספרי מתח ותכנים אפלים שספקים מסחריים רגילים מסרבים לכתוב.

  • פתרון בעיות מדעיות

    מנגנון החשיבה העמוקה שלו מפרק בעיות מורכבות בפיזיקה והנדסה בצורה מפורטת.

  • עריכת עלילה ודמויות

    משמש כשותף ביקורתי שלא מייפה את המציאות ומצביע ישירות על חורים וקלישאות בכתיבה.

איפה זה נופל

המודל נוטה להיכנס ללולאות של חזרתיות בפרומפטים קצרים מדי או בגרסאות קוונטיזציה נמוכות. כדי לעצור את זה חייבים להגדיר פנדלטי חזרות מדויק של 1.05 עד 1.1 או לספק פרומפט מערכת קבוע שמייצב אותו. מעבר לזה, בגלל שהסירו ממנו את כל מנגנוני הבטיחות, הוא יפיק תכנים קשים, קללות ותשובות פוגעניות ברגע שתבקשו, מה שהופך אותו לבלתי שמיש למוצרים הפונים לקהל הרחב בלי מעטפת סינון חיצונית. התמיכה המדווחת היא באנגלית וסינית בלבד, כך שעברית לא נבדקה ולא מובטחת כאן.

שאלות
נפוצות

איך מבטלים את בלוק החשיבה כדי לקבל תשובות מהירות?

עורכים את תבנית הג'ינג'ה של המודל ומגדירים את המשתנה אינייבל ת'ינקינג למצב פולס. בתוכנות כמו אל-אם סטודיו אפשר לשנות את זה ישירות במצב מפתח של התבנית.

האם המודל יתפקד טוב בשיחות שגרתיות בעברית?

הוא אומן רשמית רק על אנגלית וסינית. אפשר לנסות לכתוב לו בעברית, אבל סביר להניח שאיכות השפה והתחביר יהיו נמוכות ביחס למודלים רב-לשוניים ייעודיים.

למה המודל חוזר על עצמו שוב ושוב בתשובה?

זו בעיה מוכרת בארכיטקטורה הזו כשעובדים עם גרסאות מכווצות או פרומפט קצר. הפתרון הוא להוסיף פרומפט מערכת של משפט אחד ולהעלות את מקדם החזרתיות לאזור 1.1 בהגדרות הדגימה.

איך מריצים

במשקל של כמעט 74 גיגה-בייט בקבצי המקור, שכחו מלהריץ אותו בדיוק מלא על חומרה ביתית. תצטרכו לפחות שרתי ענן עם שני כרטיסי A100 או H100 כדי לטעון אותו, או לרדת לקוונטיזציה של 4 ביט שמצריכה כרטיס בודד של 32 עד 48 גיגה זיכרון גרפי כמו A6000.

אם אתם צריכים רק גישה מדי פעם ולא בונים מוצר שרץ על שרתים פרטיים, להרים שרת ייעודי למפלצת כזו עולה הרבה כסף. במקרים כאלה עדיף לשלם לפי טוקן ל־API של מודלים סגורים, אלא אם הדרישה שלכם היא מודל לא מסונן שפשוט אי אפשר לקבל מספקים מסחריים רגילים.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.5-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא אפאצ'י שתיים אפס. הוא מתיר שימוש מסחרי חופשי, שינוי של המשקולות והפצה מחדש בלי תמלוגים, כל עוד שומרים על הודעת הרישיון המקורית ומציינים שינויים שנעשו בקוד או במשקולות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗