GPT
Q

Qwen3.5-9B-Claude-4.6-HighIQ-INSTRUCT-HERETIC-UNCENSORED

קוד פתוח

DavidAUapache-2.02026-03-04

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • fine tune

זהו כוונון עדין של קוון על נתוני קלוד שעבר הסרת מגבלות מלאה. הוא מתאים למי שרוצה ביצועים חזקים של תשעה מיליארד פרמטרים בלי שום סירובים או הטפות מוסר.

  • 9.4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 17.6 GBמשקל הקבצים
  • 315,991הורדות בחודש

מה זה

מדובר במודל שפה ותמונה מבוסס Qwen 3.5 9B שעבר אימון נוסף בתוכנת Unsloth על בסיס נתונים שזוקק מ־Claude 4.6. היוצר הפעיל עליו תהליך שמכונה Heretic, שמטרתו למחוק לחלוטין את מנגנוני הבטיחות הרגילים. במבחני סירוב הוא ירד מ־100 סירובים במודל המקורי ל־6 בלבד, תוך שמירה על מרחק סטטיסטי נמוך מאוד מהמקור, מה שמראה שהיכולות הכלליות לא נפגעו מההסרה.

התוצאות במבחנים הסינתטיים מראות שיפור ניכר על פני גרסת הבסיס של קוון. במבחן הידע ARC המודל מזנק מציון 0.417 ל־0.574, ובמבחן BoolQ הוא מגיע ל־0.869 לעומת 0.623 במקור. המודל שומר על יכולות עיבוד תמונה שנבדקו ונמצאו עובדות, ומגיע בתבנית שמאלצת אותו למצב הוראות בלבד.

מתאים ל

  • מחקר אבטחת מידע

    הוא לא מסרב לשאלות קשות ומאפשר סימולציות התקפה ובדיקות חדירות בלי חסימות יזומות.

  • ניתוח מסמכים ותמונות

    הוא משלב יכולות ראייה ממוחשבת יחד עם חלון הקשר עצום של 256 אלף טוקנים.

  • כתיבה יוצרת ללא צנזורה

    האימון שזוקק מקלוד מעניק לו סגנון תשובה עשיר בלי הטפות מוסר או צנזורה על תכנים.

איפה זה נופל

הבעיה המרכזית במודל שעבר הסרת מגבלות היא היעדר מוחלט של מעצורים, ולכן לא הייתי משתמש בו לשירות לקוחות פתוח או למוצר שחשוף למשתמשי קצה בלי בדיקות מקדימות. בנוסף, אף על פי שרכיב התמונה עובד לפי התיעוד, היוצר מודה שחלק הווידאו כלל לא נבדק. גם תבנית הפרומפטים הוגדרה למצב הוראות בלבד, מה שעלול להקשות אם אתם בונים עליו למשימות שיחה חופשית שאינן מבוססות הנחיה ישירה.

שאלות
נפוצות

האם המודל יסרב לפקודות שנויות במחלוקת?

בבדיקה שמופיעה בכרטיס המודל הוא סירב רק ל־6 מתוך 100 בקשות, לעומת המודל המקורי שסירב לכולן. הוא תוכנן לענות ישירות ולבצע בדיוק מה שמבקשים ממנו.

אפשר להזין לו קבצי וידאו כמו בקוון המקורי?

לא מומלץ לבנות על זה כרגע. היוצר מציין בפירוש שרכיבי הווידאו לא נבדקו כלל באימון הנוכחי, אלא רק תמונות סטילס.

כמה זיכרון כרטיס מסך נחוץ להרצה שוטפת?

הקבצים שוקלים 17.6 גיגה בייט ומחייבים לפחות 24 גיגה זיכרון לביצועים מלאים. בגרסאות דחוסות של 4 ביט תוכלו להסתפק בכרטיס של 12 או 16 גיגה.

איך מריצים

משקל הקבצים המלא עומד על 17.6 גיגה בייט, כך שהרצה שלו בלי דחיסה דורשת כרטיס מסך עם לפחות 24 גיגה זיכרון כדי להשאיר מקום להקשר. אם הזיכרון שלכם מוגבל, היוצר מציין במפורש שעדיף לרדת לגרסאות מקוונטטות של q4ks או אפילו IQ3S עם imatrix, מה שמאפשר להריץ אותו בנוחות גם על כרטיסים ביתיים עם 12 או 16 גיגה זיכרון.

חשוב לכבות לחלוטין את מנגנון ה־repetition penalty ולקבוע אותו לערך 1 לפי ההנחיות בכרטיס. אם אתם זקוקים לכל חלון ההקשר העצום שמגיע ל־256 אלף טוקנים, תצטרכו הרבה מאוד זיכרון עבודה, ובמקרים כאלה עדיף לפנות לפתרונות ענן או שרתי vLLM ייעודיים מאשר לנסות לדחוף את זה למחשב מקומי.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.5-9B-Claude-4.6-HighIQ-INSTRUCT-HERETIC-UNCENSORED")
print(pipe("שלום"))

הרישיון

הפרויקט מדווח תחת רישיון Apache 2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי והפצה של הקוד והמשקלים בחינם, כל עוד אתם שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗