GPT
Q

Qwen3.5-9B-Claude-4.6-HighIQ-THINKING-HERETIC-UNCENSORED

קוד פתוח

DavidAUapache-2.02026-03-04

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • fine tune

שילוב של ארכיטקטורת תשעה מיליארד פרמטרים עם חשיבה שזוקקה מקלוד, ללא מנגנוני סינון ובלימת תשובות. מיועד למי שצריך תהליך היסק מקומי בלי לקבל סירובים על תוכן רגיש.

  • 9.4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 17.6 GBמשקל הקבצים
  • 1,305הורדות בחודש

מה זה

מדובר בכוונון עדין של דגם הבסיס בעזרת Unsloth על חומרה מקומית, תוך שימוש במאגר נתונים מזוקק שמחליף את מנגנון החשיבה המקורי בסגנון המדמה את קלוד. המטרה המרכזית כאן היא שחרור החסימות המובנות, מה שמתבטא במבחן שבו המודל סירב רק לשש בקשות מתוך מאה, לעומת דגם המקור שדחה את כל המאה.

מבחינת מבחני ביצועים, גרסת החשיבה מציגה שיפור נקודתי במדדים כמו arc שעולה מ־0.417 ל־0.432, ובמבחן obkqa שמגיע ל־0.374 לעומת 0.338 במקור. שאר המדדים כמו boolq שומרים על יציבות סביב 0.625, כך שתהליך ההסרה לא ריסק את יכולת ההבנה הכללית. בנוסף, רכיב התמונה נבדק ונשאר פעיל לאחר האימון.

מתאים ל

  • ניתוח מסמכים רגישים

    מאפשר לסכם ולנתח חומרים משפטיים או רפואיים בלי שהמודל יסרב לעבד מידע בוטה.

  • סוכן חשיבה עצמאי

    מספק יכולת היסק רציפה על חומרה מקומית למשימות תכנות ופתרון בעיות.

  • בדיקות אבטחת מידע

    מייצר תרחישי תקיפה ובדיקות חדירות בלי מעצורים של מנגנוני בטיחות מסחריים.

איפה זה נופל

הכרטיס מודה בפירוש שחלק הווידאו של המודל לא נבדק כלל, כך שאי אפשר לסמוך עליו לעיבוד קובצי תנועה. בנוסף, מודל ללא מגבלות עלול לפלוט תוכן פוגעני או רעיל, ולכן לא הייתי מחבר אותו לממשק לקוחות חיצוני בלי שכבת הגנה באפליקציה שלכם.

שאלות
נפוצות

האם המודל יפעל ישירות על מחשב נייד רגיל?

המשקל המקורי דורש כרטיס גרפי כבד עם 24 גיגה זיכרון. כדי להריץ אותו במחשב אישי, תצטרכו להשתמש בגרסאות מכווצות כמו q4ks או IQ3S.

האם אפשר להשתמש בו לעיבוד סרטוני וידאו?

לא כרגע. המפתח מציין במפורש שחלק הווידאו לא נבדק כלל באימון הזה, ולכן יכולות המולטימדיה מוגבלות לתמונות בלבד.

איך מריצים

המשקל הגולמי עומד על 17.6 גיגה בייט ומחייב כרטיס עם לפחות 24 גיגה זיכרון כדי לרוץ בצורה חלקה ללא קוונטיזציה. הכרטיס ממליץ לרדת לרמות דחיסה של q4ks או IQ3S, מה שיאפשר לכם להריץ אותו גם על חומרה צנועה יותר של 12 או 16 גיגה זיכרון.

אם אתם מתכננים לנצל את מלוא חלון ההקשר העצום שמגיע ל־256k טוקנים, צריכת הזיכרון תזנק מעבר ליכולת של חומרה ביתית. במצב כזה, עדיף להסתמך על תשתית ענן ייעודית או שירותי הרצה חיצוניים שתומכים ב־vLLM או SGLang.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="DavidAU/Qwen3.5-9B-Claude-4.6-HighIQ-THINKING-HERETIC-UNCENSORED")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא apache-2.0, שמאפשר שימוש מסחרי, שינוי והפצה של הקוד והמשקלים. אתם יכולים לשלב אותו במוצר מסחרי, בתנאי שתשמרו על הודעות זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗