GPT
Q

Qwen3.6-35B-A3B-uncensored-heretic-GGUF

קוד פתוח

llmfan46apache-2.02026-04-20

  • transformers
  • gguf
  • qwen3_5_moe
  • heretic
  • uncensored

גרסת GGUF שעברה הסרת מגבלות תוכן עם ירידה מ־83 סירובים ל־10 בלבד. מתאים למי שחייב תמיכה בתמונות וקוד בלי הטפות מוסר וחסימות.

  • 243 GBמשקל הקבצים
  • 16,668הורדות בחודש
  • 121לייקים

מה זה

מדובר במודל מולטימודלי של 35 מיליארד פרמטרים שמשתמש בארכיטקטורת Mixture of Experts, שבה מופעלים רק 3 מיליארד פרמטרים בכל שלב. הבסיס הוא Qwen3.6 שעבר תהליך הסרת צנזורה באמצעות כלי בשם Heretic, בשיטה שנקראת MPOA. המטרה של השיטה היא לנטרל את מנגנוני הסירוב וההרצאות של המודל המקורי בלי לפרק את יכולות ההיגיון שלו.

במדד MMLU התוצאה הכללית ירדה מ־0.8372 במקור ל־0.8330 בגרסה הזו, שזה הבדל זניח לחלוטין שמראה שהידע הכללי נשמר. גם מדד הסטייה מול המקור עומד על 0.0015 בלבד. המודל שומר על יכולות קידוד ועיבוד תמונה, אבל יענה על בקשות שהמודל הרשמי של עליבאבא זורק עליהן שגיאה או מסרב לבצע.

מתאים ל

  • ניתוח תמונות רגישות

    מאפשר פענוח תמונות שחוסמות מודלים מסחריים, יחד עם קובץ הפרויקטור הייעודי.

  • סוכן בדיקות אבטחה בקוד

    כתיבה ובדיקה של חולשות אבטחה בלי להיתקל בסירובים והרצאות על אתיקה.

  • כתיבה יצירתית ללא סינון

    יצירת תוכן, עלילות ודיאלוגים מורכבים שהגרסה המקורית דוחה בגלל מדיניות שימוש.

איפה זה נופל

ההסרה של מנגנוני הסירוב אינה מושלמת. המודל עדיין מציג 10 סירובים מתוך 100 במבחן, כך שלא מדובר בחופש מוחלט. בנוסף, בפירוק של ציוני ה־MMLU רואים פגיעה נקודתית מורגשת יותר בתחומים מסוימים, למשל ירידה מ־0.7381 ל־0.6905 בלוגיקה פורמלית, ונפילה מ־0.70 ל־0.65 באלגברה מופשטת. מי שבונה עליו למתמטיקה מדויקת או משימות היסק מורכבות עלול לחטוף שגיאות שלא היו במקור.

אותה משפחה

Qwen3.6-35B-A3B-uncensored-heretic יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

למה המודל לא מנתח לי תמונות אחרי שהורדתי את קובץ ה־GGUF?

הקובץ הראשי מכיל רק את משקלי השפה. כדי להשתמש ביכולות תמונה חייבים להוריד גם את הקובץ שמסתיים ב־mmproj-BF1.gguf ולטעון אותו במקביל בתוכנת ההרצה שלכם.

האם הוא דורש מחשב חזק יותר מהמודל המקורי?

לא. דרישות החומרה זהות לחלוטין לכל גרסת GGUF של הדגם המקורי. היתרון הוא שבזכות ארכיטקטורת ה־MoE מהירות היצירה גבוהה יחסית למודל של 35B כי רק 3B פעילים בו זמנית.

איך מריצים

בשביל להריץ את המודל הזה תצטרכו כלים שתומכים בפורמט כמו llama.cpp, LM Studio או Ollama. למרות שרק 3 מיליארד פרמטרים רצים בכל רגע, כל 35 המיליארד חייבים לשבת בזיכרון. זה אומר שבגרסאות המכווצות כמו Q4_K_M תצטרכו סביב 20 עד 24 גיגה זיכרון וידאו פנוי, או שילוב של כרטיס מסך עם זיכרון מערכת שיאט את הקצב.

נקודה שחייבים לשים אליה לב היא עיבוד התמונה. קובץ המודל הרגיל מספק רק טקסט, ובשביל יכולות תמונה חייבים להוריד ולהגדיר בנפרד את קובץ הפרויקטור בשם mmproj שמצורף בריפו.

ollama run hf.co/llmfan46/Qwen3.6-35B-A3B-uncensored-heretic-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא Apache 2.0. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של הקוד והפצה מחדש, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון. אתם יכולים לשלב אותו במוצר פנימי או מסחרי בלי לשלם תמלוגים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗