GPT
Q

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

קוד פתוח

DavidAUapache-2.02026-07-17

  • gguf
  • unsloth
  • fine tune
  • heretic
  • uncensored

גרסה מכווננת ונטולת חסימות של מודל 27B, שעברה מיזוגים כדי להגיע לביצועי היגיון גבוהים בחומרה ביתית. המטרה כאן היא מענה חופשי מסירובים ויכולת פתרון בעיות חזקה בלי תלות בשרתי ענן.

  • 433 GBמשקל הקבצים
  • 1,156,626הורדות בחודש
  • 2,326לייקים

מה זה

מדובר בכיוונון רב שלבי ומיזוג שנבנה על גבי מודל בסיס בגודל 27B, בשילוב חלקי דאטהסטים כמו פולאריס ו־F451. מעבר להסרת מגבלות הבטיחות הרגילות, הדגש בפיתוח הושם על יכולת פתרון בעיות ומעקב אחרי הוראות מורכבות. לפי נתוני המבחנים של Nightmedia, המודל השיג ציון של 0.711 במבחן ARC-C בקוונט של 8 ביט ו־0.701 ב־4 ביט, תוצאה שמציבה את כושר ההיסק שלו מעל מודל המקור ומעל גרסת ה־35B בסדרת הבסיס.

המודל כולל יכולות עיבוד תמונה לצד טקסט, ותומך בהקשר בסיסי של 256k טוקנים. הוא מתאים לשימוש טכני שדורש חשיבה מעמיקה, אבל מגיע מראש בלי מעצורים תוכניים, כך שהוא לא מסרב לשאילתות שיוצרות חסימה במודלים מסחריים סגורים.

מתאים ל

  • פתרון בעיות קוד ותשתיות

    ציוני ההיגיון הגבוהים וההקשר הרחב מאפשרים ניתוח עמוק של שגיאות ומעקב אחרי הנחיות פיתוח מורכבות.

  • ניתוח טקסט ומסמכים חופשי

    הסרת הסירובים מאפשרת לעבד טקסטים רגישים, משפטיים או בוטים שמודלים מסחריים נוטים לחסום מיד.

  • ניתוח משולב של תמונה וטקסט

    התמיכה במודל ראייה לצד מנוע הטקסט מתאימה לחילוץ נתונים והבנת תרשימים באמצעות קובץ mmproj ייעודי.

איפה זה נופל

המודל עבר תהליך הסרת סירובים באמצעות Heretic, מה שהוריד את שיעור הסירובים מ־99 מתוך 100 ל־4 בלבד, אבל הוא לא אומן מראש על תוכן בוטה. המשמעות היא שאם לא תדחפו אותו עם מילות מפתח ברורות והוראות ישירות, התוכן שהוא ייצר עשוי לצאת יבש ותפל מאוד במקום חופשי. בנוסף, הוא מוגדר רשמית לאנגלית ולסינית בלבד, כך שאין הבטחה לגבי איכות הפלט בעברית. לפני שמשלבים אותו במערכת אמיתית, חובה לבדוק את היציבות שלו כי אין כאן מנגנוני סינון שמונעים פליטת מידע בעייתי.

שאלות
נפוצות

האם כדאי להוריד קובץ GGUF רגיל או MTP?

עדיף לבדוק קודם את ה־MTP אם אתם עובדים בטמפרטורה של עד 1.0 ובלי repetition penalty, כי הוא יכול להגיע לקצב גבוה יותר. אם קצב קבלת הטוקנים במערכת שלכם נמוך מ־50 אחוז, עברו ישירות לקובץ הרגיל.

איך מפעילים את יכולת הראייה של המודל?

המשקלים של הראייה לא נמצאים בתוך קובץ ה־GGUF הראשי. אתם צריכים להוריד קובץ mmproj בנפרד ולמקם אותו באותה תיקייה שבה שמור המודל כדי שהתוכנה תזהה תמונות.

איך מריצים

כדי להריץ גרסת 4 ביט של מודל בגודל 27 מיליארד פרמטרים תצטרכו כרטיס מסך עם לפחות 16 עד 24 גיגה זיכרון וידאו, תלוי באורך ההקשר שתפתחו. הבדיקות שפורסמו בוצעו על כרטיס 5090 תחת חלונות 11, שם נרשם קצב של כ־75 טוקנים לשנייה בגרסה רגילה, ומעל 90 בגרסאות MTP. אם אתם רוצים תמיכה בתמונות, חובה להוריד בנפרד קובץ mmproj תואם ולשים אותו באותה תיקייה.

המאגר כולל קובצי GGUF רגילים לצד גרסאות MTP שמנחשות שני טוקנים במקביל. אם יחס הקבלה של הטוקנים יורד מתחת לחצי, עדיף לחזור לקוונט רגיל כי הוא יעבוד מהר יותר. למי שמחפש רק שאילתה מזדמנת בלי להחזיק כרטיס ייעודי חזק ודלוק, עדיף להשתמש ב־API חיצוני.

ollama run hf.co/DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

33 קבצים במאגר, 433 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של המשקלים והפצה של המודל בתוך מוצרים, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗