GPT
Q

Qwen3-4B-Gemini-TripleX-High-Reasoning-Thinking-Heretic-Uncensored-GGUF

קוד פתוח

DavidAUapache-2.02025-12-23

  • gguf
  • 256k context
  • Qwen3
  • All use cases
  • creative

שילוב ניסיוני שמסיר חסימות מתוכן וכולל תהליך חשיבה פנימי. מתאים למי שחייב מודל קומפקטי שמייצר טקסט ללא סירובים, כתיבה חופשית או פתרון בעיות ללא התערבות מוסרית.

  • 4.0 GBמשקל הקבצים
  • 1,267הורדות בחודש
  • 43לייקים

מה זה

מדובר במיזוג של שלושה זיקוקים שונים ממשפחת ג'מיני, כולל ג'מיני 3 בעל יכולות היסק וגרסאות פלאש 2.5, שעברו תהליך של הסרת צנזורה. לפי הנתונים בכרטיס, שיעור הסירוב של המודל צנח מ־90 מתוך 100 ל־5 מתוך 100 בלבד, מה שהופך אותו לכלי כמעט נטול עכבות. המודל שוקל 4 גיגה-בייט ומיועד למשימות יצירת טקסט באנגלית, מקוד ומתמטיקה אקדמית ועד כתיבה ספרותית ואימה.

המבנה שלו כולל תהליך חשיבה מובנה שמציג את שיקולי המודל לפני הפלט הסופי. היוצר מדווח על חלון הקשר של 256 אלף טוקנים בפורמט חשיבה דחוס. בפועל, החיבור בין מודלי היסק לביטול חסימות מייצר מודל שמסוגל לתכנן עלילות או לפתור בעיות מורכבות בלי לצנזר פרטים גרפיים או בוטים.

מתאים ל

  • כתיבת תוכן וספרות אפלה

    מייצר סצנות אימה ותוכן בוטה בלי לסרב להנחיות ובלי לצנזר תיאורים פיזיים קשים.

  • משחקי תפקידים מקומיים

    מתאים לממשקי צ'אט פרטיים שלא דורשים מעקף של מגבלות בטיחות תאגידיות.

  • מחקר ופתרון בעיות ללא סינון

    מנתח נושאים רגישים בהיסטוריה או מדע תוך הצגת שלבי החשיבה המלאים של המודל.

איפה זה נופל

זהו מיזוג ניסיוני של מודלים מרובים, ולכן הוא רגיש לחוסר יציבות ודורש כוונון דק של דוגמי הטקסט כדי לא לייצר פלט משובש. המודל הוגדר לשפה האנגלית בלבד, ואין לצפות ממנו לביצועים תקינים בעברית. שיעור סירוב של 5 מתוך 100 אומר שהוא עלול לפלוט תוכן אלים, אימה קשה או חומרים בוטים ללא שום מנגנון הגנה, כך שהוא לחלוטין אינו מתאים למוצרים שפונים לקהל הרחב.

שאלות
נפוצות

האם המודל יפעל בצורה חלקה בהגדרות ברירת מחדל?

לא. הכרטיס מבהיר במפורש שיש להגדיר Smoothing Factor ברמה של 1.5 או להעלות את ענישת החזרתיות ל־1.1 עד 1.15. בלי ההתאמות האלה בממשק ההרצה, איכות הפלט עלולה להיפגע באופן משמעותי.

האם הוא מתאים ליישומים בעברית?

השפה היחידה שמדווחת במאגר היא אנגלית. בגלל שמדובר במיזוג מבוסס משקלים שלא אומן מפורשות על טקסט עברי רחב, הוא כנראה ייכשל בניסוח או בהבנת הקשר מקומי.

איך מריצים

הקבצים שוקלים 4.0 גיגה-בייט בסך הכול ומגיעים בפורמט GGUF, כך שכרטיס מסך בסיסי עם 6 עד 8 גיגה-בייט של זיכרון יריץ אותם מקומית בקלות. אפשר להפעיל את המודל בכלים כמו KoboldCpp, SillyTavern או Text Generation WebUI, אך יש לשים לב להגדרות ספציפיות: היוצר דורש לקבוע את פרמטר ה־Smoothing Factor לערך של 1.5, או לחלופין להעלות את ענישת החזרתיות לטווח שבין 1.1 ל־1.15 כדי למנוע לולאות טקסט.

אם אתם משתמשים ב־Text Generation WebUI, הכרטיס מציין שחובה להשתמש בטוען מסוג llama_HF ולהוריד קובצי תצורה נוספים ממאגר המקור. אין סיבה לקרוא ל־API חיצוני עבור מודל כזה, כי היתרון היחיד שלו הוא הרצה מקומית פרטית של תוכן לא מצונזר ששום שירות ענן מסחרי לא יסכים לייצר.

ollama run hf.co/DavidAU/Qwen3-4B-Gemini-TripleX-High-Reasoning-Thinking-Heretic-Uncensored-GGUF:Q8_0

הקבצים

4 קבצים במאגר, 4.0 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל מופץ תחת רישיון Apache 2.0. הרישיון מתיר שימוש מסחרי, שינוי קוד והפצה חופשית של הקבצים, בתנאי ששומרים על הודעת זכויות היוצרים והצהרת הוויתור המקורית. אין מגבלות על הרצה בסביבה עסקית, אך האחריות על הפלטים הלא מצונזרים חלה עליכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗