GPT
Q

Qwen3.6-12B-IQ-Ultra-Heretic-Uncensored-Thinking-V2-Hightop-GGUF

קוד פתוח

KevinJK51apache-2.02026-05-17

  • gguf
  • qwen
  • uncensored
  • thinking
  • qwen3.5

גרסת GGUF לא מצונזרת של מודל 12B עם יכולות חשיבה, מכוונת למי שרוצה הרצה מקומית בלי מעצורים וסירובים. היא מתאימה כשמחפשים שליטה מלאה בטקסט בלי התערבות של מנגנוני בטיחות.

  • 108 GBמשקל הקבצים
  • 26,645הורדות בחודש
  • 106לייקים

מה זה

מדובר בהמרה של המודל של DavidAU לפורמט GGUF באמצעות llama.cpp, שפותחה עבור משימות יצירת טקסט. השילוב כאן מכוון ישירות לשני דברים: תהליך חשיבה מובנה והסרה מכוונת של מגבלות צנזורה, מה שאומר שהוא לא יסרב לשאלות כמו מודלים סטנדרטיים של חברות מסחריות.

הבסיס מגיע ממשפחת Qwen סביב גודל של 12 מיליארד פרמטרים, שתומך רשמית באנגלית ובסינית בלבד. אין בדף המודל מבחני ביצועים מספריים או ציונים רשמיים, כך שקשה לדעת בדיוק כמה יכולת ההיגיון שלו נפגעה או השתפרה בעקבות ההתאמות והכיול הלא מצונזר.

מתאים ל

  • מעבדות מחקר מקומיות

    בדיקת התנהגות מודלים בלי חסימות תוכן ישירות על המחשב שלכם.

  • כתיבה יצירתית חופשית

    יצירת סיפורים ותסריטים שלא נתקלים בסירובים של פילטרים מסחריים באנגלית.

  • פתרון בעיות באנגלית

    ניצול מנגנון החשיבה המובנה בניתוח טקסט מורכב בלי תלות בחיבור רשת.

איפה זה נופל

המודל הזה אינו מצונזר, ולכן הוא עלול לפלוט תוכן רעיל, מטעה או בעייתי בלי שום מסננת הגנה. חוץ מזה, הכרטיס מדווח על תמיכה באנגלית ובסינית בלבד, כך שלא הייתי בונה עליו לשום משימה שדורשת עברית תקינה. אין עליו שום נתוני בדיקה או מדדים שמוכיחים עמידות בהזיות.

שאלות
נפוצות

האם המודל תומך בעברית?

הכרטיס מפרט תמיכה באנגלית ובסינית בלבד. אם תפנו אליו בעברית תקבלו כנראה פלטים משובשים או חלקיים, ולכן הוא לא מתאים לעיבוד שפה מקומי.

איזו גרסת כימוס כדאי להוריד למחשב אישי?

גרסת Q4_K_M שוקלת 6.82 גיגה בייט ומסומנת כאיזון הטוב ביותר בין איכות לנפח זיכרון. אם יש לכם כרטיס עם פחות מ־8 גיגה זיכרון, תצטרכו לרדת לגרסאות IQ3 או Q3.

האם צריך שרת מיוחד כדי להפעיל אותו?

ממש לא, קובץ בכימוס סביר רץ ישירות על מעבד וכרטיס מסך של מחשב ביתי דרך תוכנות כמו LM Studio או Ollama.

איך מריצים

המשקלים נעים בין 4.60 גיגה בייט בגרסת Q2_K המינימלית ועד 11.57 גיגה בייט בגרסת Q8_0. הגרסה המאוזנת ביותר לפי הכרטיס היא Q4_K_M ששוקלת 6.82 גיגה בייט, מה שאומר שכרטיס מסך ביתי מודרני עם 8 או 12 גיגה זיכרון יחזיק אותה בלי בעיה יחד עם ההקשר.

אפשר להריץ את הקבצים ישירות בתוכנות כמו Ollama, LM Studio או llama.cpp. אם אתם לא צריכים את ביטול הצנזורה ורוצים רק תשובות מדויקות, עדיף להשתמש במודל סטנדרטי דרך ספק ענן ולחסוך התעסקות עם חומרה.

ollama run hf.co/KevinJK51/Qwen3.6-12B-IQ-Ultra-Heretic-Uncensored-Thinking-V2-Hightop-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא Apache 2.0. הוא מתיר שימוש חופשי כולל שימוש מסחרי, שינוי הקוד והפצה מחדש, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗