GPT
G

gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF

קוד פתוח

mradermacherapache-2.02026-04-13

  • transformers
  • gguf
  • heretic
  • uncensored
  • decensored

גרסה מכווצת של מודל ראייה ושפה שעבר הסרת סינון מלאה. הוא מיועד למי שמחפש מודל מקומי שלא מסרב לפקודות ומסוגל לעבד גם תמונות.

  • 280 GBמשקל הקבצים
  • 223,856הורדות בחודש
  • 39לייקים

מה זה

מדובר באוסף קבצי GGUF שעברו כיול באמצעות imatrix על בסיס גרסה לא מצונזרת של גמא. המטרה של המפרסם כאן היא לא לאמן משהו חדש מאפס, אלא לקחת מודל קיים של llmfan46 ולהנגיש אותו במגוון משקלים למשתמשי llama.cpp. הכרטיס מציין שמדובר במודל ראייה, אך קובצי הקישור לתמונות נמצאים במאגר המקביל של הקוונטים הסטטיים ולא ישירות כאן.

הייחוד של המודל המקורי הוא הסרת מגבלות הבטיחות והסירוב הרגילות שגוגל שמה במקור. המשמעות היא שהוא לא יטיף מוסר ולא יחסום בקשות רגישות. עם זאת, אין בכרטיס שום נתוני מדידה מסודרים, ציוני בנצ'מרק או השוואה מדעית של הדיוק מול גרסאות מקבילות. המידע היחיד מתמקד ביתרונות הטכניים של דחיסות מסוג IQ מול שיטות ישנות יותר.

מתאים ל

  • מחקר על מודלים לא מצונזרים

    בדיקת התנהגות המודל והתגובות שלו ללא מנגנוני הסירוב הרגילים של מפתחות התשתית.

  • עיבוד תמונה וטקסט מקומי

    הרצה מקומית על גבי שרת פרטי שלא שולח נתוני מדיה או טקסט לשירותי ענן חיצוניים.

  • ניסויי קוונטיזציה

    בדיקת איכות התוצאות בין שיטות דחיסה שונות באמצעות קובץ ה־imatrix שמצורף להורדה.

איפה זה נופל

הכרטיס מגדיר את הגרסאות הנמוכות ביותר כמו IQ1 במפורש כמיועדות לנואשים בלבד, עם ירידה מורגשת באיכות הפלט. מעבר לכך, מודל שהוסר ממנו הסינון נוטה לייצר הזיות בלי שום בלמים, ולכן אי אפשר לסמוך על עובדות שהוא פולט בלי אימות. בנוסף, חסרים במאגר הזה קובצי ה־mmproj הדרושים לעיבוד תמונה, כך שתצטרכו להוריד אותם ידנית ממאגר אחר כדי שהראייה תעבוד.

שאלות
נפוצות

למה המודל לא מנתח תמונות למרות שכתוב שהוא מודל ראייה?

הקובץ שהורדתם כולל רק את משקלי השפה. כדי להשתמש ביכולות ראייה ב־llama.cpp חובה להוריד את קובץ ה־mmproj המתאים מהמאגר הסטטי של אותו מפרסם, ולטעון אותו בפקודת ההרצה.

איזו גרסה כדאי להוריד למחשב עם 16GB זיכרון כרטיס מסך?

עדיף לבחור ב־Q4_K_S ששוקל 15.6 ג'יגה בייט או ב־IQ3_M ששוקל 12.5 ג'יגה בייט. גרסאות אלו ישאירו מעט מקום פנוי להקשר בלי לחרוג מזיכרון הווידאו.

איך מריצים

המשקלים מגיעים מ־8.4 ג'יגה בייט בגרסאות הקיצוניות ביותר ועד 22.7 ג'יגה בייט בקוונט Q6_K. הגרסה המומלצת הרשמית היא Q4_K_M במשקל 16.9 ג'יגה בייט, שמציעה איזון טוב בין דיוק למהירות, או Q4_K_S במשקל 15.6 ג'יגה בייט. לצורך הרצה מקומית מלאה תצטרכו כרטיס מסך עם לפחות 16 עד 24 ג'יגה בייט של VRAM, תלוי בגרסה ובגודל ההקשר.

אם אין לכם חומרה ייעודית כזו או אם אתם לא צריכים את היכולת לעקוף מגבלות סירוב, שימוש ב־API מנוהל של מודלים פתוחים יהיה פשוט וזול בהרבה מהשקעה במחשב חזק.

ollama run hf.co/mradermacher/gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

26 קבצים במאגר, 280 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0. הוא מתיר שימוש מסחרי, שינוי קוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. זה מתאים למי שרוצה לשלב את הקבצים במוצר מסחרי בלי לשלם תמלוגים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗