GPT
S

supergemma4-26b-uncensored-gguf-v2

קוד פתוח

Jiunsonggemma2026-04-11

  • gguf
  • gemma4
  • uncensored
  • fast
  • llama.cpp

גרסת GGUF לא מצונזרת ומהירה על בסיס Gemma בגודל 26B. מי שמוריד אותה מחפש צ'אט מקומי שלא נחסם על כל שטות ורץ מהר בלי לזלוג למצב קוד.

  • 15.6 GBמשקל הקבצים
  • 383,295הורדות בחודש
  • 984לייקים

מה זה

הקובץ הזה הוא המרה מכוילת שמבוססת על google/gemma-4-26B-A4B-it ועברה התאמות כדי לענות בחופשיות בלי מנגנוני הסינון הרגילים של גוגל. בניגוד לגרסאות מקומיות קודמות שנטו להפנות כמעט כל שאלה לכתיבת קוד או הפעלת כלים, הטמיעו כאן תבנית שיחה ניטרלית ששומרת על דיאלוג רגיל. הדגש כאן הוא על טקסט כללי, לוגיקה, קוד ועבודה בקוריאנית.

במדד Quick bench הגרסה הזו קיבלה 95.8 לעומת 91.4 בבסיס המקורי. זה אומר שבפועל מקבלים תשובות עקביות יותר ומענה הגיוני יותר במשימות מעשיות, לצד שיפור בקצב הפליטה שעלה מ־42.5 ל־46.2 טוקנים לשנייה בהרצת ייחוס של MLX.

מתאים ל

  • עבודה ללא סינון

    מענה ישיר לשאלות שחוסמות מודלים מסחריים רגילים, בלי התחסדות ובלי סירובים.

  • פיתוח מקומי במק

    ניצול llama.cpp על מעבדי אפל לקבלת קצב פליטה גבוה של עד 89 טוקנים לשנייה.

  • משימות קוד וטקסט

    ביצוע משימות פייתון ומענה כללי בלי שהמודל יזרוק בטעות תבניות קריאה לכלים.

איפה זה נופל

המודל מיועד ומכויל רשמית רק לשפות אנגלית וקוריאנית. עברית בכלל לא ברשימה, ולכן אי אפשר לבנות עליו לפלט תקין או עקבי בעברית. בנוסף, הסרת הסינון אומרת שאין לו מעצורים בטיחותיים, כך שאי אפשר לחבר אותו ישירות למשתמשי קצה בלי שכבת בדיקה משלכם.

אותה משפחה

supergemma4-26b-uncensored יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לעבוד בעברית?

השפות היחידות שנתמכות ומופיעות בנתוני המודל הן אנגלית וקוריאנית. הוא לא אומן ולא נבדק לעברית, ולכן לא מומלץ להסתמך עליו לפרויקטים מקומיים.

איזו חומרה צריך כדי להריץ את גרסת ה־GGUF?

הקובץ שוקל 15.6 גיגה בכימות Q4_K_M. נדרש מחשב עם 24 עד 32 גיגה זיכרון מאוחד ב־Mac או כרטיס מסך עם זיכרון דומה כדי להריץ אותו במהירות סבירה.

איך מריצים

המשקל הכולל עומד על 15.6 גיגה בכימות Q4_K_M, כך שצריך מחשב עם לפחות 24 או 32 גיגה זיכרון כדי לטעון אותו עם ההקשר. המפתחים בדקו אותו ישירות על Apple Silicon עם שבב M4 Max תחת llama.cpp, ושם הוא הגיע לקצב עיבוד קלט של עד 704.9 טוקנים לשנייה ופליטה של 89.4 טוקנים לשנייה.

אם אין לכם חומרה כזו או לפחות כרטיס מסך עם מספיק VRAM ייעודי, הוא יזחל או יקרוס. במקרה שאתם לא חייבים מודל לא מצונזר מקומית, עדיף פשוט לצרוך מודל דומה דרך API.

ollama run hf.co/Jiunsong/supergemma4-26b-uncensored-gguf-v2:Q4_K_M

הקבצים

4 קבצים במאגר, 15.6 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא gemma. תנאי השימוש של משפחת ג'מה מתירים בדרך כלל שימוש מסחרי ומחקר, אבל מחייבים עמידה בכללי השימוש המקובלים של גוגל. מומלץ לוודא שההסרה של מנגנוני הבטיחות בגרסה הזו לא מתנגשת עם המגבלות שגוגל דורשת בהפצה למוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗