GPT
G

Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking_GGUF

קוד פתוח

Andycurrentgemma2026-02-18

  • gguf
  • uncensored
  • text-generation
  • reasoning
  • instruction-tuned

גרסה מכווצת של ג'מא 3 עם מיליארד פרמטרים שתוכננה להחזיר תשובות ישירות בלי מעצורי בטיחות. היא מתאימה למי שרוצה חשיבה מובנית ומהירה מקומית על חומרה חלשה.

  • 6.7 GBמשקל הקבצים
  • 23,765הורדות בחודש
  • 140לייקים

מה זה

הבסיס כאן הוא ג'מא 3 של גוגל בגודל מיליארד פרמטרים, שעבר התאמות כדי להסיר כמעט לחלוטין את מנגנוני הסירוב הרגילים של מודלי שיחה. המפתח כיוון אותו לייצר תשובות קצרות ומהירות עם דפוסי חשיבה מובנים, בלי שכבות סינון נוספות מעבר למה שהגיע במקור מהארכיטקטורה. הדגש הוא על מהירות תגובה והשלמת טקסט ישירה.

בגודל כזה של מיליארד פרמטרים, המודל פונה לתרחישים שבהם צריך לוגיקה בסיסית ומענה קצר בזמן אפס. הוא שונה מגרסת הבסיס של גוגל בעיקר בגישה, הוא לא מטיף, לא מסרב בקלות לשאלות רגישות, ומנסה לעבוד כרכיב קל בתוך תהליכים אוטומטיים. הכרטיס לא כולל מבחני ביצועים מספריים או ציוני בנצ'מרק, כך שאין כאן נתוני דיוק רשמיים לבנות עליהם.

מתאים ל

  • סוכנים קלים באנגלית

    מגיב מהר מאוד בשרשראות חשיבה קצרות בלי להעמיס על השרת המקומי.

  • עוזר מקומי למכשיר קצה

    דורש מעט מאוד זיכרון ומתאים לעבודה שקטה ישירות על המעבד.

  • ניסויי פרומפטים ללא סינון

    טוב לבדיקות מערכת כשרוצים תשובות ישירות בלי שבלונות סירוב קבועות.

איפה זה נופל

מיליארד פרמטרים זה מודל קטן מאוד, והוא מוגדר רשמית רק באנגלית. הוא מותאם ליצירת טקסטים קצרים עד בינוניים, כך שניסיונות למשוך ממנו ניתוחים ארוכים ייגמרו מהר מאוד בהזיות או איבוד הקשר. מעבר לזה, המודל מוגדר כלא מצונזר עם הסרה מכוונת של מנגנוני סירוב, מה שאומר שכל האחריות על בדיקת הפלטים והגבלת תוכן פוגעני נופלת עליכם דרך ה־system prompt.

שאלות
נפוצות

המודל הזה תומך בעברית?

הכרטיס מציין רשמית רק אנגלית. בגודל של מיליארד פרמטרים, יכולת ההבנה והכתיבה בעברית תהיה כנראה חלשה עד לא קיימת, כך שלא כדאי לבנות עליו לעבודה מקומית בשפה הזו.

איזה פורמט כתיבה צריך להזין לו?

הוא עובד עם התבנית המקורית של ג'מא. כדי לקבל תוצאות טובות, הכרטיס מדגיש שחייבים להשתמש בפורמט ההוראות המדויק של ג'מא ולהגדיר לו הנחיות מערכת מפורשות, בלי לערבב מבנים של מודלים אחרים.

איך מריצים

מדובר בקובצי GGUF במשקל כולל של 6.7 גיגה בייט שמתחלקים לתשעה קבצים, מה שמתאים ישר להרצה בכלים מבוססי llama.cpp. הדרישות לחומרה מינימליות לחלוטין, הוא מיועד לרוץ בקלות על כרטיסי מסך ביתיים של 8 גיגה בייט זיכרון גרפי, ואפשר להריץ אותו אפילו ישירות על מעבד רגיל או התקני קצה בלי להרגיש חנק בביצועים.

אם אתם צריכים רק עזרה פשוטה או שילוב בכלים קטנים, שווה להרים אותו מקומית כי העלות זניחה והתגובה מיידית. מנגד, אם המשימה שלכם דורשת הבנה עמוקה, ניתוח טקסטים מורכבים או ידע רחב, חבל על הזמן שלכם עם הרצה מקומית של מיליארד פרמטרים, ועדיף לשלם גרושים ל־API של מודל ענן גדול בהרבה.

ollama run hf.co/Andycurrent/Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking_GGUF:Gemma-3-1B-it-GLM-4.7-Flash-Heretic-Uncensored-Thinking_Q5_k_m

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל כפוף לרישיון של ג'מא מבית גוגל, שממשיך איתו מגרסת המקור. הרישיון הזה מאפשר שימוש מסחרי, אבל כולל תנאי שימוש ייעודיים של גוגל ומדיניות שימוש הוגן שחייבים לפעול לפיהם. אם אתם מתכוונים להטמיע אותו במוצר שמפיצים הלאה, אתם מחויבים לקרוא את התנאים המלאים של הרישיון המקורי ולוודא שהיישום שלכם לא מפר אותם.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗