GPT
G

gemma-4-31B-it-scotoma-2-GGUF

קוד פתוח

ReadyArtapache-2.02026-08-06

  • transformers
  • gguf
  • text-generation
  • endpoints_compatible
  • imatrix

גרסה מכווננת של גמה 31B שמנקה את סגנון הכתיבה המלאכותי ומחלישה מעט את מנגנון הסירוב. היא מתאימה למי שרוצה טקסט שוטף בלי השבלונות הקבועות של מודלים מסחריים.

  • 213 GBמשקל הקבצים
  • 251,861הורדות בחודש
  • 38לייקים

מה זה

המודל מבוסס על gemma-4-31B-it ועבר תהליך כפול. תחילה הופעל עליו שחרור חלקי של מנגנוני הסירוב באמצעות עריכת משקלים ייעודית, ואחר כך שלושה סבבי אימון העדפה על 9,300 זוגות נתונים. המטרה של האימון הייתה להעלים דפוסי ניסוח מלאכותיים שחוזרים בכל מודל שפה מודרני, כמו צמדי שמות תואר, שימוש עודף במקפים ארוכים, ושלילה כפולה.

בבדיקה שנערכה על 480 קטעי שיחה, המדידות מציגות ירידה חדה בתבניות האלה. השימוש בשמות תואר עוקבים צנח משיעור של 12.1 למאה משפטים במקור ל־0.6 בלבד, ומבנה הניסוח המנוגד הצטמצם פי ארבעה. בפועל, התוצאה היא כתיבה שנשמעת נקייה וטבעית יותר, תוך שמירה על יכולות החשיבה של מודל הבסיס.

מתאים ל

  • כתיבה יוצרת ומשחקי תפקידים

    המודל פותח ונמדד בדיוק על תרחישים אלו, והוא מייצר דיאלוגים נקיים משבלונות ומקלישאות לשוניות.

  • עריכה ושכתוב פרוזה

    אימון ההעדפה מעלים ניסוחים רובוטיים וחזרות מעיקות על שמות תואר ומבני שלילה.

  • הרצה מקומית מאובטחת

    פורמט הקבצים מאפשר הפעלה בתשתיות פנימיות ללא שליחת נתונים רגישים החוצה.

איפה זה נופל

היוצרים מבהירים במפורש שזה אינו מודל לא מצונזר. עריכת מנגנון הבטיחות היא חלקית בלבד, ובפועל הוא ימשיך לסרב לבקשות רבות בדיוק כמו מודל הבסיס של גוגל. בנוסף, מדובר בתוצר מחקרי שאינו מוגדר כמוצר מדף, והתנהגות הטקסט עשויה להשתנות מאוד בהתאם להנחיות ולהקשר. לפני שמשלבים אותו במערכת ייצורית, חובה לבדוק ידנית שהוא לא פוגע במענה לשאלות עובדתיות או בהיגיון המקורי.

אותה משפחה

gemma-4-31B-it-scotoma-2 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה בעברית?

האימון המתואר התמקד בדפוסי סגנון ומשפטים באנגלית. מודל הבסיס מבין עברית במידה מסוימת, אך ניקוי התבניות הלשוניות נבדק בעיקר על טקסט לועזי.

האם אפשר להשתמש בו כדי לעקוף חסימות תוכן?

לא. מפתח המודל הדגיש שנעשה שינוי חלקי בלבד והוא אינו מודל פרוץ, כך שהוא ממשיך לסרב לרוב הנושאים החסומים בבסיס.

איזה קובץ צריך להוריד מתוך כל הקבצים?

המאגר מכיל 20 קבצים בנפח כולל של 213 ג'יגה בייט, שמייצגים רמות כיול שונות. בוחרים קובץ בודד לפי כמות הזיכרון הפנויה בכרטיס המסך שלכם.

איך מריצים

המשקל הכולל של כלל קובצי ה־GGUF במאגר עומד על 213 ג'יגה בייט ב־20 קבצים. כדי להריץ גרסה אחת של מודל בגודל 31 מיליארד פרמטרים, תצטרכו כרטיס מסך עם לפחות 24 ג'יגה זיכרון עבור גרסאות מכווצות, או מערך של שני כרטיסים ומעלה עבור הרצה מדויקת יותר.

אם אתם לא צריכים שרת מקומי שרץ אצלכם בענן או בתוך רשת סגורה, להחזיק חומרה כזו בשביל מודל 31B עולה לא מעט. במקרים שבהם אין דרישת פרטיות מוחלטת, זול יותר לפנות למודל דרך ספק צד שלישי.

ollama run hf.co/ReadyArt/gemma-4-31B-it-scotoma-2-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח במאגר הוא Apache 2.0, שמאפשר שימוש חופשי כולל שימוש מסחרי, שינוי קוד והפצה. יחד עם זאת, כרטיס המודל מציין כי הבסיס כפוף לתנאי הרישיון המקוריים של גוגל למשפחת גמה, ולכן יש לוודא עמידה במגבלות המקוריות לפני הפצה מסחרית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗