GPT
M

Meta-Llama-Guard-2-8B

קוד פתוח

meta-llamallama32024-04-17

  • transformers
  • safetensors
  • llama
  • text-generation
  • facebook

זה מודל שנועד לעשות דבר אחד, לבדוק אם בקשות ותשובות של מודלי שפה הן בטוחות לשימוש. הוא מתאים למי שרוצה בקרת תוכן מקומית במקום לשלוח נתונים לשרתים חיצוניים.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 29.9 GBמשקל הקבצים
  • 2,788הורדות בחודש

מה זה

במקום לענות על שאלות כלליות, הוא מסווג טקסטים לפי 11 קטגוריות סיכון של תקן MLCommons, כולל פשע, שנאה, פגיעה עצמית, קניין רוחני וייעוץ מומחה. הפלט שלו מציין אם התוכן בטוח או לא, ובאיזו קטגוריה הוא מפר את הכללים אם נמצאה בעיה.

הבדיקה מתבצעת על ידי חישוב ההסתברות של הטוקן הראשון בפלט, כאשר ערך מעל 0.5 קובע שהתוכן מסוכן. במבחנים הפנימיים של מטא הוא הציג ציון F1 של 0.915 עם שיעור התראות שווא של 0.040, פער משמעותי מול הדור הראשון ומול שירותי ענן מתחרים שנבדקו שם.

מתאים ל

  • סינון קלט משתמשים

    בדיקת פרומפטים לפני שליחתם למודל שפה ראשי כדי לחסום בקשות פוגעניות מראש.

  • בקרת פלט של מודלים

    סריקת תשובות שהמערכת שלכם מייצרת כדי למנוע דליפת מידע פרטי או תוכן לא הולם.

  • תיוג תוכן לפי קטגוריות

    מיון אוטומטי של טקסטים בעייתיים לפי 11 סוגי סיכון מוגדרים לצורכי מעקב ודיווח.

איפה זה נופל

הנתונים מראים בעיה רצינית עם פספוסים. בקטגוריות קריטיות כמו פגיעה עצמית, עבירות מין, נשק להשמדה המונית וניצול ילדים, שיעור הפספוסים נע בין 26 ל־27 אחוזים במבחנים הפנימיים. המשמעות היא שיותר מאחת מכל ארבע פניות מסוכנות בנושאים האלה עלולה לעבור את הסינון.

בנוסף, הכרטיס מצהיר על תמיכה בשפה האנגלית בלבד. אם תזינו לו טקסטים בעברית, אתם עלולים לקבל תוצאות לא צפויות, ואי אפשר להסתמך עליו בסביבת ייצור ישראלית בלי בדיקות יסודיות.

שאלות
נפוצות

האם אפשר להשתמש בו לסינון טקסטים בעברית?

הכרטיס מצהיר על תמיכה באנגלית בלבד. למרות שהוא מבוסס על Llama 3, היכולת שלו לזהות ניואנסים, סלנג וסיכונים בעברית לא נבדקה ולא מובטחת.

איך מחליטים בפועל אם תוכן נחשב מסוכן?

המודל בודק את ההסתברות של הטוקן הראשון שנוצר בפלט. אם ההסתברות שהתוכן לא בטוח עוברת את הסף שנקבע, ברירת המחדל היא 0.5, הטקסט מוגדר כמסוכן.

האם הוא יכול להחליף מודל שיחה רגיל?

לא, המבנה שלו מותאם ספציפית למשימת סיווג בטיחות. הוא פולט רק חיווי על בטיחות הטקסט וקטגוריות הפגיעה, ולא יודע לנהל שיחה חופשית או לענות לשאלות.

איך מריצים

כדי להריץ אותו צריך כרטיס מסך עם לפחות 16 עד 24 גיגה זיכרון, שכן המשקלים תופסים כמעט 30 גיגה בפורמט המקורי לפני קוונטיזציה. הוא משתמש בספריית transformers הרגילה ודורש תמיכה בפורמט bfloat16 לחסכון במשאבים.

אם יש לכם שרת ייעודי או דרישת פרטיות מוחלטת שלא מאפשרת יציאת מידע, יש היגיון להרים אותו עצמאית. אם אתם בונים שירות קטן או שאין לכם כרטיסי מסך פנויים, להחזיק מודל של 8 מיליארד פרמטרים רק בשביל שכבת סינון זה עסק יקר ומסורבל לעומת קריאת API פשוטה.

from transformers import pipeline

pipe = pipeline("text-generation", model="meta-llama/Meta-Llama-Guard-2-8B")
print(pipe("שלום"))

הרישיון

הרישיון הוא רישיון llama3 של חברת מטא. הוא מאפשר שימוש מסחרי ומחקרי, אך כפוף למדיניות השימוש המקובל שלהם ולתנאי הרישוי הספציפיים למשפחת המודלים הזו.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗