GPT
S

Selene-1-Mini-Llama-3.1-8B

קוד פתוח

AtlaAIapache-2.02025-01-22

  • transformers
  • safetensors
  • llama
  • text-generation
  • atla

מודל שפיטה קומפקטי שמיועד להערכת תשובות של מודלים אחרים. הוא חוסך קריאות יקרות ל־GPT-4o ומאפשר לבדוק איכות, הזיות והעדפות באופן מקומי.

  • 8Bפרמטרים
  • 131,072טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 3,731הורדות בחודש

מה זה

מדובר במודל שפיטה שמבוסס על Llama 3.1 8B ועבר אימון ייעודי למשימות הערכה ובקרת איכות. במקום לכתוב טקסט חופשי, התפקיד שלו הוא לקבל פלט של מודל אחר, לנתח אותו, להחזיר נימוק מפורט ולתת ציון מספרי, הכרעה בינארית או בחירה בין שתי חלופות.

לפי נתוני הבדיקות של החברה, המודל עוקף את GPT-4o במבחנים כמו RewardBench, EvalBiasBench ו־AutoJ, והגיע למקום הראשון בין מודלי השפיטה בגודל 8B. בפועל המשמעות היא שאפשר לקבל איכות שיפוט של מודלים ענקיים ברמת דיוק גבוהה, בלי לשלם על כל בדיקה לחברות צד שלישי ובלי לשלוח מידע רגיש החוצה.

מתאים ל

  • בדיקת הזיות במערכות RAG

    השוואת התשובה שנוצרה מול מסמכי המקור כדי לוודא שאין עובדות מומצאות, בלי להוציא נתונים פנימיים החוצה.

  • דירוג איכות בין מודלים

    קבלת שתי תשובות ממודלים שונים ובחירת התשובה ההגיונית והעקבית יותר עבור בדיקות A/B.

  • סינון תשובות מזיקות

    מתן ציון מספרי קבוע לרמת הבטיחות וההתאמה של פלט המערכת לפני שהוא מוצג למשתמשי הקצה.

איפה זה נופל

המודל לא אומן לייצור טקסט כללי, כתיבת קוד או שיחה פתוחה, ולכן לא הייתי משתמש בו כעוזר אישי. בנוסף, רשימת השפות הנתמכות כוללת אנגלית, גרמנית, צרפתית, איטלקית, פורטוגזית, ספרדית, הינדי ותאילנדית, אך עברית אינה מופיעה שם. לפני שמשלבים אותו במוצר שמיועד לקהל ישראלי צריך לבדוק היטב אם הוא מסוגל לשפוט עברית בלי לאבד את כושר השיפוט.

שאלות
נפוצות

האם המודל מתאים לשיחה שוטפת עם לקוחות?

לא. המודל עבר התאמה ייעודית לתפקיד של שופט ומבקר, ולא למענה שירותי או יצירת תוכן חופשי. בשביל שיחה עדיף לקחת את Llama 3.1 המקורי או מודל שיחה ייעודי.

איך המודל מתמודד עם טקסטים בעברית?

הכרטיס מציין תמיכה באנגלית ובכמה שפות אירופיות ואסיאתיות, אך עברית אינה כלולה בהן. סביר שהוא יתקשה לזהות ניואנסים, שגיאות עובדתיות או עקביות בטקסט ישראלי, ולכן חובה לבצע בדיקה מדגמית לפני אימוץ במערכת מקומית.

איך מריצים

המודל שוקל 15 גיגהבייט ומגיע בדיוק bfloat16, כך שצריך כרטיס מסך יחיד עם לפחות 16 עד 24 גיגהבייט זיכרון כדי להריץ אותו מקומית בספריית transformers. כדי לקבל תוצאות טובות חובה להשתמש בתבנית השיחה של Llama 3 ובפרומפטים שהיוצרים פרסמו, אחרת הוא מייצר פלטים שגויים.

אם אתם מבצעים רק כמה עשרות בדיקות ביום, פנייה ל־API חיצוני תהיה זולה ופשוטה יותר מלהחזיק שרת ייעודי. הרצה עצמית משתלמת ברגע שבודקים אלפי פלטים בצינור עבודה רציף.

from transformers import pipeline

pipe = pipeline("text-generation", model="AtlaAI/Selene-1-Mini-Llama-3.1-8B")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מתיר שימוש מסחרי מלא, שינוי של הקוד והפצה של המודל בתוך מוצרים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗