GPT
G

gpt-oss-safeguard-20b

קוד פתוח

openaiapache-2.02025-09-18

  • transformers
  • safetensors
  • gpt_oss
  • text-generation
  • vllm

openai עומדים גם מאחורי Sora, ויש עליו סקירה כאן.

מודל ייעודי לסינון תוכן ובדיקת מדיניות אבטחה שרץ על כרטיס מסך בודד. הוא מנמק את ההחלטות שלו במקום לזרוק ציון יבש.

  • 22Bפרמטרים
  • 131,072טוקנים בהקשר
  • 12.8 GBמשקל הקבצים
  • 67,365הורדות בחודש

מה זה

מדובר במודל שמנתח טקסט מול מדיניות בטיחות שאתם מגדירים לו, במקום להסתמך רק על כללים קשיחים מוכנים מראש. הוא נבנה על בסיס משפחת gpt-oss, אבל עבר אימון ייעודי למשימות של ניטור תוכן, סינון קלטים ופלטים של מודלים אחרים, ותיוג נתונים עבור צוותי אבטחה. מתוך 21 מיליארד פרמטרים בסך הכול, רק 3.6 מיליארד פעילים בכל רגע נתון, מה שמאפשר לו לרוץ מהר יחסית לגודל שלו.

היתרון המרכזי כאן הוא שרשרת החשיבה. המודל לא רק קובע אם טקסט עובר או נחסם, אלא מפרט את הנימוקים שלו לפי המדיניות שהזנתם לו בפרומפט. אפשר לקבוע את עומק הניתוח בין שלוש רמות שונות, כדי לאזן בין זמן תגובה לרמת הדיוק, מה שמאפשר להבין בדיוק למה החלטה מסוימת התקבלה כשצריך לדבג חסימות שגויות.

מתאים ל

  • סינון קלטים ופלטים

    בדיקת פרומפטים ותשובות של צ'אטבוטים מול מדיניות שימוש, כולל נימוק מלא לכל חסימה.

  • תיוג תוכן פנימי

    מעבר על כמויות של טקסט במערכות קהילה כדי לאתר הפרות של כללי האתר באופן אוטומטי.

  • בדיקת תאימות למדיניות

    הערכת תכנים לפי הגדרות מדיניות מותאמות אישית שאתם מזינים לו ישירות בפרומפט.

איפה זה נופל

המודל הזה לא נועד למשימות כתיבה, תכנות או שיחה כללית. אם תנסו להשתמש בו ליישומים מחוץ לעולמות הבטיחות והסינון, תקבלו תוצאות לא מתאימות. בנוסף, שרשרת החשיבה שלו נועדה למפתחים בלבד, ולא אמורה להיות מוצגת למשתמשי קצה של המוצר. חייבים גם לעבוד בדיוק לפי פורמט harmony שהוגדר עבורו, אחרת הפלטים שלו ישתבשו לגמרי.

אותה משפחה

gpt-oss-safeguard יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

אפשר להשתמש בו בתור צ'אטבוט רגיל לשירות לקוחות?

לא, הוא אומן אך ורק למשימות של ניתוח בטיחות וסינון תוכן לפי מדיניות. לשיחה רגילה או מענה על שאלות כלליות צריך להשתמש במודלי gpt-oss הרגילים ולא בגרסת ה־safeguard.

האם הוא יכול לרוץ על שרת פשוט בלי מאיץ גרפי חזק?

הוא דורש כרטיס מסך עם לפחות 16 גיגה בייט של זיכרון ייעודי כדי לעבוד בצורה תקינה. בלי חומרה מתאימה זמני הניתוח יהיו ארוכים מדי לכל שימוש מעשי.

איך מריצים

המשקל הכולל של הקבצים עומד על 12.8 גיגה בייט, והוא מתוכנן לעבוד על כרטיס מסך עם 16 גיגה בייט זיכרון. מריצים אותו דרך ספריית transformers, אבל קיימת דרישה קשיחה להשתמש בפורמט התגובה harmony של החברה, כי בלעדיו הוא פשוט לא יעבוד נכון.

אם אתם צריכים לסנן תעבורה גדולה בזמן אמת, הרצה עצמית שלו על כרטיס יחיד תיתן לכם שליטה מלאה על המידע בלי להוציא טקסטים רגישים החוצה. אם מדובר בבדיקות נקודתיות או שאין לכם כוח לנהל תשתית וספריות תואמות, עדיף להשתמש בפתרון ענן קיים במקום להחזיק שרת ייעודי פועל.

from transformers import pipeline

pipe = pipeline("text-generation", model="openai/gpt-oss-safeguard-20b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש בו במוצרים מסחריים, לשנות אותו, להריץ אותו בענן פרטי או להפיץ אותו בלי לשלם תמלוגים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗