GPT
G

gpt-oss-safeguard-120b

קוד פתוח

openaiapache-2.02025-09-18

  • transformers
  • safetensors
  • gpt_oss
  • text-generation
  • vllm

openai עומדים גם מאחורי Sora, ויש עליו סקירה כאן.

מודל מבוסס הסקת מסקנות שמסנן תוכן ובודק עמידה במדיניות בטיחות שתגדירו לו בעצמכם. הוא לא נועד לשיחה כללית, אלא לקבלת החלטות בטיחות מנומקות עם שרשרת חשיבה מלאה.

  • 120Bפרמטרים
  • 131,072טוקנים בהקשר
  • 60.8 GBמשקל הקבצים
  • 4,222הורדות בחודש

מה זה

מדובר במודל שמנתח טקסט ומחליט אם הוא מפר כללי בטיחות שהזנתם לו מראש. במקום לפלוט ציון מספרי עיוור כמו מסננים רגילים, הוא מציג שרשרת חשיבה מלאה שמסבירה למה הטקסט תקין או בעייתי, מה שמקל על איתור באגים בהחלטות מדיניות. אפשר לכוונן את מאמץ החשיבה שלו בין נמוך, בינוני לגבוה כדי לאזן בין איכות הנימוק לזמני תגובה.

המבנה שלו כולל כ־120 מיליארד פרמטרים אבל רק 5.1 מיליארד מהם פעילים בכל ריצה. המשמעות היא שאתם מקבלים יכולת תפיסה של מודל ענק עם זמני ריצה ומשאבים של מודל קטן בהרבה. הוא נבנה על גבי משפחת gpt-oss ומיועד ספציפית לסינון קלטים ופלטים במערכות מבוססות שפה או לניטור תוכן באופליין.

מתאים ל

  • סינון קלט ופלט במערכות שפה

    הוא בודק טקסט לפני שהוא נכנס למודל או מוחזר למשתמש, לפי קובץ מדיניות מוגדר.

  • תיוג תוכן לא מקוון

    הוא מנתח מאגרי תוכן גדולים וקובע האם הם עומדים בהנחיות קהילה תוך תיעוד הנימוק.

  • בדיקת מדיניות מותאמת אישית

    מזינים לו כללים ייחודיים למוצר והוא מפרש אותם ישירות בלי צורך באימון מחדש.

איפה זה נופל

הוא לא יעבוד לכם למשימות כתיבה או צ'אט, והיוצרים מבהירים במפורש שהוא מיועד לבטיחות בלבד. בנוסף, הוא אומן על פורמט מענה ייעודי בשם harmony וחייבים לעבוד לפיו, אחרת הפלטים פשוט לא יעבדו תקין. שרשרת החשיבה הגולמית שלו מיועדת רק למפתחים ולא לחשיפה למשתמשי קצה.

אותה משפחה

gpt-oss-safeguard יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

אפשר להשתמש בו בתור צ'אטבוט רגיל למשתמשים?

לא. המודל אומן אך ורק להסקה וסיווג לפי חוקי בטיחות, ולמשימות שיחה רגילות צריך לפנות למודלים הכלליים של gpt-oss.

חייבים לעבוד עם פורמט harmony?

כן. הכרטיס מציין בפירוש שהמודל אומן על הפורמט הזה ואינו מתפקד כראוי בלעדיו.

איך שולטים על זמני התגובה שלו?

אפשר להגדיר את רמת מאמץ החשיבה לנמוכה, בינונית או גבוהה, או לבחור בגרסת ה־20B שדורשת פחות משאבים.

איך מריצים

המשקל הכולל יושב על כ־60.8 גיגה בייט, והוא נבנה כך שיוכל להיכנס לכרטיס H100 יחיד. אם אין לכם כרטיס ברמה הזו או שאתם חייבים זמני תגובה מהירים יותר, יש גרסת 20 מיליארד פרמטרים עם 3.6 מיליארד פרמטרים פעילים.

מי שאין לו תשתית מתאימה או שצריך לסנן נפחי תנועה אדירים בזמן אמת בלי להחזיק שרת יקר באוויר, יעדיף לצרוך מודלים כאלה דרך שירות חיצוני במקום לתחזק חומרה כבדה לבד.

from transformers import pipeline

pipe = pipeline("text-generation", model="openai/gpt-oss-safeguard-120b")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מתיר שימוש חופשי לחלוטין, כולל שימוש מסחרי מלא ושינוי של הקוד והמשקלים. אין בו מגבלות שמחייבות אתכם לפתוח את הקוד של המוצר שלכם, מה שמאפשר להטמיע אותו בתוך שירות סגור בלי דאגות משפטיות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗