GPT
Q

Qwen3Guard-Gen-8B

קוד פתוח

Qwenapache-2.02025-09-23

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • conversational

יש כאן גם סקירה על Qwen עצמו.

זהו שומר סף מבוסס מודל שפה שנועד לסנן פרומפטים ותשובות של משתמשים. הוא מחזיר סיווג בטיחות מדורג בשלוש רמות חומרה ותומך ב־119 שפות וניבים.

  • 8.2Bפרמטרים
  • 32,768טוקנים בהקשר
  • 15.3 GBמשקל הקבצים
  • 48,915הורדות בחודש

מה זה

מדובר במודל ייעודי לסינון תוכן ובטיחות שנבנה על בסיס סדרת Qwen3 ואומן על 1.19 מיליון דוגמאות מתויגות. בניגוד למסווגים פשוטים שפולטים רק תו שחור או לבן, גרסת ה־Gen ניגשת למשימת הבטיחות כמודל גנרטיבי שממלא הוראות. הוא מחלק את הסיכון לשלוש רמות: בטוח, שנוי במחלוקת, ולא בטוח.

הוא מזהה שורה ארוכה של קטגוריות סיכון מוגדרות מראש, החל מאלימות, פגיעה עצמית ותוכן מיני, דרך זכויות יוצרים ומידע מזהה אישי, ועד ניסיונות Jailbreak בקלט של משתמשים. הגרסה הזו בגודל 8.2 מיליארד פרמטרים היא הגדולה והמקיפה במשפחה שמציעה גם גרסאות קטנות יותר, והיא מכוונת לדיוק גבוה יותר בסיווג קלטים ותשובות מורכבות.

מתאים ל

  • בדיקת פרומפטים לפני עיבוד

    זיהוי ניסיונות Jailbreak ותוכן לא חוקי בקלט של משתמשים עוד לפני שליחתו למודל הראשי.

  • סינון תשובות של מודלים

    אימות פלט של מודלי שפה כדי למנוע זליגת מידע אישי מזהה, הפרת זכויות יוצרים או תיאורי אלימות.

  • סיווג סיכונים מדורג

    הפרדה בין תוכן מסוכן לחלוטין לתוכן שנוי במחלוקת שדורש רק אזהרה או בדיקה אנושית.

איפה זה נופל

מכיוון שמדובר במודל גנרטיבי מלא של שמונה מיליארד פרמטרים, כל בדיקת בטיחות מייצרת עומס חישובי והשהיה נוספת לפני או אחרי פנייה למודל הראשי שלכם. הוא אמנם מדווח על תמיכה ב־119 שפות וניבים, אך הדגש במדידות הרשמיות הוא על אנגלית וסינית, כך שחובה לבדוק התנהגות מול סלנג וביטויים רגישים בעברית.

בנוסף, הקטגוריה של נושאים פוליטיים רגישים מוגדרת סביב מידע כוזב על פעולות ממשל ודמויות ציבוריות. מודלים שמגיעים מהסביבה הזו עלולים להציג רגישות יתר או הטיות סביב נושאים שנויים במחלוקת, ותצטרכו לכייל את רמת ה־Controversial כדי לא לחסום משתמשים לחינם.

אותה משפחה

Qwen3Guard-Gen יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

למה להריץ מודל של 8B רק בשביל סינון?

אם אתם מפעילים מערכת בסביבה מבוקרת עם דרישות פרטיות מחמירות, אתם לא יכולים לשלוח טקסטים לשירותי ענן חיצוניים. מודל 8B מציע הבנה עמוקה של הקשר שמונעת חסימות שגויות שקורות במסווגים פשוטים.

מה ההבדל בין גרסת ה־Gen הזו לגרסת ה־Stream?

גרסת ה־Gen מייצרת את הסיווג כפלט טקסטואלי מלא לאחר קבלת כל הקטע, ומתאימה לבדיקת קלט שלם או תשובה סופית. גרסת ה־Stream כוללת ראש סיווג ייעודי שמנטר טוקנים בזמן אמת בזמן היצירה.

איך מריצים

המשקל של המודל בפורמט bfloat16 תופס 15.3 גיגה בייט, ולכן תצטרכו כרטיס מסך עם לפחות 24 גיגה זיכרון כדי להחזיק אותו בנוחות לצד הקשר ארוך. הוא דורש transformers מגרסה 4.51.0 ומעלה, ונתמך ישירות ב־vLLM מגרסה 0.9.0 או ב־SGLang מגרסה 0.4.6.post1 להקמת שרת תואם OpenAI.

אם אתם צריכים בדיקות מהירות בזמן אמת תוך כדי הזרמת טוקנים למשתמש, הגרסה הזו לא מתאימה, ובסדרה קיימת גרסת Stream ייעודית לכך. כמו כן, אם אין לכם שרת ייעודי שמצדיק החזקת מאיץ פועל רק בשביל סינון, עדיף להפנות את הבקשות ל־API מרוחק.

from transformers import pipeline

pipe = pipeline("text-generation", model="Qwen/Qwen3Guard-Gen-8B")
print(pipe("שלום"))

הרישיון

המודל משוחרר ברישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי, הפצה והטמעה במוצרים סגורים בלי תשלום תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים והתנאים המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗