GPT
Q

Qwen3Guard-Gen-4B

קוד פתוח

Qwenapache-2.02025-09-23

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • conversational

יש כאן גם סקירה על Qwen עצמו.

מודל סינון תוכן של 4.4 מיליארד פרמטרים שמסווג טקסט לשלוש רמות חומרה. הוא מתאים למי שרוצה לבדוק פרומפטים ותשובות מקומית ב־119 שפות בלי להסתמך על שירות חיצוני.

  • 4.4Bפרמטרים
  • 32,768טוקנים בהקשר
  • 8.2 GBמשקל הקבצים
  • 103,456הורדות בחודש

מה זה

במקום להסתפק בהחלטה בינארית של מותר או אסור, הדגם הזה מחלק את הטקסט לשלוש רמות: בטוח, שנוי במחלוקת ולא בטוח. החלוקה הזו מאפשרת גמישות ביישומים שונים, למשל כשיש תוכן שאינו מזיק באופן מובהק אלא תלוי בהקשר. הוא אומן על 1.19 מיליון פרומפטים ותשובות מתויגים, ומתפקד כמודל גנרטיבי שעוקב אחרי הוראות כדי לסווג את הקלט.

המודל מנטר מגוון קטגוריות סיכון ספציפיות, כולל אלימות, פעולות לא חוקיות, תוכן מיני, פגיעה עצמית, חשיפת מידע אישי וזכויות יוצרים. בנוסף, הוא בודק נושאים פוליטיים רגישים וניסיונות עקיפת הנחיות (Jailbreak) בקלט של המשתמש. התמיכה ב־119 שפות וניבים הופכת אותו לפתרון רלוונטי למי שצריך סינון תוכן מחוץ לאנגלית בלבד, ובגודל של 4B הוא מציע פשרה סבירה בין ביצועים למשאבים ביחס לגרסאות ה־0.6B וה־8B בסדרה.

מתאים ל

  • בדיקת פרומפטים לפני עיבוד

    זיהוי ניסיונות Jailbreak ותוכן אלים או לא חוקי בהודעות משתמש לפני שליחה למודל ראשי.

  • סינון תשובות מודל

    בדיקה שהפלט לא מכיל מידע אישי מזוהה, הפרת זכויות יוצרים או פגיעה עצמית לפני הצגתו.

  • סיווג תוכן רב-לשוני

    חלוקת תוכן לרמות סיכון שונות במערכות שתומכות בשפות מרובות מתוך 119 השפות הנתמכות.

איפה זה נופל

מדובר במודל גנרטיבי שמייצר תשובה כטקסט, מה שאומר שהסיווג עצמו מוסיף השהיה לתהליך בהשוואה לראש סיווג ייעודי. הקטגוריה של נושאים פוליטיים רגישים מוגדרת כמידע שקרי על פעולות ממשל או דמויות ציבוריות, הגדרה שעשויה להכניס הטיות סינון שחובה לבדוק מראש מול דרישות המוצר שלכם. בנוסף, זיהוי Jailbreak מוגבל רק לקלט המשתמש ולא קיים בבדיקת פלט.

אותה משפחה

Qwen3Guard-Gen יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

מה ההבדל בין גרסת ה־Gen הזו לגרסת ה־Stream של הסדרה?

גרסת ה־Gen מייצרת את הסיווג כטקסט בעקבות הוראה, ומתאימה לבדיקת קלט שלם או פלט סופי. גרסת ה־Stream כוללת ראש סיווג ברמת הטוקן ומיועדת לניטור בזמן אמת תוך כדי שהטקסט נוצר.

האם המודל חוסם אוטומטית את הטקסט?

לא. המודל רק מסווג את הקלט לקטגוריה ולרמת חומרה של בטוח, שנוי במחלוקת או לא בטוח. ההחלטה אם לחסום, להתריע או להעביר לבדיקה אנושית נשארת בקוד שלכם.

איך מריצים

המשקל הכולל של הקבצים עומד על 8.2 גיגה-בייט בפורמט bfloat16, כך שתצטרכו כרטיס מסך עם לפחות 12 עד 16 גיגה-בייט זיכרון כדי להריץ אותו בנוחות יחד עם חלון הקשר מלא של 32,768 טוקנים. הוא דורש את ספריית transformers מגרסה 4.51.0 ומעלה, או מנועי שרת כמו vLLM מגרסה 0.9.0 ו־SGLang מגרסה 0.4.6.post1 ליצירת נקודת קצה תואמת OpenAI.

הגרסה הזו היא גרסה גנרטיבית, בניגוד לגרסת ה־Stream שמנטרת טוקנים בזמן אמת. אם אין לכם תשתית GPU זמינה להחזקת מודל של 4B ברקע רק בשביל סינון, שירות API חיצוני עשוי לחסוך תחזוקה, בעיקר בעומסים נמוכים.

from transformers import pipeline

pipe = pipeline("text-generation", model="Qwen/Qwen3Guard-Gen-4B")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה של המודל בחינם בתוך מוצרים. הדרישה העיקרית היא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗