GPT
Q

Qwen3Guard-Gen-0.6B

קוד פתוח

Qwenapache-2.02025-09-23

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • conversational

יש כאן גם סקירה על Qwen עצמו.

מודל סינון תוכן זעיר של 752 מיליון פרמטרים שמסווג בטיחות כהוראת ג'נרוציה. הוא מזהה סיכונים בשלוש רמות חומרה ותומך ב־119 שפות בעלות חישוב מינימלית.

  • 752Mפרמטרים
  • 32,768טוקנים בהקשר
  • 1.4 GBמשקל הקבצים
  • 160,131הורדות בחודש

מה זה

מדובר במודל שנועד לסנן פרומפטים של משתמשים ותשובות של מודלים אחרים לפני שהן מגיעות למסך. הוא אומן על מאגר של 1.19 מיליון דוגמאות ומחלק את הסיכון לשלוש רמות מוגדרות: בטוח, שנוי במחלוקת ולא בטוח. הגישה הזו מקלה על קבלת החלטות מדורגת במקום חסימה אוטומטית ועיוורת של כל תוכן בעייתי.

בניגוד למודלי סיווג ייעודיים עם ראש קלאסיפיקציה, הגרסה הזו מייצרת את הסיווג כטקסט לפי הוראה, בדומה למודל שיחה רגיל. הוא מכסה קטגוריות סיכון נרחבות החל מאלימות, פריצה ומידע אישי מזהה, ועד ניסיונות עקיפת הנחיות ובדיקת זכויות יוצרים, עם חלון הקשר רחב שמגיע עד 32,768 טוקנים.

מתאים ל

  • סינון פרומפטים נכנסים

    זיהוי ניסיונות עקיפה, תוכן אלים או פניות בלתי חוקיות לפני שהן מגיעות למודל השפה המרכזי.

  • בדיקת פלט ומניעת דליפות

    סריקת התשובות של המודל כדי לוודא שאינן מכילות מידע מזהה אישי או הפרות זכויות יוצרים.

  • בקרת תוכן רב־לשונית

    סיווג סיכונים באפליקציות שפועלות בעשרות שפות מגוונות על גבי תשתית חומרה קלה וזולה.

איפה זה נופל

המודל הזה הוא גרסת ה־0.6B, שהיא הקטנה ביותר בסדרה לצד דגמי 4B ו־8B, ולכן כושר ההבנה וההסקה שלו מוגבלים בהרבה מהם. מודלים זעירים נוטים לייצר יותר שגיאות סיווג במצבים מורכבים של אירוניה, הקשר תרבותי או התקפות עקיפה מתוחכמות במיוחד. בנוסף, קטגוריות כמו נושאים פוליטיים רגישים או תוכן שנוי במחלוקת מוגדרות לפי מדיניות האימון של החוקרים, וצריך לבדוק לעומק אם הן תואמות את הגבולות של המוצר שלכם.

אותה משפחה

Qwen3Guard-Gen יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם כדאי לבחור בגרסת ה־0.6B ולא בדגמים הגדולים יותר?

הגודל הזה מתאים כשתקציב החישוב אפסי או כשחייבים תגובה סופר מהירה. לדגמי ה־4B וה־8B יש עדיפות ברורה בהבנת שפה ודיוק, במיוחד בטקסטים מפותלים.

מה ההבדל בין גרסת Gen לגרסת Stream בסדרה הזו?

גרסת ה־Gen מקבלת את הטקסט ומייצרת פלט סיווג מילולי. גרסת ה־Stream כוללת ראש ייעודי שבודק סיכונים בזמן אמת בכל טוקן שנפלט מהמודל הראשי.

איך מריצים

במשקל כולל של 1.4 גיגה בייט ובדיוק של bfloat16, המודל הזה רץ בקלות על כרטיס מסך בסיסי או אפילו על מעבד שרת סטנדרטי בלי שתרגישו אותו. אפשר להעלות אותו ישירות בספריית transformers בגרסה 4.51.0 ומעלה, או להרים אותו כשרת מקומי בתאימות ל־OpenAI באמצעות vLLM או SGLang.

משתלם להריץ אותו לבד כשרוצים להחזיק את כל שרשרת סינון התוכן בתוך הרשת המקומית בלי להוציא טקסט החוצה. אם אתם צריכים בדיקה תוך כדי הזרמת טוקנים בזמן אמת, עדיף לבחון את גרסת ה־Stream ולא את גרסת ה־Gen הזו, שדורשת להמתין לייצור התשובה.

from transformers import pipeline

pipe = pipeline("text-generation", model="Qwen/Qwen3Guard-Gen-0.6B")
print(pipe("שלום"))

הרישיון

הקוד והמשקלים מופצים תחת רישיון apache-2.0. מותר להשתמש במודל לצרכים מסחריים, לשנות אותו ולהפיץ אותו כחלק ממוצר סגור, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗