GPT
Q

Qwen-Image-NSFW

קוד פתוח

starsfridayapache-2.02025-08-19

  • diffusers
  • image-generation
  • lora
  • Qwen-Image
  • text-to-image

התאמת LoRA קטנה שמיועדת לייצור תמונות פורטרט למבוגרים על בסיס מודל התמונות של Qwen. מורידים אותה כשרוצים לעקוף מגבלות תוכן בלי להחזיק מודל כבד משלכם.

  • 184 MBמשקל הקבצים
  • 3,968הורדות בחודש
  • 157לייקים

מה זה

מדובר במשקולות LoRA קלות משקל שנוצרו על ידי חברת Chongqing Valiant Cat הסינית ומיועדות להרכבה על גבי Qwen-Image. הקבצים תופסים 184 מגה בייט בלבד, מה שאומר שלא מדובר במודל שלם שמייצר תמונות לבד, אלא בשכבת הנחיה ממוקדת שמכוונת את מודל הבסיס ליצירת תמונות פורטרט עם תכנים למבוגרים.

השליטה בתוצאה מתבצעת בעזרת מילת הפעלה ייעודית, rsq, שחייבים לכלול בפרומפט כדי לעורר את השינויים שהוטמעו באימון. המודל מתמקד באנגלית ולא כולל תיעוד של מבחני ביצועים, בנצ'מרקים או מדדי איכות מסודרים בכרטיס המקורי, כך שכל עניין ההערכה נשאר לבדיקות בעין מול הפלטים שלכם.

מתאים ל

  • עבודה בתוך ComfyUI

    חיבור ישיר של צומת LoRA לקובץ התהליך המותאם של היוצרים לצורך שליטה מקומית.

  • פורטרטים ללא חסימות

    ייצור ממוקד של תמונות דמויות למבוגרים על גבי תשתית מודל התמונות של Qwen.

  • אוטומציה בספריית diffusers

    שילוב שכבת המשקולות בתוך קוד פייתון קיים להרצה סדרתית של פרומפטים באנגלית.

איפה זה נופל

הבעיה המרכזית היא חוסר מוחלט בפרטים טכניים. היוצרים לא מפרטים על איזה מאגר נתונים הם אימנו את השכבה, באילו רזולוציות היא שומרת על יציבות, או איך היא מתמודדת עם פגמים נפוצים ביצירת גוף כמו עיוותי ידיים ופנים. בלי להכניס את מילת ההפעלה rsq לפרומפט, לא תקבלו את האפקט הרצוי.

בנוסף, הכרטיס מצהיר על תמיכה באנגלית בלבד. אם תנסו לכתוב תיאורים בעברית, המודל פשוט לא יבין מה אתם רוצים ויזרוק פלטים אקראיים. לפני שמשלבים דבר כזה בצינור עבודה, חובה לבדוק ידנית שהוא לא מייצר עיוותים אנטומיים קשים.

שאלות
נפוצות

האם אפשר להריץ את הקבצים האלה לבד בלי מודל נוסף?

לא, מדובר במשקולות LoRA במשקל 184 מגה בייט בלבד. הן חייבות להיטען ישירות על גבי מודל הבסיס Qwen-Image כדי לייצר תמונה כלשהי.

למה התמונות שנוצרות לא מציגות את הסגנון של המודל?

האימון מחייב שימוש במילת ההפעלה rsq בתוך הטקסט של הפרומפט. אם לא תוסיפו את המילה הזו, מודל הבסיס יתעלם מרוב ההתאמות שהוכנסו בשכבה.

איך מריצים

כדי להשתמש במשקולות האלה בפועל צריך להחזיק קודם כל את מודל הבסיס Qwen-Image בזיכרון, ואז להטעין את שכבת ה־LoRA דרך ספריית diffusers בקוד פייתון או לחבר צומת ייעודי בממשק ComfyUI לפי קובץ הזרימה שהיוצרים שיתפו. המשקל של הקבצים עצמם זניח, אבל מודל הבסיס עצמו דורש כרטיס מסך מודרני עם כמות זיכרון מכובדת, בהתאם לדרישות המקוריות של Qwen לתמונות.

אם יש לכם שרת מקומי עם מאיץ גרפי מתאים, ההרצה קלה מאוד כי מדובר בחיבור קובץ Safetensors רגיל. למי שאין תשתית חומרה כבדה ורוצה רק לבדוק תמונות בודדות, עדיף להריץ את השרשור על גבי שרת ענן שכור לפי שעה או שירות שמארח ComfyUI, במקום לקנות חומרה יקרה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("starsfriday/Qwen-Image-NSFW")
img = pipe("a photo").images[0]

הקבצים

7 קבצים במאגר, 184 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מפורסם ברישיון apache-2.0, שמאפשר שימוש חופשי, שינוי קוד והפצה, כולל שימוש במוצרים מסחריים. התנאי העיקרי הוא שמירת הודעות זכויות היוצרים והרישיון המקורי. צריך לזכור שהרישיון הזה מכסה רק את קובצי ה־LoRA עצמם, ואתם עדיין מחויבים לתנאי השימוש וההגבלות של מודל הבסיס שעליו אתם מלבישים אותם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗