GPT
Q

qwen-image-realism-lora

קוד פתוח

flymy-aiapache-2.02025-08-06

  • diffusers
  • lora
  • qwen
  • qwen-image
  • realism

תוספת משקלים קטנה שמתלבשת על מודל התמונה של Qwen ומכוונת אותו לייצור תמונות פוטוריאליסטיות. מורידים אותה כשרוצים לשפר טקסטורות עור, תאורת חוץ ודיוק בצבעים בלי לאמן מודל שלם מאפס.

  • 102 MBמשקל הקבצים
  • 2,036הורדות בחודש
  • 136לייקים

מה זה

מדובר במתאם LoRA ששוקל 102 מגה-בייט בלבד ומיועד לעבודה על גבי מודל הבסיס Qwen-Image. המטרה שלו ממוקדת מאוד, לדחוף את התוצאות של מודל הבסיס לכיוון של צילום אמיתי. עדכון 1.1 שלו מתמקד בפרטים הקטנים שעושים את ההבדל בין ציור דיגיטלי לתמונה, כמו מרקם עור טבעי עם פגמים, חלוקת תאורה וצללים בנופים, והחזרות אור בסביבות מורכבות כמו גשם או שלטי ניאון.

ההבדל העיקרי בינו לבין שימוש במודל הבסיס הרגיל הוא הדרישה להשתמש במילת המפתח Realism בכל פרומפט כדי להפעיל את הסגנון שהוטמע בו. המתאם מאפשר לקבל תוצאות מדויקות יותר בצילום אנשים מקבוצות אתניות מגוונות ובדיוק של פרטים עדינים כמו טיפות מים או קמטי בד, מבלי להחליף את כל תשתית ההסקה שלכם.

מתאים ל

  • פורטרטים לאתרי אינטרנט

    יצירת תמונות פרופיל ותצלומי אנשים מגוונים עם מרקם עור אותנטי ותאורת סטודיו טבעית.

  • צילומי נוף ריאליסטיים

    הפקת נופי טבע ותאורת חוץ ברמת פירוט גבוהה, למשל בזריחה או בשקיעה.

  • עבודה מקומית ב־ComfyUI

    חיבור מהיר של תהליך יצירת תמונות מוגדר מראש ללא צורך בכתיבת קוד פייתון.

איפה זה נופל

המתאם מחייב שימוש מפורש במילה Realism בפרומפט, ואם תשכחו אותה ההשפעה שלו לא תבוא לידי ביטוי כמו שצריך. בנוסף, המודל אומן ותועד רק באנגלית, כך שפרומפטים בעברית צפויים להניב תוצאות לא צפויות או לא לפגוע בסגנון המבוקש. צריך גם לזכור ש־LoRA לא יכול לתקן עיוותים מבניים כבדים שמקורם במודל הבסיס של Qwen, והוא מתמקד בעיקר בשכבת הטקסטורה, התאורה והצבעים.

שאלות
נפוצות

האם אפשר להריץ את ה־LoRA הזה לבד בלי מודל נוסף?

לא. מדובר בקובץ של 102 מגה-בייט שכולל רק שכבות התאמה, וחייבים להוריד ולהריץ ברקע את מודל הבסיס Qwen-Image כדי להפיק תמונה.

האם המתאם יודע לעבוד עם פרומפטים בעברית?

המודל הוגדר ונבדק באנגלית בלבד. כדי להבטיח שהתוצאה תיראה כמו שצריך וכדי שמילת ההפעלה Realism תיקלט, חובה לכתוב את הפרומפטים באנגלית.

איך מריצים

את המשקלים טוענים ישירות לספריית diffusers בפייתון מעל Qwen-Image בפורמט bfloat16, או שזורקים את קובץ ה־safetensors לתוך תיקיית ה־loras ב־ComfyUI ומריצים דרך קובץ ה־JSON שהיוצרים צירפו. תהליך ההסקה בדוגמה דורש 50 צעדים ברזולוציה של 1024 על 1024 וערך True CFG של 5, כך שצוואר הבקבוק בחומרה הוא לא קובץ ה־LoRA הקל, אלא מודל הבסיס עצמו שדורש כרטיס מסך ייעודי של אנבידיה עם מספיק זיכרון וידאו כדי להחזיק את כל ה־Pipeline.

אם אין לכם שרת עם מעבד גרפי חזק שרץ באופן קבוע, כדאי לשקול להריץ את מודל הבסיס דרך שירות ענן חיצוני שתומך בהזרקת משקלי LoRA מותאמים אישית בזמן הריצה, במקום להחזיק תשתית מקומית יקרה רק בשביל לייצר כמה תמונות.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("flymy-ai/qwen-image-realism-lora")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0 מלא. אפשר להשתמש במשקלים במוצרים מסחריים, לשנות אותם, לשלב אותם באפליקציות סגורות או להפיץ אותם מחדש, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗