GPT
N

next-scene-qwen-image-lora-2509

קוד פתוח

lovis93mit2025-09-26

  • diffusers
  • lora
  • cinematic
  • comfyui
  • qwen

המודל מייצר המשכיות קולנועית מתמונה לתמונה במקום עריכה בודדת. מי שבונה סטוריבורד או רצף שוטים מקבל תנועות מצלמה ושינויי תאורה שנשענים ישירות על הפריים הקודם.

  • 587 MBמשקל הקבצים
  • 17,446הורדות בחודש
  • 651לייקים

מה זה

מדובר במתאם LoRA שמאומן על גבי מודל הבסיס Qwen-Image-Edit מגרסה 2509. הרעיון כאן הוא תנועה נרטיבית בין תמונות. במקום להחליף אלמנט נקודתי בתוך תמונה קיימת, הוא לוקח פריים קיים וגוזר ממנו את השוט הבא ברצף, תוך שמירה על המרחב, התאורה והדמויות.

הוא מתמקד בשינויי זווית, תנועות מצלמה כמו דולי וטראקינג, חשיפת פרטים שיוצאים או נכנסים לפריים, ומעברים בתאורה או במזג אוויר. קיימות שתי גרסאות בקבצים, כאשר גרסה שתיים עברה אימון על דאטה איכותי יותר, מגיבה מדויק יותר להנחיות ומתקנת בעיה של פסים שחורים בשוליים שהופיעה בגרסה הראשונה.

מתאים ל

  • בניית סטוריבורד

    יצירת רצף שוטים עקבי להפקות וידאו ואנימציה על ידי שרשור פקודות מצלמה מפריים לפריים.

  • הכנת פריימים לווידאו

    יצירת תמונות מפתח עם תנועה ברורה ושינויי זווית לפני הזנה למודלים של תמונה לווידאו.

  • התפתחות קונספט ארט

    הדגמת שינויי תאורה, מזג אוויר וסביבה לאורך זמן על בסיס עיצוב סביבתי קיים.

איפה זה נופל

המתאם הזה לא מתאים לעריכת תמונה בודדת, להחלפת אובייקט ספציפי או ליצירת פורטרטים סטטיים. הוא תוכנן לקדם סיפור מפריים לפריים, ולכן הוא מעדיף רצף והמשכיות קולנועית על פני דיוק של פרטים מבודדים. בגרסה הראשונה יש תופעה של פסים שחורים בשולי התמונה, ולכן חייבים לעבוד עם גרסה שתיים. בנוסף, הוא מאומן על הנחיות באנגלית בלבד ומסתמך על תבנית פקודה מסוימת מאוד כדי לעבוד כמו שצריך.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה לבד בלי מודל בסיס?

לא. זהו מתאם מסוג LoRA ששוקל 587 מגהבייט ואינו מכיל את כל המשקולות הנדרשות ליצירת תמונה. חובה לטעון איתו את מודל הבסיס Qwen-Image-Edit מגרסה 2509.

איזו גרסה של הקובץ כדאי להוריד?

עדיף להוריד רק את גרסה שתיים, הקובץ שנקרא next-scene_lora-v2-3000.safetensors. גרסה אחת סובלת מגבולות שחורים בתמונות ומגיבה פחות טוב להנחיות הטקסט.

האם אפשר לכתוב לו פרומפטים בעברית?

המודל מוגדר ומאומן באנגלית בלבד. כדי להפעיל את ההמשכיות צריך להשתמש במבנה הנחיה שמתחיל במונח Next Scene באנגלית, יחד עם הוראות בימוי ותנועת מצלמה בשפה זו.

איך מריצים

כדי להריץ אותו צריך להוריד את קובץ ה־safetensors, ששוקל כמה מאות מגהבייטים, ולטעון אותו יחד עם מודל הבסיס Qwen-Image-Edit בתוך ComfyUI או סביבת diffusers. החומרה הנדרשת נקבעת לפי מודל הבסיס של Qwen ולא לפי ה־LoRA עצמו, כך שצריך כרטיס מסך שיכול להחזיק את מודל העריכה המלא בזיכרון.

היוצר מספק קובץ JSON ייעודי לזרימת עבודה ב־ComfyUI וממליץ לעבוד עם גרסה שתיים בעוצמת מתאם של 0.7 עד 0.8. את ההנחיות הטקסטואליות צריך להתחיל עם הקידומת Next Scene כדי לקבל את תנועת המצלמה וההמשכיות הרצויה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("lovis93/next-scene-qwen-image-lora-2509")
img = pipe("a photo").images[0]

הרישיון

רישיון MIT פתוח ומתיר שימוש מסחרי, מחקרי ופרטי ללא תשלום תמלוגים, בכפוף למתן קרדיט. היוצר מציין ששימוש מסחרי דורש בדיקות עצמאיות שלכם לפני הטמעה במוצר. קחו בחשבון שאתם תלויים גם בתנאי הרישיון של מודל הבסיס Qwen-Image-Edit עצמו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗