GPT
M

minimax-h3_fl2v_8Step_motion_enhancer

קוד פתוח

rzgarapache-2.02026-09-04

  • diffusers
  • text-to-video
  • image-to-video
  • image-text-to-video
  • video-to-video

תוספת LoRA שמאיצה הנפשת תמונה לווידאו לשמונה צעדים בלבד. rzgar כיוון אותה ספציפית לדיוק אנטומי ותנועות מורכבות סביב תכני NSFW.

  • 1.8 GBמשקל הקבצים
  • 2,412הורדות בחודש
  • 38לייקים

מה זה

מדובר במשקולת LoRA בגודל 1.8 גיגה בייט שמיועדת למודל הווידאו MiniMax-H3 FL2VS. הבסיס שלה מגיע מהגרסה של LightX2V שנועדה לחתוך את זמני הריצה לשמונה צעדי דגימה, אבל כאן היוצר לקח את זה לכיוון מוגדר מאוד. הדגש הוא על תוכן למבוגרים, בעיקר סביב פיזיקה ותנועה שלא תמיד נראות טוב ברינדור וידאו רגיל.

במקום להמציא מודל שלם מאפס, הקובץ הזה יושב על תשתית קיימת ומשפר אנטומיה נשית וגברית. מי שמפתח סביב המודל הזה יודע שווידאו נוטה להתעוות בתנועות גוף מהירות, והמטרה כאן היא לייצב את ההנפשה בדיוק במקומות האלה, בלי להכפיל את כמות צעדי הדגימה.

מתאים ל

  • הנפשת תמונות NSFW במהירות

    רינדור וידאו למבוגרים בשמונה צעדים בלבד, שחוסך זמן עיבוד משמעותי על השרת.

  • תיקון אנטומיה בווידאו

    שיפור היציבות של תנועות גוף מורכבות במודל MiniMax-H3, שנוטות להתפרק ברינדור רגיל.

  • בדיקות מקומיות קצרות

    סבבי פיתוח מהירים יותר מקומית תודות למספר הצעדים הנמוך.

איפה זה נופל

ההתמקדות כאן צרה מאוד, וסביר להניח שהיא לא תתרום דבר אם אתם מחפשים תנועות נוף, מכוניות או אנימציה יומיומית. בנוסף, מודלים שדוחסים ייצור וידאו לשמונה צעדים בלבד תמיד משלמים בפירוט עדין או ביציבות של פריימים רחוקים. אם אתם צריכים תוכן נקי למוצר לכל המשפחה, אל תגעו בזה, המשקולות אומנו במפורש על תכנים למבוגרים.

שאלות
נפוצות

אפשר להריץ את זה בלי מודל הבסיס?

לא. מדובר בקובץ LoRA ששוקל 1.8 גיגה בייט ומיועד לשבת על גבי מודל הווידאו MiniMax-H3 FL2VS. חייבים לטעון קודם את הבסיס ורק אז להחיל את המשקולות האלה.

צריך להשאיר את התוספת של LightX2V דולקת ברקע?

ממש לא. כרטיס המודל מנחה במפורש לכבות את ה־LoRA הרגיל של LightX2V, כי המודל הזה כבר בנוי עליו ומחליף אותו בפועל.

איך מריצים

טוענים את קובץ ה־safetensors ישירות לתוך פייפליין של diffusers או ComfyUI מעל מודל הבסיס MiniMax-H3. היוצר מציין במפורש שצריך לכבות את ה־LoRA המקורי של LightX2V אם הוא פעיל אצלכם, כדי למנוע התנגשויות והרס של הפלט.

התוספת עצמה שוקלת מעט יחסית, אבל מודל הבסיס כבד ודורש כרטיס מסך חזק עם מספיק זיכרון וידאו לרינדור פריימים ברצף. אם אין לכם חומרה ייעודית מקומית, עדיף להרים שרת ענן עם GPU מתאים ברגע שרוצים לרנדר באצ'ים, במקום להיאבק במחשב פיתוח רגיל.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("rzgar/minimax-h3_fl2v_8Step_motion_enhancer")
img = pipe("a photo").images[0]

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו הלאה, כל עוד שומרים על תנאי הרישיון המקוריים ומצרפים את כתב הוויתור.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗