GPT
B

Bernini-R-LightX2V-4step-loras

קוד פתוח

rzgarapache-2.02026-07-02

  • diffusers
  • lora
  • text-to-video
  • image-to-video
  • video-to-video

תוספי LoRA שנועדו להאיץ יצירת וידאו לארבעה צעדים בלבד על בסיס Bernini-R. הם פותרים בעיות של תנועה מקוטעת ואצבעות מטושטשות בלי לשחק עם משקלים חריגים.

  • 2.3 GBמשקל הקבצים
  • 8,173הורדות בחודש
  • 53לייקים

מה זה

מדובר בצמד קובצי LoRA שנועדו לעבוד בתוך תהליך עבודה של ComfyUI עבור Bernini-R ומודלי Wan. במקום להשתמש בפתרון הישן שלקח מודל זיקוק בודד והכריח אותו לעבוד בעוצמות גבוהות מדי של 3.0 ו־1.5, כאן פיצלו את העבודה לשני שלבים נפרדים, אחד לרעש גבוה ואחד לרעש נמוך.

השוני מורגש ישירות באיכות התוצאה. הפיצול הזה מאפשר לייצר וידאו נקי בארבעה צעדים, עם ידיים חדות ותנועה חלקה, בדיוק כמו במערך של Wan 2.2, כששני הקבצים רצים בעוצמה רגילה של 1.0. זה חוסך זמן חישוב יקר בלי להקריב את הפרטים של התמונה.

מתאים ל

  • רינדור וידאו מהיר ב־ComfyUI

    קיצור זמן ההפקה לארבעה צעדים בלבד בעזרת הדוגם המומלץ.

  • אנימציית ידיים ותנועה חדה

    מניעת מריחות באצבעות וגמגומים בזמן תנועות מהירות בווידאו.

  • שילוב בפייפליין של diffusers

    הטענת משקלי LoRA קלים של 2.3 גיגה בייט לפרויקטים מקומיים.

איפה זה נופל

הקבצים האלה תלויים לחלוטין בתהליך העבודה הספציפי של Bernini-R ומודל הבסיס שלו, כך שאי אפשר להשתמש בהם כמודל עצמאי. מעבר לזה, הכרטיס מציין במפורש שהם מיועדים למנוע גמגום בתנועה מהירה ומריחות באצבעות, מה שאומר שאם מנסים לחרוג מההגדרות של ארבעה צעדים או לשנות דוגם, התוצאות עלולות להישבר מהר מאוד.

שאלות
נפוצות

איזה חוזק צריך להגדיר לכל קובץ?

בניגוד להגדרות ישנות שדרשו להעלות חוזק ל־3.0 או 1.5, כאן מגדירים 1.0 בדיוק לשני הקבצים. קובץ ה־high noise מיועד לשלב הרעש הגבוה וה־low noise לשלב הנמוך.

האם המודל מייצר וידאו לבד מקלט טקסט?

לא. מדובר בתוספי LoRA של 2.3 גיגה בייט למשימת תמונה לתמונה שנועדו להאצת מודל קיים, הם לא עובדים באופן עצמאי בלי מודל הבסיס Bernini-R.

באילו הגדרות דגימה חובה להשתמש?

היוצר מציין במפורש ארבעה צעדים, דוגם dpmpp_2m_sde, ומתזמן מסוג sgm_uniform. שימוש בערכים אחרים לא מתוכנן לעבוד עם המשקלים האלה.

איך מריצים

המשקל הכולל של הקבצים עומד על 2.3 גיגה בייט, כך שהם לא מעמיסים משמעותית על הזיכרון מעבר למודל הבסיס שאתם מריצים. מורידים את הקבצים Bernini-R_LightX2V_high_noise ו־low_noise וטוענים אותם לתוך ComfyUI או דרך diffusers בשלבים המתאימים של הרעש.

ההגדרה דורשת דוגם dpmpp_2m_sde עם מתזמן sgm_uniform וארבעה צעדים בדיוק, עם חוזק מכוון ל־1.0 בשני החלקים. אם אין לכם מאיץ גרפי חזק שמסוגל להחזיק את מודל הווידאו הבסיסי בזיכרון, שום LoRA קל לא יעזור ועדיף לפנות לשרת מרוחק.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("rzgar/Bernini-R-LightX2V-4step-loras")
img = pipe("a photo").images[0]

הרישיון

רישיון apache-2.0 מאפשר שימוש מסחרי חופשי, שינוי של הקוד והפצה מחדש. מותר לשלב את המשקלים האלה בתוך שירותים או מוצרים שאתם מוכרים, כל עוד שומרים על תנאי הייחוס והודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗