GPT
L

LTX2.3-10Eros

קוד פתוח

TenStripרישיון לא דווח2026-04-29

  • diffusers
  • image-to-video
  • not-for-all-audiences

הכוונון הזה הופך תמונות לווידאו עם דגש על תנועות מפורשות, תוך שילוב משקלים שמיועדים לשחרר מגבלות אנטומיה. מי שבוחר בו מחפש שליטה ישירה בתנועה בלי הסינון של מודלי בסיס רגילים.

  • 395 GBמשקל הקבצים
  • 56,043הורדות בחודש
  • 567לייקים

מה זה

מדובר במודל שמייצר וידאו מתוך תמונה על בסיס סדרת LTX, שעבר מיזוג שכבות מורכב עם Sulphur ומשקולות ייעודיות לשיפור חופש התנועה. המטרה המרכזית שלו היא לאפשר סצנות ותנועות גוף מפורשות בלי שהמערכת תתנגד או תחסום את ההנחיה.

בניגוד למיזוג משקלים רגיל, נעשה פה כיול של שערי תשומת הלב בין הגרסאות השונות כדי לייצב את התוצאה מגרסה 1.4 ולפתוח את הפירוט האנטומי של גרסה 1.2. הוא פועל הכי טוב בשילוב עם מתאמי LoRA היברידיים מסוג DMD, ומחייב פרומפטים מפורטים ומדויקים מאוד שמגדירים כל שלב בתנועה, כי המודל עצמו לא משלים פערי הבנה לבד.

מתאים ל

  • הנפשת תמונות לסצנות חופשיות

    הוא נועד להפיק תנועות גוף מפורשות מתמונה ללא חסימות, בשילוב מתאמי LoRA ייעודיים.

  • עבודה בתהליכי ComfyUI מקומיים

    המודל נבנה להתממשק ישירות עם צמתים מותאמים ורכיבי החלפת משקלים בסביבות עבודה מודולריות.

  • ניסויי אימון על בסיס פתוח

    המבנה שלו בגרסה זו הוכן במיוחד כבסיס שעליו ניתן לאמן טלאי אנטומיה ותיקוני עיוותים נוספים.

איפה זה נופל

המודל סובל מבעיות מבניות מוכרות, כולל עיוותי אנטומיה, הופעת איברים מיותרים, כתוביות לא רצויות ומעברי סצנה פתאומיים. הוא לא מתקן שגיאות לבד, ומחייב הנחיות טקסט קפדניות ומלוטשות ביותר עבור כל תנועה, שינוי קומפוזיציה וסאונד. שימוש במתאמי LoRA מזוקקים גדולים מדי עלול לפגוע באיכות הכוונון שלו.

שאלות
נפוצות

האם אפשר להריץ אותו עם פרומפט קצר וכללי?

לא, המודל חסר יכולת הסקה עצמאית כשהוא מקבל התניה. חייבים לתאר במדויק את הנושא, כל תנועת איבר, זוויות המצלמה והסאונד שלב אחר שלב, רצוי באמצעות מודל שפה חיצוני שמכין את הטקסט.

איזה מתאמי LoRA כדאי לחבר אליו?

הוא מגיב הכי טוב למתאמי LoRA היברידיים מסוג DMD שמותאמים לגרסאות 2.3. מתאמים מזוקקים גדולים מדי עלולים לפגוע במשקלים המכווננים שלו, ולכן עדיף להשתמש בגרסאות קלות או מותאמות לתנאים.

איך מריצים

כדי להריץ אותו מקומית צריך שטח אחסון עצום, שכן קובצי המאגר המלא שוקלים 395 גיגה בייט ומחולקים ל־14 חלקים. המודל נטען כצ'קפוינט מלא מסוג BF16 שכולל רכיבי CLIP ו־VAE, אך קיימות גרסאות מכווצות בפורמט FP8 ו־INT8 שמתאימות לכרטיסי מסך חזקים של משתמשי קצה.

רוב המשתמשים מריצים אותו דרך סביבת ComfyUI באמצעות צמתים ייעודיים ורכיבי LoRA מתאימים. שרת מקומי עם כרטיס מקצועי יקר יידרש למשקלים המלאים, ולכן למי שאין תשתית כבדה עדיף לפנות לגרסאות ה־FP8 או להסתמך על סביבות ענן שמאפשרות שכירת חומרה לפי שעה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("TenStrip/LTX2.3-10Eros")
img = pipe("a photo").images[0]

הרישיון

היוצר לא דיווח על רישיון שימוש במאגר. במצב כזה אין הרשאה מפורשת להשתמש במודל לצרכים מסחריים או להפיץ אותו בתוך מוצר, והשימוש בו כרוך בסיכון משפטי ברור עד להבהרת תנאי הרישוי על ידי המפתח.

הרישיון המלא בעמוד המודל ↗