GPT
L

LTX-2.3

קוד פתוח

Lightricksother2026-03-04

  • diffusers
  • image-to-video
  • text-to-video
  • video-to-video
  • image-text-to-video

מודל פתוח מבית לייטריקס שמייצר וידאו ואודיו מסונכרנים יחד באותו תהליך. הוא מתאים למי שרוצה שליטה מקומית בהפקה בלי להדביק סאונד בנפרד.

  • 145 GBמשקל הקבצים
  • 1,181,828הורדות בחודש
  • 1,877לייקים

מה זה

מדובר במודל דיפוזיה שמבוסס על ארכיטקטורת DiT, ומייצר תנועה וסאונד במקביל במקום להסתמך על שני מודלים נפרדים. הגרסה הזו מגיעה כעדכון למודל הקודם עם שיפורים באיכות הקול, בתמונה ובהבנת הפרומפט. המאגר כולל משקלים מלאים לאימון בפורמט bf16, לצד גרסאות מזוקקות שרצות בשמונה צעדים בלבד כדי לקצר זמני רינדור.

החבילה מכילה גם רכיבי הגדלה למרחב ולזמן, שנועדו להעלות רזולוציה וקצב פריימים בשלבים נפרדים. השילוב הזה מאפשר לייצר קטעים קצרים עם סאונד תואם, בלי להסתבך בהרכבה ידנית של ערוצי שמע ווידאו במערכות חיצוניות.

מתאים ל

  • יצירת קליפים קצרים עם דיבור

    הוא מפיק תמונה וקול מסונכרנים בריצה אחת, ואיכות השמע שלו טובה בעיקר כשיש דיבור.

  • עבודה בתחנות ComfyUI מקומיות

    יש לו תמיכה מובנית בנודים רשמיים, מה שמאפשר לשלב אותו ישירות בתהליכי עבודה קיימים.

  • אימון LoRA מותאם אישית

    הקוד כולל תשתית אימון מהירה שמאפשרת ללמד סגנון, תנועה או מראה תוך פחות משעה.

איפה זה נופל

האיכות נופלת משמעותית בסאונד שאינו כולל דיבור, והמודל עדיין מתקשה לעקוב במדויק אחרי הנחיות טקסטואליות אם לא מתאימים לו סגנון כתיבה ספציפי. הוא מועד להטיות סטטיסטיות, עלול לפלוט תוכן פוגעני, וכמובן לא מתאים להצגת עובדות או מידע מהימן. בנוסף יש דרישות חלוקה קשיחות, הרוחב והגובה חייבים להתחלק ב־32 ומספר הפריימים חייב להתאים לנוסחה קבועה, אחרת צריך לחתוך ולרפד ידנית.

אותה משפחה

LTX-2.3 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו כבר עכשיו דרך diffusers?

התמיכה בספריית diffusers הוגדרה בקרוב ועוד לא שוחררה רשמית. כרגע מריצים אותו דרך הקוד שלהם בגיטהאב או דרך ComfyUI.

איך מייצרים וידאו ברזולוציה גבוהה בלי לחנוק את הזיכרון?

עובדים בשלבים. מייצרים קודם בסיס עם המודל המזוקק, ואז משתמשים ברכיבי ה־upscaler המצורפים להגדלת המרחב וקצב הפריימים.

איך מריצים

כדי להריץ אותו מקומית צריך להוריד נפח כולל של 145 ג'יגה בייט, מה שמחייב חומרה כבדה מאוד עם תמיכה בגרסאות CUDA מעל 12.7 ופייתון מודרני. אפשר לעבוד איתו ישירות דרך נודים בתוך ComfyUI, או להשתמש בספריית הקוד שלהם בגיטהאב שמחולקת לרכיבי אינפרנס ואימון.

מי שאין לו שרת ייעודי עם מעבדים גרפיים חזקים יעדיף לגשת ישירות דרך ה־API שלהם או ה־Playground. אם אתם כן מריצים לבד, הגרסאות המזוקקות או שימוש ב־LoRA יחסכו זמן יקר בהשוואה למודל המלא.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lightricks/LTX-2.3")
img = pipe("a photo").images[0]

הרישיון

הרישיון מוגדר כמותאם אישית ומפנה להסכם נפרד במאגר הגיטהאב של הפרויקט. הוא לא רישיון קוד פתוח סטנדרטי מסוג MIT או אפאצ'י, ולכן אסור לשלב אותו במוצר מסחרי לפני שקוראים את תנאי השימוש המדויקים שהם הגדירו עבור משקלי המודל והתוצרים שלו.

הרישיון המלא בעמוד המודל ↗