GPT
L

LTX-2

קוד פתוח

Lightricksother2026-01-03

  • diffusers
  • safetensors
  • image-to-video
  • text-to-video
  • video-to-video

המודל מייצר וידאו ואודיו מסונכרנים יחד מאותה ארכיטקטורה. הוא שוקל 19 מיליארד פרמטרים, פותח בישראל ומגיע עם משקולות פתוחות להרצה מקומית.

  • 19Bפרמטרים
  • 293 GBמשקל הקבצים
  • 364,579הורדות בחודש
  • 1,780לייקים

מה זה

מדובר במודל מבוסס DiT של חברת לייטריקס, שמחבר יצירת וידאו וסאונד תחת קורת גג אחת במקום להדביק אודיו בנפרד. הוא מיועד למשימות תמונה לווידאו וטקסט לווידאו, וכולל תמיכה מובנית בשמונה שפות לצד אנגלית. המאגר מכיל 293 גיגה בייט של קבצים, כולל גרסאות בסיס, גרסאות מזוקקות ורכיבי שיפור רזולוציה.

הייחוד כאן הוא השילוב האודיו ויזואלי הישיר. במקום להריץ מודל תמונה ואז לחפש מודל אפקטים שיתאים לקצב, הוא פולט את שניהם יחד. לצד גרסת הפיתוח המלאה, יש גם גרסה מזוקקת שרצה בשמונה צעדים בלבד כדי לקצר זמני חישוב.

מתאים ל

  • הנפשת תמונות סטילס

    יצירת קטעי וידאו קצרים מתמונות קיימות, כשהתנועה והסאונד נוצרים יחד ישירות מהקלט הוויזואלי.

  • הפקת סרטונים מהירה

    שימוש בגרסה המזוקקת בשמונה צעדים לבדיקת רעיונות תנועה וסאונד בלי להמתין דקות ארוכות לכל רינדור.

  • אימון מודלים מותאמים

    התאמת המודל המלא לסגנון מסוים או לדמות בעזרת LoRA שלוקח פחות משעה בחומרה המתאימה.

איפה זה נופל

היוצרים מודים בפירוש שהיצירה של אודיו שאינו דיבור סובלת מאיכות נמוכה יותר, כך שרעשי רקע ואפקטים קוליים עלולים להישמע צורמים. בנוסף, המודל רגיש מאוד לצורת הניסוח של הבקשות ולעיתים קרובות מפספס הוראות ולא מייצר בדיוק מה שביקשתם. הוא לא מיועד לספק מידע עובדתי, ועלול להגביר הטיות או לפלוט תוכן לא הולם. חובה גם להקפיד על ממדים שמתחלקים ב־32 ומספר פריימים ספציפי, אחרת צריך לחתוך ולרפד ידנית את הקלט.

שאלות
נפוצות

האם המודל מייצר גם דיבור באודיו?

הוא מייצר אודיו מסונכרן יחד עם הווידאו, אך איכות הצלילים שאינם דיבור נמוכה יותר לפי התיעוד. אם המטרה היא דיבוב מדויק או שירה, מומלץ לבדוק את התוצאות מראש ולא להסתמך עליו ככלי קריינות בלעדי.

איזו גרסה כדאי להוריד למחשב ביתי חזק?

הגרסה המלאה ב־bf16 כבדה מדי לרוב המחשבים השולחניים. למשתמש ביתי עם כרטיס תומך עדיף להוריד את גרסת ה־fp8 או ה־nvfp4, ולהשתמש במודל המזוקק שמפיק תוצאות בשמונה צעדים בלבד.

איך מריצים

משקל כולל של כמעט שלוש מאות גיגה אומר שאתם חייבים כונן מהיר ומרווח רק בשביל הקבצים. כדי להריץ את גרסת הדיב המלאה בפורמט bf16 צריך תחנת עבודה רצינית עם מעבדים גרפיים חזקים מאוד, במיוחד בגלל 19 מיליארד הפרמטרים. למי שמוגבל בזיכרון, שחררו גרסאות מכווצות בפורמטים של fp8 ושל nvfp4, או גרסת LoRA מזוקקת.

בפועל אפשר להרים אותו דרך Diffusers, קוד פייתון ייעודי, או כתוספת נוחה בתוך ComfyUI. אם אין לכם שרת מקומי עם מאיצים תומכי קוודה 12.7 ומעלה, ההרצה המקומית תהיה איטית מדי, ועדיף פשוט להתחבר לפלייגראונד שלהם ברשת.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lightricks/LTX-2")
img = pipe("a photo").images[0]

הקבצים

69 קבצים במאגר, 293 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון מוגדר כמותאם אישית ולא כרישיון קוד פתוח סטנדרטי. הקבצים מפנים להסכם ספציפי של לייטריקס שצריך לבדוק לפני שמשלבים את המודל במוצר מסחרי, בעיקר כדי לוודא שאין מגבלות על הפצה או שימוש מסחרי רחב.

הרישיון המלא בעמוד המודל ↗