GPT
L

LTX-Video-0.9.7-distilled

קוד פתוח

Lightricksother2025-05-14

  • diffusers
  • safetensors
  • ltx-video
  • image-to-video
  • text-to-video

גרסה מזוקקת של מודל וידאו ישראלי שמייצרת קטעים בקצב גבוה במיוחד. היא דורשת פחות זיכרון כדי לאפשר איטרציות מהירות בלי להמתין דקות לכל שוט.

  • 13Bפרמטרים
  • 44.6 GBמשקל הקבצים
  • 1,514הורדות בחודש
  • 62לייקים

מה זה

מדובר במודל מבוסס DiT שמפיק וידאו מטקסט או מתמונה יחד עם טקסט, בקצב של 30 פריימים בשנייה וברזולוציה של עד 1216 על 704. הגרסה הזו עברה זיקוק, מה שאומר שהיא חותכת זמני ריצה ודרישות חומרה לעומת גרסת הפיתוח המלאה של 13 מיליארד הפרמטרים, במחיר של ירידה קלה באיכות הוויזואלית.

בגודל הזה של 13 מיליארד פרמטרים, המודל מתמקד ביכולת להגיע למהירות יצירה גבוהה יותר מזמן הצפייה בווידאו עצמו. המטרה כאן היא לא להתחרות ברינדורים כבדים שלוקחים שעות, אלא לתת ליוצרים ולצוותי פיתוח כלי שמגיב מהר, מאפשר לבדוק פרומפטים בלולאה קצרה, ועדיין שומר על מבנה תנועה קוהרנטי ומגוון של סצנות מורכבות.

מתאים ל

  • איטרציה מהירה על שוטים

    זמני ריצה מהירים בזכות הזיקוק, מעולה לבדיקת תנועות מצלמה ורעיונות לפני רינדור סופי.

  • הנפשת תמונות סטילס

    תמיכה מובנית בתמונה וטקסט ביחד, שמתאימה להפיכת עיצוב קיים לווידאו בתנועה חלקה.

  • הטמעה בפייפליין של קומפי

    יש תמיכה מלאה בוורקפלוז מוכנים שמאפשרים שילוב קל עם שלבי עיבוד והגדלה קיימים.

איפה זה נופל

המודל מוגבל לרזולוציות של מתחת ל־720 על 1280 ועד 257 פריימים בלבד, כך שאי אפשר לייצר איתו סרטונים ארוכים בלי חיבורים חיצוניים. בנוסף, הוא עובד אך ורק עם פרומפטים באנגלית מפורטת מאוד, ולא יבין עברית. קיימת גם דרישה טכנית קשיחה שהרזולוציה תתחלק ב־32 וכמות הפריימים תתאים לנוסחה מדויקת של כפולות שמונה ועוד אחד, אחרת המערכת מבצעת חיתוך וריפוד שעלולים לפגוע בפריים.

שאלות
נפוצות

האם אפשר להריץ את המודל על כרטיס מסך ביתי רגיל?

הקבצים שוקלים 44.6 גיגה בייט ומודל של 13 מיליארד פרמטרים דורש נפח זיכרון וידאו גבוה מאוד שלא קיים בכרטיסים פשוטים. כדי להריץ מקומית צריך כרטיס מקצועי או לחכות לגרסאות מכווצות של שמונה ביט שיקטינו את העומס. לשימוש ביתי מזדמן עדיף לגשת אליו דרך שירותי ענן מוכנים.

מה ההבדל בינו לבין גרסת הפיתוח הרגילה של 13B?

הגרסה הזו עברה תהליך זיקוק שמקצר את זמן הריצה וצורך פחות משאבים פר יצירה. הירידה באיכות התמונה מתונה מאוד ביחס לחיסכון המשמעותי בזמן ההמתנה לכל פלט, מה שהופך אותה למעשית יותר לייצור שוטף.

איך מריצים

המשקלים שוקלים 44.6 גיגה בייט, ולכן הרצה מקומית של הגרסה הזו דורשת כרטיס מסך חזק עם נפח זיכרון מכובד, סביב 48 גיגה בייט בזיכרון וידאו אם רוצים לעבוד חלק, או שימוש בגרסאות מכווצות כמו שמונה ביט. אפשר להריץ אותה ישירות דרך פייתון עם ספריית diffusers, בקוד עצמאי, או לשלב אותה בנוחות בתוך ComfyUI.

אם אין לכם שרת ייעודי עם חומרה ברמה הזו, אל תנסו להריץ אותו על מחשב נייד או כרטיס ביתי פשוט. במצב כזה, עדיף להשתמש בנקודות קצה של שירותים כמו Fal.ai או Replicate שבהם משלמים לפי שימוש וחוסכים את כל ההתעסקות עם התקנות CUDA 12.2 ותחזוקת שרתים.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lightricks/LTX-Video-0.9.7-distilled")
img = pipe("a photo").images[0]

הקבצים

42 קבצים במאגר, 44.6 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון מוגדר בתור other ומופץ תחת מסמך תנאים ייעודי של לייטריקס לגרסאות משקלים פתוחים. הוא אינו רישיון קוד פתוח סטנדרטי מסוג MIT או Apache, ולכן חובה לקרוא את קובץ הרישיון המצורף במאגר לפני שמשלבים את המודל בתוך מוצר מסחרי.

הרישיון המלא בעמוד המודל ↗