GPT
L

ltxv-gguf

קוד פתוח

calcuisother2024-12-14

  • gguf
  • gguf-node
  • gguf-connector
  • image-to-video
  • en

גרסאות מכווצות בפורמט GGUF למודל הווידאו LTX, שמאפשרות לייצר סרטונים מתמונות ומטקסט גם על כרטיסי מסך ביתיים בלי לחנוק את הזיכרון.

  • 500 GBמשקל הקבצים
  • 12,899הורדות בחודש
  • 96לייקים

מה זה

המאגר הזה מכיל המרות של LTX-Video בפורמט GGUF ובדיוקים שונים, החל מכימותים כבדים כמו q2_k ועד גרסאות fp8 מלאות יותר. המודל עצמו מייצר קטעי וידאו קצרים על בסיס הנחיות טקסט או שילוב של תמונה וטקסט, תוך שימוש במודל בסיס של 2 מיליארד פרמטרים ומקודד טקסט מסוג T5xxl.

במקום להסתפק בקבצי המשקלים המקוריים שדורשים חומרה מקצועית יקרה, הכימותים כאן מפרקים את החלקים השונים, כולל ה־VAE ומקודד הטקסט, לרכיבים נפרדים שניתן לשלב ביניהם לפי מגבלות הזיכרון. קיימות כאן גרסאות מזוקקות כמו 0.9.8, שמצמצמות את מספר הצעדים הנדרש ליצירה מ־30 ל־15 צעדים, מה שמקצר משמעותית את זמן הרינדור בפועל.

מתאים ל

  • הנפשת תמונות מקומית

    מאפשר לייצר תנועה מתמונות סטילס על מחשב ביתי בלי להעלות חומרים רגישים לענן.

  • בדיקת תהליכי עבודה ב־ComfyUI

    משתלב בקלות ב־workflows קיימים וצורך מעט זיכרון וידאו בזכות פורמט GGUF.

  • רינדור מהיר בגרסה מזוקקת

    הגרסאות המזוקקות חותכות את מספר הצעדים בחצי ומקצרות את זמני ההמתנה לטיוטות.

איפה זה נופל

היוצר מציין במפורש שגרסת הכימות q2_k אמנם מהירה מאוד אבל לא שמישה מבחינת איכות התוצאה, ומתאימה לבדיקות טכניות בלבד ולא לייצור אמיתי. בנוסף, המערכת מורכבת מכמה רכיבים נפרדים שחייבים להתאים ביניהם ידנית, כולל מקודד T5xxl כבד ו־VAE ספציפי, וחיבור לא נכון ביניהם מייצר עיוותים קשים בווידאו.

שאלות
נפוצות

איזו גרסת כימות כדאי להוריד לעבודה יומיומית?

עדיף להתרחק מ־q2_k כי האיכות שלה נמוכה מדי לפי דברי היוצר. גרסאות q4_0 או שילוב של קובצי fp8 מספקים איזון טוב בין משקל נמוך בזיכרון לתוצאה ויזואלית שנראית טוב.

חייבים להוריד את כל 500 הגיגה שבמאגר כדי שזה יעבוד?

ממש לא. המאגר מכיל עשרות גרסאות שונות של אותם רכיבים, ואתם צריכים לבחור רק קובץ מודל אחד, מקודד טקסט T5 אחד וקובץ VAE בודד שתואמים לגודל הזיכרון שלכם.

איך מריצים

אפשר להריץ את הקבצים ישירות בתוך ComfyUI באמצעות תוסף gguf-node, כאשר מפזרים את המודל, ה־VAE ומקודד הטקסט לתיקיות הייעודיות שלהם וטוענים קובץ תהליך עבודה. דרך נוספת ומהירה היא שימוש בכלי הפקודה gguf-connector שמוריד את הקבצים ומעלה ממשק דפדפן מקומי בכתובת 127.0.0.1:7860 בפקודות כמו ggc vg לטקסט או ggc v1 לתמונה.

מבחינת משאבים, גרסת q4_0 שוקלת רק 1.09 גיגה-בייט למודל עצמו, 2.9 גיגה-בייט למקודד הטקסט וכ־838 מגה-בייט ל־VAE, כך שהיא נכנסת בקלות לכרטיסי מסך של 6 עד 8 גיגה זיכרון. אם אתם צריכים לרנדר עשרות סרטונים במקביל או שאין לכם כרטיס ייעודי סביר, עדיף להשתמש בשירות ענן חיצוני כי יצירת פריימים מקומית תחנוק את המחשב.

ollama run hf.co/calcuis/ltxv-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

170 קבצים במאגר, 500 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון של המאגר מוגדר כ־other, כלומר תנאי השימוש המדויקים לא מוגדרים תחת רישיון קוד פתוח סטנדרטי. במצב כזה אי אפשר לדעת בוודאות אם מותר לשלב את הקבצים האלה במוצר מסחרי, וצריך לבדוק את תנאי המקור של מודל LTX לפני הפצה.

הרישיון המלא בעמוד המודל ↗