GPT
H

HunyuanVideo-I2V-gguf

קוד פתוח

city96other2025-03-06

  • gguf
  • image-to-video

גרסת קוונטיזציה של מודל התמונה לווידאו של טנסנט בפורמט GGUF. היא מיועדת למי שרוצה להנפיש תמונות מקומית בתוך סביבת ComfyUI בלי לחנוק את החומרה.

  • 124 GBמשקל הקבצים
  • 2,012הורדות בחודש
  • 37לייקים

מה זה

הפרויקט הזה מביא המרה ישירה לפורמט GGUF של המודל HunyuanVideo-I2V מבית טנסנט. המטרה המרכזית שלו היא לקחת תמונת סטילס ולהפיק ממנה סרטון וידאו. מכיוון שמדובר בקוונטיזציה ולא באימון מחדש, היכולות הוויזואליות נשענות לחלוטין על מודל המקור, אבל הקבצים מותאמים לעבודה יעילה יותר על זיכרון המערכת והכרטיס הגרפי.

היוצר city96 עדכן את המאגר בעקבות גרסה מעודכנת שטנסנט שחררו למודל המקורי, והמיר אותה מחדש. אם אתם זקוקים להשוואות מול הגרסה הישנה יותר, היא עדיין נשמרה בענף נפרד במאגר. סך כל הקבצים שוקל כ־124 ג'יגה בייט על פני 16 קבצים, מה שמציע מגוון דרגות קוונטיזציה לבחירה לפי מגבלות הזיכרון שלכם.

מתאים ל

  • הנפשת תמונות סטילס

    יצירת קטעי וידאו קצרים מתוך תמונה קיימת ישירות בתוך סביבת העבודה של ComfyUI.

  • הרצה מקומית בחומרה מוגבלת

    הפעלת מודל הווידאו של טנסנט תוך חיסכון בזיכרון גרפי תודות לפורמט ה־GGUF המכווץ.

  • בדיקות איכות והשוואת גרסאות

    השוואה בין הגרסה המקורית של טנסנט לגרסה המעודכנת שנשמרה בענף הייעודי במאגר.

איפה זה נופל

זהו אינו פתרון פלא עצמאי שעובד ישר מהקופסה. נדרשת הגדרה של רכיבים חיצוניים כמו VAE ייעודי ותוסף ComfyUI מותאם, כך שתקלות בהתקנה או אי התאמות בגרסאות הצמתים ישביתו את הרינדור. בנוסף, קוונטיזציות נמוכות עלולות להכניס עיוותים וארטיפקטים לתנועה בווידאו, ויש לקחת בחשבון שטנסנט עצמם החליפו את המודל המקורי עקב עדכונים, מה שמעיד על כך שהטכנולוגיה עדיין מתייצבת.

שאלות
נפוצות

האם המודל כולל את כל מה שצריך כדי להפיק וידאו?

לא. מדובר בקובצי המודל עצמם בלבד. כדי להפיק סרטון בפועל עליכם להתקין את ComfyUI עם תוסף ה־GGUF, ולהוריד בנפרד קובץ VAE מתאים לפי הקישור שמסופק בתיעוד.

באיזה קובץ כדאי לבחור מתוך ה־16 שקיימים במאגר?

הקבצים מייצגים רמות קוונטיזציה שונות שמאזנות בין איכות התמונה והתנועה לבין צריכת זיכרון הווידאו בכרטיס המסך. היוצר מפנה לטבלת ביצועים כללית של GGUF, כך שכדאי לבחור את הרמה הגבוהה ביותר שנכנסת בנוחות ב־VRAM שלכם בלי לגלוש לזיכרון המערכת.

איך מריצים

המודל תוכנן לעבודה ישירה מול הצמתים המובנים של HunyuanVideo בתוך ComfyUI, יחד עם התוסף ComfyUI-GGUF של היוצר. את הקבצים שהורדתם צריך לשים בתיקיית unet של המערכת. בנוסף, חובה להוריד בנפרד קובץ VAE חיצוני ממאגר נפרד כדי שהרינדור יעבוד.

מבחינת משאבים, מודלים של וידאו בסדר הגודל הזה דורשים כרטיס מסך חזק מאוד עם שפע של זיכרון VRAM, במיוחד כשמחברים את רכיב התמונה והווידאו יחד. אם אין לכם חומרה ייעודית כבדה מקומית, ההתעסקות עם הורדת עשרות ג'יגה בייט והרצה מקומית תהיה אטית ומסורבלת, ובמצב כזה עדיף לצרוך מודל כזה דרך ספק ענן או API חיצוני.

ollama run hf.co/city96/HunyuanVideo-I2V-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other ומכיוון שמדובר בהמרה בלבד ולא באימון עצמאי, תנאי השימוש והמגבלות של מודל המקור של טנסנט חלים עליו במלואם. אין כאן רישיון קוד פתוח סטנדרטי וחופשי. לפני שילוב שלו בפרויקט מסחרי, חובה לבדוק את תנאי השימוש הספציפיים שהגדירה טנסנט במאגר המקורי שלהם כדי לוודא שאין איסור על שימוש מסחרי או הפצה.

הרישיון המלא בעמוד המודל ↗