GPT
W

bullerwins/Wan2.2-I2V-A14B-GGUF

קוד פתוח

bullerwinsapache-2.02025-07-28

  • gguf
  • image-to-video
  • en
  • zh

גרסת קוונטיזציה של מודל תמונה לווידאו המחלקת את העבודה בין שני מומחים. מי שמוריד אותה מחפש להריץ וידאו מקומי באיכות גבוהה בלי להחזיק שרת של 80 גיגה זיכרון גרפי.

  • 174 GBמשקל הקבצים
  • 46,250הורדות בחודש
  • 305לייקים

מה זה

הפרויקט הזה מביא את Wan2.2 לפורמט GGUF עבור ComfyUI, במטרה לייצר סרטונים מתמונת מקור ברזולוציות של 480P ו־720P. המבנה מבוסס על תצורת MoE עם 27 מיליארד פרמטרים בסך הכול, אך בכל שלב עובדים רק 14 מיליארד פרמטרים. הרעיון מחלק את תהליך הדיפוזיה לשניים, כאשר מודל ראשון מייצר את הקומפוזיציה והתנועה הגולמית ברמות רעש גבוהות, ומודל שני נכנס לפעולה ברעש נמוך כדי לחדד את הפרטים והמרקמים.

בגרסה הזו הוכנסו נתוני אימון רחבים יותר לעומת Wan2.1, עם עליה של 65.6% בכמות התמונות ו־83.2% בווידאו, לצד תיוג פרטני של תאורה, צבע ותנועות מצלמה. לפי הבדיקות של המפתחים במדד Wan-Bench 2.0 מול שירותים מסחריים סגורים, החלוקה לשני מומחים משיגה התכנסות טובה יותר והפסד אימות נמוך משמעותית, מה שמקטין עיוותים לא רציונליים בתנועה של המצלמה.

מתאים ל

  • הנפשת תמונות מקומית

    הפיכת תמונות סטילס לווידאו קצר ב־720P על חומרה מקומית, בלי לחשוף חומרי מקור לשירותי ענן חיצוניים.

  • עבודה מבוססת ComfyUI

    שילוב בתוך תהליכי עבודה קיימים שדורשים שליטה ידנית בהפרדה בין שלב הקומפוזיציה לשלב חידוד הפרטים.

  • יצירת שוטים סינמטיים

    הפקת קטעי וידאו עם תנועות מצלמה יציבות ושליטה מוגדרת בתאורה וצבע, בזכות תיוג הנתונים המורחב של גרסה 2.2.

איפה זה נופל

הפיצול לשני מודלים מכריח ניהול כפול של קבצים בזיכרון, מה שמסבך את ה־pipeline ב־ComfyUI ועלול להאט את היצירה במעבר בין המומחים. בנוסף, המודל אומן ותומך רק בשפות אנגלית וסינית, כך שפרומפטים בעברית ידרשו תרגום מקדים כדי לקבל תוצאה סבירה. הפקת וידאו ב־720P כבדה מאוד חישובית, ובלי כרטיס חזק זמני הרינדור יהיו ארוכים מדי לשימוש שדורש מהירות.

שאלות
נפוצות

למה צריך להוריד שני קבצים שונים כדי לייצר סרטון אחד?

הארכיטקטורה מבוססת על שני מומחים נפרדים עבור שלבי הרעש השונים. המודל הראשון בונה את התנועה והמבנה הכללי, והשני נכנס לפעולה באמצע התהליך כדי להוסיף חדות ופרטים עדינים, ולכן ComfyUI זקוק לשניהם.

האם אפשר להשתמש בפרומפטים בעברית להנפשת התמונה?

המודל תומך רשמית רק באנגלית ובסינית. אם תזינו הנחיות בעברית, הוא יתעלם מהן או ייצר תוצאות לא צפויות, לכן מומלץ לתרגם כל פרומפט לאנגלית לפני השליחה לרינדור.

איך אפשר להתחיל לעבוד עם זה בלי להגדיר הכל מאפס?

המאגר כולל קובץ workflow מוכן ל־ComfyUI. אחרי התקנת התוסף ComfyUI-GGUF והורדת שני קובצי המודל לתיקייה הנכונה, פשוט גוררים את קובץ הדוגמה ישירות לתוך הממשק.

איך מריצים

הריצה המקומית בפורמט הזה דורשת את התוסף ComfyUI-GGUF, והיא אינה עובדת מקובץ בודד. חייבים להוריד שני מודלים נפרדים, אחד עבור שלב הרעש הגבוה ואחד לשלב הרעש הנמוך, ולהניח אותם בתיקיית ה־unet של ComfyUI.

בעוד שהמודל המקורי דורש כרטיס עם 80GB VRAM לפחות או קלאסטר מרובה כרטיסים להרצה רגילה, גרסאות ה־GGUF מאפשרות לרדת לחומרה צרכנית יותר. למרות זאת, משקל המאגר מגיע ל־174 גיגה על פני 23 קבצים, כך שעדיין צריך מעבד גרפי חזק, שטח אחסון מהיר ונפח זיכרון משמעותי. אם המטרה היא להפיק סרטונים בודדים פעם בשבוע, כנראה שעדיף לשלם לפי קריאה ל־API חיצוני מאשר להחזיק חומרה כזו דולקת.

ollama run hf.co/bullerwins/Wan2.2-I2V-A14B-GGUF:wan2.2_i2v_high_noise_14B_Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הקוד והמשקלים שוחררו תחת רישיון apache-2.0. מותר להשתמש בהם למטרות מסחריות, לשנות, להפיץ ולהטמיע במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי. היוצרים מצהירים שאין להם זכויות על התוכן שתייצרו, אך האחריות המשפטית על השימוש היא עליכם בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗