GPT
W

Wan2.1-I2V-14B-720P-gguf

קוד פתוח

city96apache-2.02025-02-28

  • gguf
  • video
  • video-generation
  • image-to-video
  • en

המרת GGUF למודל תמונה לווידאו של 14 מיליארד פרמטרים ב־720p. היא חותכת את דרישות הזיכרון כדי שתוכלו להריץ יצירת וידאו מקומית דרך ComfyUI בלי שרת מנופח.

  • 194 GBמשקל הקבצים
  • 18,546הורדות בחודש
  • 162לייקים

מה זה

מדובר בהמרה ישירה שביצע city96 לקבצי GGUF מתוך מודל המקור של Wan-AI, שמיועד ליצירת וידאו מתמונה ברזולוציית 720p. כל הקוונטיזציות כאן הופקו ישירות מקובץ הבסיס ב־FP32, מה שאמור לשמור על דיוק מרבי ביחס למקור, אם כי ברשת שותף רק ה־FP16 בגלל מגבלות גודל קובץ.

היתרון המרכזי הוא היכולת להריץ מודל וידאו כבד של 14B על חומרה מקומית נגישה יותר. הפורמט הזה עובד ישירות מול התוסף ComfyUI-GGUF, כך שמי שכבר מחזיק פייפליין מבוסס ComfyUI יכול לשלב אותו בתוך תהליך העבודה הקיים בלי להמציא את הגלגל מחדש.

מתאים ל

  • הנפשת תמונות מקומית

    יצירת קטעי וידאו מתמונות סטילס ב־720p ישירות על המחשב, בלי לשלם על כל רינדור לענן.

  • פייפליין מבוסס ComfyUI

    חיבור ישיר למערך עבודה קיים בתוכנה באמצעות קבצי GGUF שחוסכים בצריכת הזיכרון.

  • בדיקות קוונטיזציה לווידאו

    בחינת איכות התנועה ברמות דחיסה שונות שהופקו מקובץ מקור של FP32.

איפה זה נופל

הקובץ לבדו לא מספיק לעבודה, ותצטרכו להביא קבצים משלימים מחבילה נפרדת של Comfy-Org כדי שהעסק בכלל יידלק. בנוסף, פיצול קבצים דרך gguf-split עדיין לא נתמך בתוסף של ComfyUI, ולכן קבצי ענק מוגבלים מראש. המודל עצמו תומך רק באנגלית ובסינית, כך שפרומפטים בעברית לא יעבדו כאן כמו שצריך.

שאלות
נפוצות

האם אפשר להריץ את המודל ישירות רק מהורדת הקובץ הזה?

לא. כרטיס המודל מבהיר שחובה להוריד קבצים תומכים נוספים מהמאגר של Comfy-Org כדי להשלים את ההרצה.

האם המודל מבין הנחיות בעברית?

השפות הנתמכות שצוינו הן אנגלית וסינית בלבד. הנחיות בעברית לא יעבדו טוב ועדיף לתרגם אותן קודם.

איך מריצים

בשביל להריץ אותו צריך להתקין את הצומת של ComfyUI-GGUF, לזרוק את הקבצים לתיקיית unet, ולהוריד קבצי מעטפת נוספים מהמאגר הייעודי של Comfy-Org. מודל של 14B דורש כרטיס מסך חזק עם זיכרון וידאו מכובד, גם אחרי כיווץ, במיוחד כשמרנדרים וידאו ב־720p.

יש כאן מגוון רחב של קוונטיזציות לבחירה בהתאם למגבלות ה־VRAM שלכם. אם אין לכם כרטיס עם מספיק זיכרון להחזיק את המודל יחד עם שאר הקבצים הנלווים, עדיף להשתמש ב־API חיצוני ולא לחנוק את המחשב המקומי.

ollama run hf.co/city96/Wan2.1-I2V-14B-720P-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו הלאה, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי. מתאים למי שבונה מוצר ורוצה ראש שקט מבחינה משפטית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗