GPT
W

Wan2.1-T2V-14B-gguf

קוד פתוח

city96apache-2.02025-02-26

  • gguf
  • text-to-video

גרסת GGUF מכווצת למודל יצירת וידאו מטקסט עם 14 מיליארד פרמטרים. היא חוסכת זיכרון ומאפשרת להריץ מודל וידאו כבד יחסית מקומית דרך ComfyUI במקום להסתמך על ענן.

  • 171 GBמשקל הקבצים
  • 34,622הורדות בחודש
  • 193לייקים

מה זה

מדובר בהמרה ישירה לקובצי GGUF של המודל Wan2.1-T2V-14B, שמייצר וידאו ישירות מתיאור טקסטואלי. מי שהמיר אותו לקח את קובץ המקור בפורמט FP32 ויצר ממנו סדרה של קוונטיזציות שונות, במטרה לאפשר דחיסה של מודל כבד לכרטיסי מסך ביתיים או שרתים קטנים יותר.

היתרון המרכזי כאן הוא פורמט GGUF, שמוכר בעיקר מעולמות ה־LLM ומגיע לכאן כדי לחתוך את צריכת ה־VRAM ביצירת וידאו. אין כאן מודל חדש מאפס אלא התאמה טכנית שמיועדת לעבודה ישירה בתוך סביבת ComfyUI, למי שרוצה לשלוט בתהליך היצירה מקומית ולא לשלם לספקי API חיצוניים לפי שניית רינדור.

מתאים ל

  • יצירת וידאו מקומית

    מאפשר לייצר סרטונים מטקסט ישירות בתוך ComfyUI בלי תלות בחיבור לרשת או בספקים חיצוניים.

  • עבודה על כרטיסי מסך מוגבלים

    גרסאות ה־GGUF המכווצות מאפשרות לדחוס מודל וידאו של 14B לחומרה שלא מסוגלת להחזיק משקלי FP16 מלאים.

  • פייפליינים מבוססי ComfyUI

    משתלב ישירות כצומת בתהליכי עבודה קיימים שמשלבים כבר מודלים שונים ליצירת תמונה ותנועה.

איפה זה נופל

הקובץ לא עובד כיחידה עצמאית. חייבים להוריד VAE ממקור חיצוני אחר כדי לקבל תמונה, וצריך תוסף ייעודי בתוך ComfyUI כדי שבכלל יזהה את הפורמט. בנוסף, קובצי FP32 המקוריים נחתכו כי הם עברו את רף 50 הגיגה-בייט, ופיצול קבצים עדיין לא נתמך בתוסף. כרטיס המודל לא כולל נתוני ביצועים, זמני דגימה או מדדי איכות, כך שאין דרך לדעת מראש כמה זמן ייקח כל פריים או מה מידת הפגיעה באיכות הפיקסלים ברמות הדחיסה הנמוכות.

שאלות
נפוצות

האם אפשר להריץ את המודל רק עם הקבצים שבעמוד הזה?

לא. המודל דורש רכיב VAE נפרד כדי להמיר את המרחב הלטנטי לווידאו, שאותו צריך להוריד ממאגר אחר של Kijai. בנוסף, חובה להתקין את התוסף ComfyUI-GGUF כדי שהמערכת תדע לקרוא את הקבצים האלה.

למה יש בעמוד 16 קבצים ששוקלים יחד 171 גיגה-בייט?

המאגר כולל רמות דחיסה שונות של אותו המודל, מגרסאות מכווצות מאוד ועד FP16. אתם לא צריכים להוריד את כולם, אלא רק קובץ בודד שמתאים לנפח הזיכרון הפנוי בכרטיס המסך שלכם.

איך מריצים

כדי להריץ אותו צריך להתקין את הצומת ComfyUI-GGUF, לזרוק את הקבצים שהורדתם לתיקיית unet, ולהוריד בנפרד קובץ VAE ייעודי של Kijai. כל החבילה שוקלת 171 גיגה-בייט על פני 16 קבצים של גרסאות שונות, אז בוחרים רק את רמת הקוונטיזציה שמתאימה לזיכרון שלכם ולא מורידים הכול.

גרסת FP16 הועלתה במלואה אבל מוגבלת בגלל תקרות נפח קבצים. אם אין לכם כרטיס מסך חזק עם מספיק VRAM להחזיק מודל של 14 מיליארד פרמטרים ואין לכם ComfyUI מוגדר ועובד, עדיף להשתמש בפתרון ענן מוכן כי ההתקנה והרינדור המקומי יזחלו.

ollama run hf.co/city96/Wan2.1-T2V-14B-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ עותקים ולשלב אותו במוצרים שלכם, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗