GPT
W

wan-gguf

קוד פתוח

calcuisapache-2.02025-02-26

  • gguf
  • gguf-connector
  • gguf-node
  • text-to-video
  • en

גרסת קוונטיזציה של מודל הווידאו Wan בפורמט GGUF. היא מיועדת למי שרוצה לייצר וידאו מטקסט או מתמונה מקומית בתוך ComfyUI בלי להחזיק שרתי ענק.

  • 1.1 TBמשקל הקבצים
  • 20,541הורדות בחודש
  • 206לייקים

מה זה

מדובר בהמרה של מודל הווידאו Wan של Wan-AI לפורמט GGUF, כשהמטרה היא לאפשר יצירת וידאו מטקסט ומתמונה על חומרה נגישה יותר. המאגר כולל 133 קבצים במשקל כולל של 1.1 טרה בייט, ומציע פיצול לרכיבים שונים כמו המודל עצמו, מקודדי טקסט מסוג t5xxl, מקודדי תמונה ורכיבי VAE.

הייחוד כאן הוא התמיכה בגרסת 1.3B שלפי התיעוד מתאימה למחשבים ישנים או חלשים יחסית, לצד גרסאות שמבוססות על מודל 14B המקורי. כדי להריץ את הקבצים האלה צריך להשתמש בהרחבות ייעודיות כמו ComfyUI-GGUF או חבילת gguf-connector, שכן נעשה כאן שימוש בארכיטקטורה מותאמת שמכונה pig.

מתאים ל

  • יצירת וידאו ב־ComfyUI

    מאפשר לייצר סרטונים קצרים מטקסט בתוך תהליכי עבודה מקומיים בלי לשלם על API חיצוני.

  • עבודה על מחשב ביתי

    גרסת 1.3B ב־GGUF מיועדת לרוץ גם על מחשבים חלשים וישנים יחסית עם פריקה חכמה לזיכרון המעבד.

  • הנפשת תמונות סטילס

    תומך במשימות תמונה לווידאו בעזרת חיבור מקודד clip-vision מתאים ישירות לצנרת היצירה.

איפה זה נופל

ההתקנה דורשת התעסקות ידנית ולא תמיד עובדת ישר מהקופסה. בגלל השימוש בארכיטקטורת pig, אם ComfyUI לא מזהה את הקובץ תצטרכו לערוך את הקובץ loader.py ולהוסיף את המחרוזת pig לרשימת הארכיטקטורות הנתמכות בעצמכם.

מעבר לזה, המודל תומך באנגלית בלבד. מי שבונה על פרומפטים בעברית יקבל תוצאות שבורות או יצטרך לתרגם אותם מראש. בנוסף, בחלק מהגרסאות המוקדמות היו שגיאות בטעינת משקולות זמן וטקסט, מה שדרש עדכון של חלק מהקבצים למבנה f32 כדי למנוע קריסות בריצה.

אותה משפחה

wan יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אני חייב להוריד את כל 1.1 הטרה בייט של המאגר?

לא. המאגר מכיל עשרות קוונטיזציות וחלקי מודל שונים ב־133 קבצים. אתם מורידים רק את קובץ המודל הרצוי, מקודד טקסט אחד וקובץ VAE אחד שמתאימים לתצורה שלכם.

למה ComfyUI לא מזהה את קובץ ה־GGUF שהורדתי?

המודל משתמש במבנה פנימי שנקרא pig. תצטרכו לפתוח את הקובץ loader.py של צומת ה־GGUF ב־ComfyUI ולהוסיף את המילה pig לרשימה שנקראת IMG_ARCH_LIST כדי שהמערכת תטען אותו.

האם המודל מבין הוראות בעברית?

לא, המודל אומן ותומך באנגלית בלבד. כדי לקבל תוצאות מדויקות חייבים לכתוב את הפרומפטים באנגלית או להעביר אותם תרגום לפני השליחה למודל.

איך מריצים

ההרצה נעשית בעיקר דרך ComfyUI. את קובץ המודל שמים בתיקיית diffusion_models, את מקודד הטקסט בתיקיית text_encoders, ואת ה־VAE במקום המתאים לו. אם עובדים על יצירת וידאו מתמונה, צריך לטעון גם את clip-vision-h לתיקיית clip_vision. יש אפשרות להריץ חלופית דרך diffusers או בעזרת פקודת ggc v2 של gguf-connector.

אם משתמשים במקודד umt5xxl בגרסת fp8 scaled, צריך להגדיר בטוען המודלים פריקה למעבד במקום לכרטיס המסך כדי לחסוך זיכרון וידאו, מה שלא אמור לפגוע במהירות. גרסת ה־1.3B תעבוד על מחשבים פשוטים יותר, אבל המאגר כולו שוקל מעל טרה בייט כך שתצטרכו לבחור רק את הקבצים הספציפיים שדרושים לכם.

ollama run hf.co/calcuis/wan-gguf:Q8_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

133 קבצים במאגר, 1.1 TB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים את נוסח הרישיון המקורי. אין כאן הגבלות מיוחדות על שילוב במוצרים מסחריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗