GPT
W

wan2-gguf

קוד פתוח

calcuisapache-2.02025-07-29

  • gguf
  • gguf-node
  • text-to-video

גרסאות מכווצות בפורמט GGUF למודלי יצירת הווידאו Wan2.2. מי שרוצה לייצר וידאו מטקסט מקומית בתוך ComfyUI בלי לחנוק את הזיכרון ימצא כאן מענה.

  • 1.1 TBמשקל הקבצים
  • 10,184הורדות בחודש
  • 42לייקים

מה זה

מדובר במאגר קבצים שמכיל קוונטיזציות GGUF של משפחת Wan2.2, שפותחה במקור על ידי Wan-AI למשימות של text-to-video. במקום להוריד מודלי ענק במשקל מלא שלא נכנסים בחומרה ביתית או בתחנות עבודה סבירות, calcuis מציע כאן גרסאות דחוסות שמיועדות לרוץ ישירות במערכות כמו ComfyUI בעזרת gguf-node ייעודי.

המאגר עמוס ומחזיק 147 קבצים בנפח כולל של מעל טרה־בייט, שמכסים גרסאות שונות כמו מודלי 5B ו־14B, לצד קובצי עזר של VAE ו־LoRA. הדגש כאן הוא לא על אלגוריתם חדש אלא על הנגשה של מודל קיים, כולל תמיכה בהרחבות כמו s2v ליצירת וידאו וחיבור מודלי Lightning להאצת הריצה לפחות צעדים.

מתאים ל

  • רינדור וידאו ב־ComfyUI

    טעינת מודלי הווידאו של Wan2.2 ישירות לתוך סביבת עבודה מקומית בעזרת צמתי GGUF.

  • האצת תהליכי יצירה

    שילוב משקלי Lightning שמקצרים את תהליך ההסקה ל־4 או 8 צעדים לחסכון בזמן.

  • אנימציה מבוססת תמונה או קול

    שימוש ב־s2v lite lora יחד עם המודל ליצירת אנימציות מותאמות.

איפה זה נופל

המאגר הזה הוא בלאגן של קבצים בלי תיעוד מסודר על איכות הפלט של כל קוונט וקוונט. אין בנצ'מרקים, אין השוואות אובדן איכות בין רמות הדחיסה השונות, וצריך להרכיב את הפאזל לבד עם קובצי טקסט ואנקודר חיצוניים. בנוסף, מודלי וידאו כבדים מטבעם, וגם בפורמט מכווץ הרינדור המקומי עלול להיות איטי מאוד.

שאלות
נפוצות

איזה קובץ VAE אני צריך להוריד מתוך המאגר?

זה תלוי בגודל המודל שבחרתם. למודל ה־5B צריך להוריד את pig-wan2-vae ששוקל 1.41GB, ובשביל מודל ה־14B משתמשים בקובץ pig-wan-vae ששוקל 254MB.

האם המודל כולל בתוכו את רכיב פענוח הטקסט?

לא. צריך להוריד את מקודד הטקסט umt5xxl בנפרד, מאחד המאגרים המקושרים, ולשים אותו בתיקיית text_encoders כדי לייצר וידאו מטקסט.

איך מריצים

כדי לעבוד עם זה מורידים את הרכיבים הדרושים ומפזרים אותם בתיקיות של ComfyUI: מודל ה־wan הולך ל־diffusion_models, ה־umt5xxl ל־text_encoders, וה־VAE המכונה pig נכנס ל־vae. צריך לשים לב שמשתמשים ב־VAE הנכון, כי לגרסת 5B יש קובץ של 1.41GB ולגרסת 14B יש קובץ נפרד של 254MB.

צריך לעדכן את gguf-node כדי לקבל תמיכה מלאה בקוונטים החדשים. מי שמחזיק כרטיס מסך ממוצע יוכל לנסות להריץ את גרסת ה־5B, אבל למודל ה־14B עדיין תצטרכו חומרה חזקה עם זיכרון וידאו רחב, ואם אין לכם סבלנות לזמני רינדור ארוכים של פריימים, API חיצוני יחסוך תסכול.

ollama run hf.co/calcuis/wan2-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

147 קבצים במאגר, 1.1 TB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו מחדש, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי. אפשר לשלב אותו במוצרים מסחריים בלי לחשוף קוד קנייני.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗