GPT
W

Wan2.1_14B_VACE-GGUF

קוד פתוח

QuantStackapache-2.02025-05-16

  • gguf
  • video
  • video-generation
  • text-to-video

גרסה מכווצת בפורמט GGUF למודל יצירת הווידאו של Wan-AI עם 14 מיליארד פרמטרים. היא חוסכת משאבים ומאפשרת לייצר וידאו מקומי ישירות בתוך סביבת ComfyUI.

  • 191 GBמשקל הקבצים
  • 16,401הורדות בחודש
  • 245לייקים

מה זה

מדובר בהמרה ישירה של Wan2.1-VACE-14B לפורמט GGUF, שנוצרה מקובץ הבסיס בדרגת דיוק מלאה של FP32. המודל מתמקד ביצירת וידאו מטקסט ועיבוד וידאו לווידאו, ומציע משקלים מכווצים עד רמת Q8_0 ומטה כדי שתוכלו להריץ אותו בלי לשרוף את כל הזיכרון בכרטיס המסך.

בניגוד להרצה של קובצי המשקל המקוריים שדורשים מערכי שרתים כבדים, הדחיסה הזו מיועדת לעבודה שוטפת בתוך ComfyUI בעזרת תוסף ייעודי. סך כל הקבצים במאגר תופס 191 גיגה בייט בגלל ריבוי רמות הכיווץ, אבל בפועל מורידים רק את הקובץ הספציפי שמתאים לחומרה שלכם.

מתאים ל

  • רינדור וידאו ב־ComfyUI

    שילוב ישיר בתהליכי עבודה קיימים בעזרת התוסף ComfyUI-GGUF וקובץ הדוגמה המצורף.

  • יצירת וידאו מחומרה ביתית

    רמות הכיווץ מ־Q8_0 ומטה מאפשרות לטעון מודל 14B לכרטיסי מסך עם פחות זיכרון.

  • פרויקטי וידאו מסחריים

    רישיון Apache 2.0 מאפשר שילוב בצנרת הפקה מסחרית בלי תמלוגים או מגבלות סגורות.

איפה זה נופל

זה לא פתרון שעובד מהקופסה בהתקנה פשוטה של קליק אחד. המאגר מכיל רק את משקלי ה־unet, מה שמחייב אתכם למצוא ולהגדיר את ה־VAE בנפרד, להרכיב את השרשרת בתוך ComfyUI, ולקוות שהחומרה שלכם לא תקרוס תחת העומס של מודל וידאו כבד. בנוסף, אין במאגר גרסאות F16 או BF16 מוכנות מראש אלא רק גרסאות מכווצות עד Q8_0, כך שאם אתם חייבים דיוק מרבי ללא פשרות תצטרכו לבקש אותן במיוחד מהיוצר.

שאלות
נפוצות

איזה קבצים צריך להוריד כדי להתחיל לעבוד?

לא מורידים את כל ה־191 גיגה בייט. בוחרים קובץ מכווץ אחד ברמת הדיוק הרצויה, למשל Q8_0, ומורידים בנפרד את קובץ ה־VAE לפי הקישור שמופיע בעמוד.

האם אפשר לקבל את המודל ללא כיווץ?

המאגר כולל כרגע רק גרסאות מכווצות מ־Q8_0 ומטה. היוצר ציין שקובצי F16 או BF16 נוצרו מקובץ הבסיס, אך הם יועלו רק לפי בקשה מיוחדת.

איך מריצים

בשביל להריץ אותו צריך להתקין את התוסף ComfyUI-GGUF, לזרוק את קובץ המודל לתיקיית unet, ולהוריד בנפרד את קובץ ה־VAE הרשמי של Wan 2.1. המפתח צירף גם קובץ workflow לדוגמה שמבוסס על התיעוד הרשמי, כך שלא צריך לבנות את הגרף מאפס.

גרסת Q8_0 היא הכבדה והאיכותית ביותר שזמינה כאן, וממנה יש מדרגות כיווץ נמוכות יותר למי שמוגבל בזיכרון. אם כרטיס המסך שלכם חלש מדי בשביל להחזיק מודל של 14 מיליארד פרמטרים יחד עם ה־VAE, עדיף להשתמש ב־API מרוחק ולא לנסות לסחוט רינדור וידאו מקומי שייקח שעות.

ollama run hf.co/QuantStack/Wan2.1_14B_VACE-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0 מלא. אתם יכולים להשתמש בו באופן חופשי לחלוטין, לשלב אותו במוצרים מסחריים, לשנות אותו ולהפיץ אותו הלאה, כל עוד אתם שומרים על תנאי הקרדיט והרישיון המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗