GPT
W

Wan2.2-Fun-A14B-Control-GGUF

קוד פתוח

QuantStackapache-2.02025-08-13

  • gguf
  • text-to-video
  • en
  • zh

גרסת כימות בפורמט GGUF למודל יצירת וידאו עם בקרת שליטה מבית עליבאבא. אתם מקבלים יכולת להריץ כלי של 14 מיליארד פרמטרים ישירות דרך ממשק ComfyUI.

  • 233 GBמשקל הקבצים
  • 7,206הורדות בחודש
  • 40לייקים

מה זה

מדובר בהמרה ישירה לפורמט GGUF של המודל Wan2.2-Fun-A14B-Control שפותח על ידי alibaba-pai. המטרה המרכזית שלו היא יצירת וידאו מטקסט, כשהתוספת של מנגנון הקונטרול מאפשרת שליטה מדויקת יותר בתוצאה הוויזואלית ולא רק הסתמכות על פרומפט עיוור. הוא תומך באנגלית ובסינית, ומיועד להשתלב בצנרות עבודה קיימות של יצירת תוכן.

בניגוד למודלי וידאו ענקיים שדורשים חוות שרתים, פורמט ה־GGUF דוחס את המשקלים כדי שתוכלו לתמרן איתו בחומרה נגישה יותר. כל המאגר שוקל 233 גיגה בייט ומחולק לעשרים ושמונה קבצים שונים, כך שאפשר לבחור את רמת הכימות המדויקת שמתאימה לזיכרון שלכם במקום להוריד משקלים גולמיים ומנופחים.

מתאים ל

  • יצירת וידאו מבוקר

    שליטה בתנועה ובמבנה הסצנה בעזרת מנגנון הבקרה, מעבר למה שפרומפט טקסטואלי רגיל מאפשר לייצר.

  • רינדור מקומי ב־ComfyUI

    שילוב ישיר בצנרת קיימת בתוך המחשב שלכם, ללא תלות ברשת או תשלום חודשי על שירותי ענן.

  • עבודה עם פרומפטים בסינית

    תמיכה טבעית בסינית ובאנגלית מאפשרת שימוש ישיר בתיאורים מורכבים בשפות אלו ללא עיוותי משמעות.

איפה זה נופל

המודל תומך רשמית רק באנגלית ובסינית, כך שפרומפטים בעברית ידרשו תרגום מוקדם ולא יעבדו ישירות בצורה אמינה. מעבר לכך, מדובר במודל מורכב להקמה שמחייב חיבור ידני של מקודד טקסט ורכיב VAE נפרדים, מה שמגדיל את הסיכוי לשגיאות תאימות. כדאי לבדוק היטב את איכות התנועה ברמות הכימות הנמוכות, שכן דחיסה אגרסיבית של מודלי וידאו נוטה לייצר מריחות ועיוותים פיזיקליים.

שאלות
נפוצות

האם אני חייב להוריד את כל 233 הגיגה בייט כדי לעבוד איתו?

ממש לא. המאגר כולל עשרים ושמונה קבצים שונים שמייצגים רמות כימות שונות של אותו המודל. אתם צריכים לבחור ולהוריד רק קובץ GGUF אחד ברמת הכימות שמתאימה לנפח הזיכרון של כרטיס המסך שלכם.

האם הקובץ מהמאגר מספיק כדי להתחיל ליצור סרטונים?

לא, הקובץ הוא רק מודל הבסיס ויושב בתיקיית unet. כדי לייצר וידאו תצטרכו להוריד בנפרד גם מקודד טקסט Umt5-xxl וקובץ VAE תואם, ולהגדיר אותם יחד ב־ComfyUI.

איך מריצים

כדי להריץ אותו בפועל תצטרכו את ComfyUI יחד עם התוסף ComfyUI-GGUF של city96. הקובץ הראשי נכנס לתיקיית unet, אבל הוא לא עובד לבד. חובה לחבר אליו גם מקודד טקסט מסוג Umt5-xxl ורכיב VAE תואם. עשרים ושמונה הקבצים מייצגים רמות כימות שונות, כך שאפשר לבחור קובץ קל יותר אם כרטיס המסך שלכם מוגבל.

אם אין לכם כרטיס מסך מודרני וחזק עם כמות מכובדת של VRAM, אין טעם לנסות להריץ מודל של 14 מיליארד פרמטרים מקומית. הפקת וידאו ב־GGUF אמנם חוסכת זיכרון, אך היא עדיין כבדה מאוד בזמן עיבוד, ובמקרים של חומרה חלשה עדיף לשלם לפי שימוש ב־API חיצוני.

ollama run hf.co/QuantStack/Wan2.2-Fun-A14B-Control-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

28 קבצים במאגר, 233 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0, שמאפשר שימוש מסחרי מלא, שינוי של הקוד והפצה חופשית. המגבלה היחידה היא שמירה על הודעות זכויות היוצרים של המקור, וזכרו שהמפרסמים מציינים שכל תנאי השימוש וההגבלות המקוריים של עליבאבא עדיין חלים על המשקלים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗