GPT
W

Wan2.2-T2V-A14B

קוד פתוח

Wan-AIapache-2.02025-07-24

  • wan2.2
  • diffusers
  • safetensors
  • text-to-video

מודל פתוח שמייצר וידאו מטקסט באיכות גבוהה בעזרת חלוקה למומחים שונים. הוא מתאים למי שחייב שליטה מלאה בתהליך הריצה על שרתים משלו.

  • 118 GBמשקל הקבצים
  • 3,056הורדות בחודש
  • 559לייקים

מה זה

המודל מחזיק 27 מיליארד פרמטרים בסך הכל, אך בנוי בארכיטקטורת MoE עם שני מומחים של כ־14 מיליארד פרמטרים כל אחד. רק מומחה אחד פעיל בכל צעד של תהליך הסרת הרעש, כך שהמומחה הראשון בונה את הקומפוזיציה והתנועה הכללית ברמת רעש גבוהה, והשני נכנס לפעולה לפי סף יחס אות לרעש כדי לחדד פרטים.

התוצאה היא סרטונים באורך 5 שניות ברזולוציות של 480P או 720P. לעומת גרסת Wan2.1 הקודמת, האימון התבסס על תוספת של 65.6% תמונות ו־83.2% סרטונים עם תיוג ייעודי לתאורה וצבעים, מה שהוריד את שגיאת הוולידציה במדדי היוצרים בהשוואה לדגמים סגורים ומסחריים.

מתאים ל

  • הפקת וידאו מטקסט לשרתים חזקים

    מתאים לצינורות עיבוד עצמאיים עם שרתי 80GB שמחפשים איכות קולנועית ללא תלות בספק חיצוני.

  • מחקר על ארכיטקטורות MoE

    מספק יישום פתוח ובדוק לחלוקת מומחים לפי ספי רעש בתוך מודלי דיפוזיה של וידאו.

  • יצירת קטעי אנימציה ותנועה

    נשען על אימון תנועה מורחב שמאפשר תנועות גוף מורכבות יותר מגרסאות פתוחות קודמות.

איפה זה נופל

המודל מוגבל מראש לסרטונים של חמש שניות בלבד, ואינו תומך בהזנת תמונה כבסיס בניגוד לגרסת ה־I2V. מעבר לכך, איכות התוצר תלויה ישירות בהרחבת פרומפט, מה שמאלץ אתכם לתחזק שירות נפרד כמו שרת מקומי עם מודל Qwen או חיבור ל־API של עליבאבא, אחרת הפירוט בווידאו נפגע באופן משמעותי.

שאלות
נפוצות

האם אפשר להריץ את המודל על כרטיס מסך ביתי?

לא. הדגם הזה מחייב לפחות 80GB זיכרון גרפי לכרטיס יחיד וכולל הורדה של 118 גיגה-בייט. לכרטיסים ביתיים עדיף להשתמש בגרסת 5B של הסדרה.

האם המודל מקבל תמונת מקור ומנפיש אותה?

לא, המשקלים האלה נועדו אך ורק ליצירת וידאו מטקסט. מי שצריך הנפשת תמונות צריך להוריד את גרסת ה־I2V-A14B הנפרדת מאותו פרויקט.

איך מריצים

כדי להריץ כרטיס בודד דרוש מאיץ עם לפחות 80GB זיכרון וירטואלי, וגם אז יש להפעיל את דגלי פריקת המודל, המרת סוג הנתונים והרצת מקודד הטקסט על המעבד הרגיל. בסביבת ייצור עם עומס, ההרצה המומלצת דורשת שרת של 8 מאיצים באמצעות FSDP ו־DeepSpeed Ulysses.

אם אין לכם קלאסטר כזה או מאיץ 80GB ייעודי, עדיף להשתמש בגרסת ה־5B הקלה שרצה על כרטיסי 4090, או לפנות ל־API חיצוני כמו DashScope, שממילא מוצע כאן לצורך הרחבת פרומפטים בעזרת מודלי שפה.

pip install -U huggingface_hub
hf download Wan-AI/Wan2.2-T2V-A14B

הקבצים

32 קבצים במאגר, 118 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא Apache 2.0 מלא שמתיר שימוש מסחרי, שינוי קוד והפצה חופשית. היוצרים אינם דורשים זכויות על הווידאו שנוצר, אך מחייבים שמירה על תנאי השימוש החוקיים ומניעת פגיעה או הפצת מידע כוזב.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗