GPT
W

wan2-1-VACE-fast

רץ בדפדפן

linoytsרישיון לא דווח2025-07-25

  • gradio
  • mcp-server

הכלי מייצר סרטוני וידאו קצרים מתמונות ומטקסט בשישה צעדים בלבד. הוא מיועד למי שרוצה לבדוק הנפשה מבוססת תנאי תמונה בלי לחכות דקות ארוכות לכל ריצה.

  • הורדות בחודש
  • 95לייקים

מה זה

אתם מעלים תמונה אחת או יותר לגלריה, בוחרים מצב עבודה, וכותבים תיאור טקסטואלי של מה שצריך לקרות בסרטון. יש אפשרות לסמן הסרת רקע אוטומטית מהתמונות, והתוצאה שמתקבלת בצד היא קובץ וידאו עם ניגון אוטומטי. בהגדרות המתקדמות אפשר לקבוע פרומפט שלילי, סיד, מידות גובה ורוחב, ומספר צעדי ריצה בין 1 ל־10.

מאחורי הקלעים רץ המודל Wan2.1-VACE-14B בגרסת diffusers, כשאליו מוצמד לורה בשם FusionX Phantom של היוצרת vrgamedevgirl84. השילוב הזה נועד לאפשר דחיסה של תהליך הדגימה לשישה צעדים כדי לקצר זמנים בצורה משמעותית. להסרת הרקע מהתמונות נעשה שימוש במודל הייעודי RMBG-1.4 של briaai.

מתאים ל

  • הנפשת תמונת מקור

    מעלים תמונה בודדת ומקבלים סרטון קצר שמתבסס על הדמות או האובייקט לפי הנחיית טקסט.

  • מעבר בין שני פריימים

    מזינים שתי תמונות כדי ליצור סרטון שמגשר ביניהן כתמונת התחלה וסיום.

  • חיתוך רקע והנפשה נקייה

    מבודדים אובייקט מתמונה באמצעות RMBG-1.4 לפני תחילת יצירת הווידאו.

איפה זה נופל

הקיצור לשישה צעדי חישוב בלבד גובה מחיר באיכות, ולעיתים קרובות מופיעים עיוותים בתנועה או ירידה בפרטים ביחס למודל הבסיס המלא. בנוסף, חלון הפריימים נעול בין 8 ל־81 פריימים בלבד, כך שאי אפשר לייצר סרטונים ארוכים. מצב עבודה שמחבר בין פריים ראשון לאחרון דורש לפחות שתי תמונות, ואם תעלו פחות תקבלו שגיאה מיידית.

שאלות
נפוצות

האם השימוש באפליקציה עולה כסף?

האפליקציה זמינה לשימוש חופשי בדפדפן על גבי התשתית של Hugging Face. אין כאן מדרגות תשלום או צורך בהזנת כרטיס אשראי. עם זאת, הזמינות תלויה במכסות השימוש החופשיות של חומרת השרת.

מה קורה עם התמונות והסרטונים שאני מעלה?

הקבצים מעובדים על שרת מרוחק שאינו בשליטתכם, והפרויקט פועל במרחב ציבורי. אין מידע על שמירה קבועה של הקבצים מעבר לזמן העיבוד, אך לא מומלץ להעלות חומרים רגישים. אם הפרטיות קריטית, עדיף להריץ את המודלים בסביבה מקומית.

כמה זמן לוקח לייצר סרטון?

זמן היצירה בפועל קצר יחסית למודלי וידאו כבדים בזכות שילוב של 6 צעדי ריצה ומאיץ A10G. יחד עם זאת, התחלת הריצה תלויה בהקצאת המשאבים של zero-gpu באותו רגע. אם השרת עמוס, תצטרכו להמתין בתור לפני שהעיבוד יתחיל.

במה היישום הזה שונה מהמודל המקורי של Wan2.1?

המודל המקורי דורש בדרך כלל עשרות צעדי דגימה ומשאבי מחשוב משמעותיים בהרבה. כאן הוסיפו שכבת FusionX Phantom LoRA שמאיצה את התהליך לשישה צעדים ומאפשרת תגובה מהירה יותר. בנוסף שולב רכיב להסרת רקע מתמונות שלא קיים במודל הווידאו עצמו.

איך משתמשים

טוענים תמונות, מתאימים את משך הזמן הרצוי בשניות, ולוחצים על Generate Video. הריצה מתבצעת על חומרת zero-a10g שמקצה מעבד גרפי של אנבידיה לפי דרישה. בגלל שמספר הצעדים ברירת המחדל עומד על 6 בלבד, העיבוד עצמו לא אמור להיגרר זמן רב, אבל במצבי עומס על חומרת Zero GPU אתם עשויים להמתין בתור לפני שהמכונה בכלל מתחילה לעבוד.

הרישיון

הרישיון לא דווח בעמוד של האפליקציה. המשמעות היא שאין הרשאה ברורה לגבי שימוש מסחרי בתוצאות, וכל תמונה שאתם מעלים או וידאו שאתם מפיקים מועברים דרך התשתית הציבורית של Spaces בלי התחייבות לפרטיות.

הרישיון המלא ב־Hugging Face ↗