GPT
W

Rchoks/wan555

רץ בדפדפן

Rchoksרישיון לא דווח2026-07-02

  • gradio
  • mcp-server

המרת תמונה לווידאו בעזרת מודל Wan2.2 מכווץ. הכלי מיועד למי שרוצה תצוגה מקדימה מהירה בלי לחכות לתור ממושך.

  • הורדות בחודש
  • 163לייקים

מה זה

אתם מעלים תמונת מקור, כותבים הנחיית טקסט קצרה, ומקבלים קובץ וידאו מונפש. אפשר גם להעלות תמונת סיום כדי להגדיר לאן התנועה צריכה להגיע. הממשק מאפשר לקבוע את משך הסרטון בשניות, ויש כפתור שמחלץ פריים מסוים מתוך הווידאו המוכן כדי להשתמש בו מיד כקלט הבא.

מאחורי הקלעים רץ המודל Wan2.2 בגרסת 14B תחת ספריית Diffusers, שעבר אופטימיזציות כדי להצליח לרוץ מהר. הקוד מיישם קוונטיזציה של שמונה ביט, הידור AoT, ומודל RIFE שמכפיל את כמות הפריימים. השילוב הזה נועד לייצר סרטון בארבעה עד שמונה צעדי דגימה בלבד במקום עשרות.

מתאים ל

  • בדיקת תנועה מהירה

    הרצת סקיצה ראשונית כדי לראות אם כיוון האנימציה של התמונה עובד לפני עיבוד כבד.

  • הנפשה מתמונה לתמונה

    הגדרת תמונת התחלה ותמונת סיום לקבלת מעבר מונפש ורציף ביניהן.

  • שרשור קטעי וידאו

    לכידת הפריים האחרון מתוך הווידאו שהופק והזנתו מחדש כקלט לסרטון המשך.

איפה זה נופל

המהירות מגיעה על חשבון איכות. ריצה של ארבעה עד שמונה צעדים בלבד עם שמונה ביט גורמת לפשרות בפרטים הקטנים ולעיוותים בתנועות מורכבות. הממשק מזהיר מפורשות שאיכות וידאו ברמה עשר עלולה ליצור קובץ כבד מדי שלא יוצג בנגן. בנוסף, אם תעלו את ה־Guidance Scale מעל אחד, תשלמו בזמן עיבוד ארוך בהרבה וצריכת זיכרון מוגברת שעלולה להיכשל במגבלות ZeroGPU.

שאלות
נפוצות

האם השימוש פתוח בחינם?

כן, המרחב זמין לשימוש ישיר בדפדפן. עם זאת, הוא מסתמך על מכסות החומרה של ZeroGPU. אם תנצלו את המכסה האישית שלכם בשרת, תצטרכו להמתין שהיא תתאפס.

כמה זמן לוקח לייצר סרטון?

בברירת המחדל מוגדרים שישה צעדי איטרציה בלבד, ולכן הפקת הווידאו אורכת שניות בודדות עד דקה. אם תעלו את ערכי הצעדים או תגדילו את ערכי ה־Guidance Scale, זמן ההמתנה יתארך משמעותית.

מה קורה לתמונות שאני מעלה?

התמונות והסרטונים נשמרים זמנית על גבי השרת שמריץ את הקוד. לפי ההגדרות בקוד הממשק, הקבצים במטמון נמחקים מעצמם בטווח שבין שעה לשלוש שעות. לא כדאי להעלות לשם חומרים רגישים.

במה היישום הזה שונה מהמודל המקורי?

הוא לא מריץ את Wan2.2 בתצורתו המלאה והכבדה, אלא גרסה מכווצת ומותאמת. נעשה כאן שימוש בקוונטיזציה של שמונה ביט, בהידור AoT ובמספר צעדים נמוך כדי לאפשר ריצה קלילה ומהירה.

איך משתמשים

מעלים תמונה, מוודאים שהטקסט מתאים, ולוחצים על Generate Video. הקוד דורש תמונת קלט ומציג הודעת שגיאה אם מנסים להריץ בלעדיה. הריצה מתבצעת על גבי תשתית ZeroGPU עם מעבד A10G. המערכת מקצה את המעבד הגרפי לפי דרישה, מה שאומר שיש זמני המתנה קצרים להקצאת החומרה, אך הודות למיעוט הצעדים והכיווץ לשמונה ביט, העיבוד עצמו מסתיים במהירות ביחס למודל בגודל הזה.

הרישיון

הרישיון של המרחב עצמו לא דווח. מודל הבסיס והרכיבים מגיעים ממאגרים חיצוניים שונים, וללא רישיון מוגדר לא ברור מה מותר לעשות עם הווידאו שנוצר מבחינה מסחרית. הקבצים שאתם מעלים עוברים דרך השרתים הציבוריים של Hugging Face, ולפי הקוד המטמון נמחק אוטומטית רק אחרי שעה עד שלוש שעות.

הרישיון המלא ב־Hugging Face ↗