GPT
W

wan2-1-fast

רץ בדפדפן

multimodalartרישיון לא דווח2025-05-18

  • gradio
  • mcp-server

הכלי מייצר סרטוני וידאו קצרים מתמונות סטילס והנחיות טקסט תוך שניות בודדות. הוא מיועד ליוצרים שרוצים להנפיש תמונות במהירות בלי לחכות דקות ארוכות לכל רינדור.

  • הורדות בחודש
  • 1,621לייקים

מה זה

מעלים תמונת מקור בפורמט רגיל, כותבים הנחיית טקסט קצרה שמתארת את התנועה הרצויה, ומקבלים קובץ וידאו מונפש. הממשק מציע גם דוגמאות מוכנות מראש שמכילות תמונות, פרומפטים והגדרות רזולוציה מתאימות לבדיקה מהירה בלחיצה אחת.

מאחורי הקלעים רץ מודל Wan2.1 בתצורת תמונה לווידאו עם 14 מיליארד פרמטרים ברזולוציית בסיס של 480p. כדי לקצר את זמן היצירה, המערכת משלבת את CausVid, זיקוק של המודל שמגיע כתוסף LoRA שחולץ על ידי Kijai. השילוב הזה מאפשר לוותר על עשרות שלבי יצירה ולהפיק וידאו בארבעה עד שמונה צעדים בלבד דרך ספריית Diffusers.

מתאים ל

  • הנפשת תמונות מהירה

    יצירת קליפ קצר מתמונת סטילס תוך ארבעה צעדי רינדור בלבד לצורך בדיקת רעיונות.

  • בדיקת תנועה לווידאו

    הערכת הנחיות טקסט שונות על אותה תמונה כדי לראות איך כיוון התנועה משתנה.

  • הפקת וידאו קצר לרשת

    יצירת סרטוני תנועה קצרים באורך שניות בודדות לשימוש ברשתות חברתיות.

איפה זה נופל

המודל מוגבל לרזולוציית 480p ולטווח תנועה שנע בין שמונה ל־81 פריימים בלבד, כך שלא תקבלו כאן סרטונים ארוכים או חדים במיוחד. אם לא תעלו תמונה הכלי יזרוק שגיאה מיד, כי הוא לא תומך ביצירת וידאו מטקסט בלבד. בנוסף, זיקוק הרינדור לארבעה צעדים אומנם מאיץ את העבודה, אך הוא גובה מחיר באיכות התנועה לעומת הרצה מלאה ואיטית של המודל המקורי.

שאלות
נפוצות

האם השימוש בכלי עולה כסף?

לא, השימוש בדף פתוח לחלוטין בדפדפן ואינו דורש תשלום. המשאבים מוקצים על גבי חומרת A10G שיתופית לפי זמינות.

האם התמונות שאני מעלה נשארות פרטיות?

העיבוד נעשה על שרתי ענן פומביים של Hugging Face. היות שהרישיון והתנאים לא פורטו, לא כדאי להעלות תמונות אישיות או חומרים מסווגים.

במה הכלי שונה משימוש ישיר במודל Wan2.1 המקורי?

הגרסה הזו משלבת משקולות CausVid כ־LoRA, מה שמכווץ את תהליך היצירה לארבעה צעדים במקום עשרות צעדים. זה מייצר סרטון מהר יותר, אך לעיתים עם פחות פירוט או יציבות.

האם אפשר להריץ את זה על המחשב בבית?

כן, הקוד מבוסס על ספריות סטנדרטיות כמו Diffusers ומשקולות פתוחות מ־Hugging Face. תצטרכו כרטיס מסך חזק עם מספיק זיכרון וידאו כדי לטעון מודל בגודל 14 מיליארד פרמטרים.

איך משתמשים

גוררים תמונה לתיבת הקלט, מקלידים פרומפט, בוחרים משך זמן בשניות ולוחצים על כפתור הייצור. תחת הגדרות מתקדמות אפשר לקבוע גם פרומפט שלילי, סיד, מספר צעדי רינדור ומידות גובה ורוחב. החומרה שמריצה את הדף היא כרטיס מסוג A10G שמוקצה לפי דרישה. ברירת המחדל עומדת על ארבעה צעדי רינדור בלבד, כך שההפקה מהירה מאוד, אבל עומס משתמשים באתר עלול להכניס אתכם לתור קצר לפני שהמעבד הגרפי מתחיל לעבוד.

הרישיון

הרישיון של המרחב לא דווח בדף הפרויקט. המשמעות היא שאין היתר ברור לשימוש מסחרי בתוצרים, והזכויות על הקוד והתשתית אינן מוגדרות במפורש. הקבצים שאתם מעלים מועברים לעיבוד על גבי השרתים הציבוריים של Hugging Face, ולכן מומלץ לא להזין חומרים רגישים או פרטיים.

הרישיון המלא ב־Hugging Face ↗