GPT
H

Helios-14B-RealTime-AOTI

רץ בדפדפן

BestWishYshapache-2.02026-03-06

  • gradio

הדגמה שמייצרת סרטונים קצרים מטקסט, תמונה או וידאו קיים. מתאימה למי שרוצה לבדוק מהירות ויכולות של מודל וידאו מזוקק בלי להגדיר שרת משלו.

  • הורדות בחודש
  • 83לייקים

מה זה

אתם בוחרים מצב עבודה, מזינים תיאור טקסטואלי, ויכולים להוסיף קובץ תמונה או סרטון לפי הצורך. הפלט הוא קובץ וידאו מרונדר לצד תיבת מידע על הריצה. בהגדרות המתקדמות אפשר לקבוע את כמות הפריימים בכפולות של שלושת, את כמות צעדי הדגימה וערך סיד לשחזור תוצאות.

מאחורי הקלעים רץ המודל המזוקק Helios-Distilled בגודל 14 מיליארד פרמטרים, יחד עם HeliosDMDScheduler ו־HeliosPyramidPipeline מתוך ספריית diffusers בפורמט bfloat16. המודל עובד בצורה אוטורגרסיבית בחלוקה למקטעים של 33 פריימים, ומיישם חיזוי x0 שנועד לקצר משמעותית את זמן ההסקה ביחס למודל הבסיס.

מתאים ל

  • הנפשת תמונות סטילס

    העלאת תמונה קיימת והוספת תיאור תנועה קצר כדי לקבל קליפ מונפש תוך שניות.

  • בדיקת פרומפטים לווידאו

    ניסוי מהיר של תיאורים טקסטואליים לבדיקת תנועה ודיוק לפני הרצה כבדה על שרת פרטי.

  • שינוי סגנון לווידאו קיים

    הזנת סרטון קיים וטקסט כדי לנסות עיבוד מחודש של התנועה.

איפה זה נופל

הרזולוציה נעולה בממשק על 384 על 640 פיקסלים בלי אפשרות לשינוי. אורך הסרטון מוגבל בסליידר לעד 231 פריימים בלבד, שזה פחות מעשר שניות, למרות שהתיעוד מבטיח תמיכה בסרטונים ארוכים בהרבה. המפתחים עצמם מציינים שהאימון בוצע בעיקר על טקסט לווידאו, ולכן יצירה מתמונה או מעריכת וידאו נותנת לעיתים קרובות תוצאות נחותות או מקטעים סטטיים בהתחלה.

שאלות
נפוצות

האם השימוש בהדגמה עולה כסף?

לא, הממשק פתוח לשימוש חופשי בדפדפן. כל עוד השרת פועל במכסה הציבורית שלו אין עלות למשתמש.

כמה זמן לוקח לייצר סרטון?

זה תלוי בעומס ובחומרה שזמינה באותו רגע. על חומרת A10G שמוקצית כאן ובברירת מחדל של שני צעדים, הריצה לוקחת בדרך כלל בין כמה שניות לחצי דקה אם אין תור.

האם אפשר להריץ את המערכת על מחשב מקומי?

כן, המשקולות של Helios-Distilled והקוד זמינים להורדה. לפי התיעוד אפשר להריץ אותו עם ספריות Diffusers או SGLang, ושיטות אופטימיזציה מאפשרות ריצה גם בפחות מ־6 גיגה זיכרון וידאו.

במה ההדגמה הזאת שונה מריצת המודל המלא?

היא מריצה גרסה מזוקקת של המודל שמיועדת למהירות על חשבון חלק מאיכות התמונה. בנוסף, הממשק מגביל את כמות הפריימים המרבית ל־231 ונועל את הרזולוציה לנמוכה מהיכולת המרבית של הארכיטקטורה.

איך משתמשים

בוחרים בממשק בין טקסט, תמונה או וידאו, כותבים תיאור ולוחצים על Generate Video. אין צורך בהרשמה או התחברות לחשבון. ההדגמה רצה על מאיץ A10G בתצורת שיתוף משאבים, כך שאם יש עומס תצטרכו להמתין בתור עד שהחומרה תתעורר. למרות שהמפתחים מדברים על קצבים של 19.5 פריימים לשנייה בכרטיסי H100, החומרה כאן חלשה יותר ותייצר קצב איטי יותר בפועל.

הרישיון

הקוד וההדגמה מפורסמים תחת רישיון apache-2.0, שמאפשר שימוש חופשי וגם מסחרי בקוד ובמשקולות. לגבי הקבצים שאתם מעלים או מפיקים, הממשק רץ על תשתית ציבורית ולכן לא מומלץ להעלות חומרים רגישים או קבצים שאינכם רוצים שיישמרו זמנית בשרת.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗