GPT
M

MiniMax-H3-Acc-LoRAs

קוד פתוח

alibaba-paiother2026-08-26

  • videox_fun
  • text-to-video

מתאמי האצה שמקצרים את יצירת הווידאו במודל MiniMax-H3 לשמונה צעדי דגימה בלבד. הם מיועדים למי שרוצה לחתוך זמני רינדור בלי לוותר על בסיס המודל המקורי.

  • 2.6 GBמשקל הקבצים
  • 67,839הורדות בחודש
  • 220לייקים

מה זה

מדובר בצמד משקלי LoRA רשמיים שפותחו על ידי עליבאבא כדי להאיץ את תהליך ההסקה של MiniMax-H3. הרעיון נשען על שיטה בשם Parallel Decoding Distillation, שמזקקת את תהליך הרינדור וחוסכת עשרות צעדים חישוביים, כך שמגיעים לווידאו מוכן בשמונה צעדים בלבד.

המאגר כולל התאמות ייעודיות לשתי גרסאות של מודל הבסיס: אחת עבור FL2VA ברזולוציה של 768p ואחת עבור Ref2VA. המשקלים שמורים בפורמט safetensors בדיוק של BF16 עם rank ו־network_alpha של 64. הם לא באים להחליף את המודל הגדול אלא מתלבשים עליו כדי לקצר את זמן ההמתנה לכל פריים.

מתאים ל

  • האצת רינדור מקומי

    קיצור זמן יצירת הווידאו בשרתים עצמאיים למי שכבר מריץ את MiniMax-H3 ורוצה לקבל סרטון בשמונה צעדים.

  • עבודה עם תמונת פתיחה

    שימוש בגרסת FL2VA להנפשת תמונות במהירות של 768p בלי לחכות לזמני ההסקה הרגילים והארוכים.

  • יצירת וידאו על בסיס רפרנס

    הרצת מודל Ref2VA עם מתאם Acc LoRA תואם, שמייצר סרטון בהתבסס על קלט ייחוס בכמות צעדים נמוכה.

איפה זה נופל

החיסרון הברור ביותר הוא שהמתאמים האלה לא עובדים לבד, אתם חייבים להוריד ולהחזיק את מודל הבסיס MiniMax-H3 המלא. מעבר לכך, הכרטיס לא מציג מדדים כמותיים רשמיים על איכות התוצאה אלא רק סרטוני הדגמה מול פתרונות אחרים כמו Minimax-h3-Turbo. קיצור תהליך ההסקה לשמונה צעדים עלול לפגוע בפרטים קטנים או בעקביות התנועה בהשוואה להסקה מלאה ואיטית, וצריך לבדוק בפועל אם איכות הווידאו עומדת ברף הנדרש שלכם.

שאלות
נפוצות

האם אפשר להריץ את המאגר הזה כמו שהוא כדי ליצור וידאו?

לא. הקבצים כאן הם מתאמי LoRA בלבד, ששוקלים כ־2.6 גיגה-בייט. חייבים להוריד בנפרד את מודל הבסיס MiniMax-H3 ולטעון עליו את המתאם באמצעות סקריפט ההרצה.

מה ההבדל בין שני קובצי ה־safetensors שבמאגר?

קובץ אחד מיועד לגרסת FL2VA של המודל, והקובץ השני מיועד לגרסת Ref2VA. עליכם לטעון את הקובץ שמתאים בדיוק לתצורת המודל שבה אתם משתמשים בפרויקט שלכם.

איך מריצים

כדי להריץ אותם תצטרכו קודם כל את מודל הבסיס המלא של MiniMax-H3, מפני שהמשקלים כאן שוקלים כ־2.6 גיגה-בייט וכוללים רק את שכבות ה־LoRA. ההרצה דורשת סביבת פייתון עם diffusers בגרסה 0.40.0 ומעלה, ושימוש בקוד מתוך המאגר VideoX-Fun שמספק סקריפטים מוכנים בשם predict_t2v.py או predict_ref2v.py בהתאם לסוג המשימה.

מבחינת חומרה, כיוון שמדובר במודל וידאו כבד שרק מואץ, עדיין צריך מאיץ גרפי חזק מאוד עם נפח VRAM משמעותי כדי להחזיק את מודל הבסיס עצמו. אם אין לכם שרת ייעודי עם כרטיס מתאים, סביר להניח ששירות ענן או API חיצוני יהיו פתרון מעשי וזול יותר מהרמה של תשתית כזו מאפס.

pip install -U huggingface_hub
hf download alibaba-pai/MiniMax-H3-Acc-LoRAs

הרישיון

הרישיון של המאגר מסומן כ־other, מה שאומר שאין כאן רישיון קוד פתוח סטנדרטי ומוכר כמו MIT או Apache. תנאי השימוש הספציפיים, כולל השאלה האם מותר להשתמש במתאמים לצרכים מסחריים או להטמיע אותם במוצר, תלויים ברישיונות של MiniMax-H3 ושל פרויקט VideoX-Fun. מומלץ לבדוק את המסמכים במאגרים המקוריים לפני שמשלבים אותם בקוד ייצורי.

הרישיון המלא בעמוד המודל ↗