GPT
M

minimax-h3-fused-turbo-int8-convrot

קוד פתוח

MATLOWAIother2026-08-29

  • diffusion-single-file
  • minimax-h3
  • comfyui
  • int8
  • convrot

הורדת משקלים מוכנה ל־ComfyUI שדוחסת יצירת וידאו עם קול לארבעה צעדים. במקום לטעון שני מתאמים בנפרד ולבזבז זיכרון, הכול מוזג מראש לקובץ בודד שמכיל גם תמונת ייחוס.

  • 19.6 GBמשקל הקבצים
  • 120,472הורדות בחודש
  • 146לייקים

מה זה

הקובץ מאחד מודל בסיס של MiniMax-H3 עם מודל דילול מסוג טורבו ושכבת החלקה לתנועה, כולם מכווצים לדיוק של שמונה ביט. השילוב חוסך את הצורך בטעינה חיה של מתאמים, מה שמונע שכפול של משקלים בזיכרון. המדידות מראות שהרצה בארבעה צעדים מייצרת וידאו באורך עשר שניות ובגודל 1152 על 640 ב־76 שניות על חומרה חזקה, בעוד שהוספת צעדים עד 25 רק מחדדת קלות את התמונה בלי לשנות את האודיו.

ההבדל המשמעותי מול משקלים רגילים הוא התמיכה המובנית גם ביצירה מטקסט וגם ביצירה מתמונת מקור באותו קובץ. אין צורך להחליף מודלים באמצע כדי לשמור על עקביות של דמות, והקובץ כולל בתוכו את ההתאמות לחישובי קשב דלילים שמאיצים את העבודה ומשפרים את איכות הצליל.

מתאים ל

  • הנפשת דמויות מתמונה

    המודל כולל מנגנון ייחוס מובנה, כך שאפשר להזין איור ולהפיק ממנו סרטון של עשר שניות ששומר על מראה הדמות המקורית.

  • יצירת וידאו מהירה עם קול

    ארבעה צעדי דילול מייצרים תוצאה שלמה כולל רצועת שמע תואמת בדקה אחת, בלי צורך במודל נפרד לפס הקול.

  • עבודה מקומית בזיכרון נמוך

    משקלי שמונה ביט שמוזגו מראש מאפשרים להריץ את המערכת על כרטיסי 16 גיגה בלי לחרוג מהזיכרון בגלל שכפול שכבות.

איפה זה נופל

המיזוג הקבוע של המשקלים נועל אתכם עם רמות ההשפעה שנבחרו, ואי אפשר להחליש את שכבת הטורבו או את מודל ההחלקה בלי לחזור להרכבה ידנית. מעבר לזה, בשימוש במתאמי תנועה מתקדמים לשלב השני יש נטייה לאבד את הסגנון הציורי לטובת מראה ריאליסטי יותר, ובמקרים מסוימים המודל משכפל דמויות במסגרת במקום להשאיר אותן יציבות. שימוש בחישוב קשב מלא ולא דליל יפגע באיכות של פס הקול ויגרום לו להישמע עמום.

שאלות
נפוצות

האם כדאי להעלות את מספר הצעדים כדי לקבל איכות טובה יותר?

הבדיקות מראות שעלייה מעבר לארבעה צעדים מוסיפה מעט מאוד חדות לקווים ולא משנה את איכות הקול בכלל. ריצה של 25 צעדים לוקחת כמעט פי ארבעה זמן, והדרך הנכונה לשפר תוצאה היא הרצה דו-שלבית של ארבעה צעדים בכל שלב.

למה לא לקחת את המודל המקורי ולחבר אליו את התוספים בעצמי?

חיבור חי של המתאמים בתוך ComfyUI דורש שמירת עותק נקי של כל השכבות בזיכרון, מה שמקפיץ את השימוש ב־21 גיגה נוספים. הקובץ הממוזג חוסך את העומס הזה ומגיע כבר מכווץ כולו.

איך מריצים

טוענים את הקובץ ישירות ב־ComfyUI דרך צומת טעינה רגיל, בלי תוספי טעינה מיוחדים. כדי לייצר סרטון מלא צריך לחבר גם מקודד טקסט ומקודדי תמונה וקול תואמים. כרטיס עם 16 גיגה זיכרון וידאו מריץ את התהליך אם נותנים למערכת להעביר נתונים לזיכרון הראשי, ובמצב כזה תהליך של ארבעה צעדים לוקח כדקה. יש גם תמיכה ישירה בכרטיסי מסך של AMD דרך גרסה ייעודית.

אם אין לכם כרטיס עם מספיק זיכרון או שאתם לא רוצים להמתין דקה לכל קליפ קצר, פנייה לשרת מרוחק עדיפה. היתרון בהרצה מקומית מגיע כשרוצים שליטה מלאה בצינור העבודה ובעיבוד התנועה.

pip install -U huggingface_hub
hf download MATLOWAI/minimax-h3-fused-turbo-int8-convrot

הקבצים

42 קבצים במאגר, 19.6 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון מוגדר כקהילתי של MiniMax יחד עם רישיון אפאצ'י על רכיב הטורבו, ויש הגבלות טריטוריאליות שצריך לבדוק במסמך המצורף. אם אתם מתכננים להפיץ מוצר מסחרי סגור, המבנה המשפטי המעורב מחייב בדיקה של תנאי השימוש כדי לוודא שאין חריגה מההרשאות.

הרישיון המלא בעמוד המודל ↗