GPT
M

MiniMax-H3-Prompt-Rewriter-LoRA

קוד פתוח

lightx2vרישיון לא דווח2026-08-07

  • peft
  • safetensors
  • lora
  • prompt-rewriting
  • minimax-h3

מתאם משקל קל שלוקח פרומפט פשוט ובונה ממנו הוראות הפקה מפורטות לסרטון עם סאונד עבור MiniMax-H3. הוא חוסך תלות בשירות הענן של MiniMax כשרוצים להריץ הכול מקומית.

  • 3.5 GBמשקל הקבצים
  • 695הורדות בחודש
  • 182לייקים

מה זה

מדובר במתאם LoRA ששוקל 3.5 גיגה ומיועד להרצה מעל מודל השפה Qwen3.6-27B. המטרה שלו ממוקדת לגמרי, הוא לא יוצר וידאו בעצמו, אלא מקבל טקסט קצר יחד עם משך ויחס תצוגה, ופולט תיאור מובנה שמפרק את הסצנה לצילומים, תנועות מצלמה, סאונד דיאגטי ופסקול רקע שמתאימים בדיוק למנוע הווידאו והאודיו של MiniMax-H3.

במקום לקרוא לשירות Context-IR הסגור של MiniMax, המתאם הזה מנסה לחקות את אותה הרחבה מקומית. הוא לא מספק בדיקות מדידה מספריות אלא מציג השוואות איכותיות מול פרומפט גולמי ומול מודל הבסיס ללא המתאם. לפי הדוגמאות, ההבדל העיקרי הוא פירוט טכני של זוויות צילום וסנכרון רעשי רקע, שבלעדיהם מודל הווידאו מייצר לעיתים תוצאה שטוחה או סטטית.

מתאים ל

  • פייפליין מקומי ל־T2VA

    הרחבת פרומפטים קצרים להוראות בימוי מפורטות ללא תלות ברשת חיצונית.

  • הפקת סאונד מתוזמן לווידאו

    יצירת הגדרות מדויקות לרעשי רקע ומוזיקה שמותאמים לקאטים בסרטון.

  • אוטומציה ל־LightX2V

    שילוב ישיר כשלב ראשון לפני רינדור מבוזר של וידאו מקומי.

איפה זה נופל

המתאם עובד כרגע רק על טקסט לווידאו ואודיו. הוא לא מקבל תמונות, סרטוני רפרנס או דגימות קול, כך שאי אפשר להשתמש בו ליצירה המבוססת על פריים ראשון או אחרון. החיסרון המרכזי שמופיע בדף הוא נטייה להמציא פרטים שלא היו בבקשה המקורית. כשצריך דמויות ספציפיות, תסריט מדויק או דיאלוגים מוגדרים, הוא עלול לשנות את הכוונה וחייבים לבדוק ידנית את הפלט שלו לפני ששולחים אותו לרינדור.

אותה משפחה

MiniMax-H3-Prompt-Rewriter-LoRA יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה יוצר בעצמו קובץ וידאו?

לא. זהו מתאם טקסט בלבד שרץ על מודל שפה ומחזיר מחרוזת טקסט מובנית. כדי לקבל וידאו וקול, צריך להזין את הטקסט שהוא פולט לתוך מודל הווידאו MiniMax-H3 באמצעות כלי הרצה נפרד.

האם אפשר להשתמש בו לשכתוב בעברית?

כרטיס המודל מציין תמיכה באנגלית בלבד. פקודות בשפות אחרות לא נבדקו וסביר להניח שלא יניבו את התחביר המובנה שמנוע הווידאו מצפה לקבל.

מה צריך כדי להריץ את המתאם הזה מקומית?

צריך סביבה שיכולה להחזיק את מודל הבסיס Qwen3.6-27B בזיכרון, יחד עם חבילת peft והמשקלים של המתאם עצמו שמוסיפים כ־3.5 גיגה. להרצת שרשרת ההפקה המלאה תידרש חומרה חזקה בהרבה כדי לטעון גם את מודל הווידאו.

איך מריצים

כדי להריץ את המתאם צריך להוריד את מודל הבסיס Qwen3.6-27B, מה שדורש זיכרון וידאו משמעותי של עשרות גיגה רק עבור שלב שכתוב הטקסט, עוד לפני שנוגעים במודל הווידאו עצמו. המערכת משתמשת בספריית peft ומאפשרת חלוקה של המשקלים על כמה כרטיסים בעזרת חלוקה אוטומטית, עם אפשרות לפענוח דטרמיניסטי או דגימה רגילה.

אחרי שהטקסט מוכן, צריך להעביר אותו לכלי כמו LightX2V יחד עם משקלי הווידאו הרשמיים כדי לייצר את קובץ ה־MP4. אם אין לכם שרת ייעודי חזק מאוד עם מספר כרטיסי מסך, החזקה של מודל שפה בגודל 27B רק בשביל שכתוב פרומפטים היא בזבוז משאבים מוחלט, ועדיף להשתמש ב־API קיים לשלב הטקסט.

pip install -U huggingface_hub
hf download lightx2v/MiniMax-H3-Prompt-Rewriter-LoRA

הקבצים

7 קבצים במאגר, 3.5 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

היוצרים לא ציינו רישיון עבור המתאם הזה. המשמעות היא שאין הרשאה מפורשת לשימוש מסחרי, הפצה או שילוב שלו במוצר, וכל שימוש כזה כרוך בסיכון משפטי עד שהמפתח יבהיר את התנאים. בנוסף, שימוש במודל הווידאו הסופי כפוף לרישיון הנפרד של MiniMax-H3.

הרישיון המלא בעמוד המודל ↗