GPT
M

MiniMax-Music3 — הדגמה

קוד פתוח

MiniMaxAIרישיון לא דווח2026-08-13

  • gradio

מפיקים שירים שלמים ממילים ומתיאור מובנה ישירות בדפדפן. הממשק פונה ליוצרים שרוצים לבדוק את מודל המוזיקה MiniMax-Music3 בלי להקים סביבת הרצה מקומית.

  • 2.4Bפרמטרים
  • 53.4 GBמשקל הקבצים
  • הורדות בחודש
  • 323לייקים

מה זה

אתם מזינים תיאור של השיר ומילים, או כותבים הוראות כלליות ונעזרים במודל DeepSeek-V4-Flash-0731 כדי לבנות את המילים ואת המאפיינים המבניים. הממשק כולל שני מצבים: מצב פשוט שבו מקלידים תיאור חופשי, ומצב סטודיו שבו מגדירים תגיות מבנה, סגנון כללי, פרטי שירה ועיבוד כלי. אם לא רוצים שירה, אפשר להגדיר קטע כלי בלבד.

מאחורי הקלעים רץ שילוב של מודל שפה של 8 מיליארד פרמטרים וצינור של diffusers עם קרנלים מסוג AoTI, שנועדו להאיץ את שלב הדגימה. הפלט מוזרם בחלקים ישירות לנגן ייעודי שנבנה ב־HTML, מה שמאפשר להתחיל להאזין עוד לפני שהקובץ המלא מסיים להיווצר. דוגמאות מובנות מתוך עמוד הפרויקט הרשמי זמינות בממשק עם אודיו ווידאו מוכנים מראש.

מתאים ל

  • הפקת שיר מלא מטקסט

    מזינים מילים עם תגיות מבנה ומקבלים קובץ אודיו מוזרם עם שירה ועיבוד מוזיקלי.

  • יצירת קטעים כליים

    מגדירים מצב ללא שירה ומפיקים ליווי מוזיקלי לפי פירוט כלי נגינה וז'אנר.

  • ניסוח מילים וסגנון בעזרת בינה

    מקלידים רעיון כללי בלבד ונותנים למודל שפה לייצר את חלוקת הבתים ואת הגדרות הצליל.

איפה זה נופל

מילים הן חובה, וכל תגית מבנה חייבת לשבת בשורה נפרדת. אם תחברו תיאור ארוך מדי, המערכת תיעצר בגלל חריגה מתקרת הטוקנים. לפעמים המודל מייצר אפס פריימים של אודיו, ואז נדרש להאריך את משך היצירה או לשנות את המילים. בנוסף, הדוגמאות המוצגות בעמוד מגיעות מקבצים שמורים מראש ולא משקפות את זמני ההמתנה האמיתיים של הרצה חיה.

שאלות
נפוצות

האם השימוש באפליקציה כרוך בתשלום?

האפליקציה פתוחה בדפדפן על גבי תשתית ZeroGPU. אין כאן מודל תשלום, אך ההרצה תלויה בהקצאת משאבים שיתופיים פנויים.

כמה זמן לוקח להפיק שיר?

ההפקה אינה מיידית, אך האודיו מוזרם בחלקים אל הנגן ברגע שמצטבר זיכרון מספיק. המהירות נקבעת לפי משך השיר, כמות הצעדים והעומס על המעבד הגרפי מסוג A10G.

במה הממשק הזה שונה מהמודל המקורי?

זהו ממשק גרפי שמחבר מודל שפה של DeepSeek לכתיבת הפרומפטים יחד עם מימוש diffusers וקרנלים מואצים. הוא חוסך כתיבת קוד ומאפשר להאזין ישירות ברשת.

האם אפשר להריץ את הכל באופן מקומי?

הקוד נשען על משקלי MiniMax-Music3, קרנלים מותאמים של AoTI וחבילת diffusers. כדי להריץ לבד צריך סביבת פייתון תואמת ומעבד גרפי מתאים לתמיכה בקבצים האלה.

איך מריצים

לוחצים על כפתור יצירת המילים והתיאור, או ממלאים את השדות ידנית ולוחצים על הפקה. האפליקציה רצה על חומרת zero-a10g, ומקצה משאבים לפי זמינות של ZeroGPU. תהליך ההפקה אורך זמן בהתאם לאורך השיר, למספר הצעדים ולזמן הזיכרון הזמני שהוגדר לפני תחילת ההשמעה. הסטטוס מציג כמה שניות של אודיו הופקו וכמה זמן עבר, ויש כפתור עצירה שמאפשר לשמור את מה שכבר הוזרם.

pip install -U huggingface_hub
hf download MiniMaxAI/MiniMax-Music3

הקבצים

88 קבצים במאגר, 53.4 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון של היישום אינו מדווח במאגר. במצב כזה אין הרשאה מפורשת לשימוש מסחרי בקוד או בפלטים, ולא מוגדר מה קורה עם זכויות היוצרים על הטקסטים שמוזנים או על קובצי האודיו שמופקים.

הרישיון המלא בעמוד המודל ↗