GPT
S

suno-ai-music-dataset

קוד פתוח

Kukedlccc-by-4.02026-05-24

  • music
  • audio
  • ai-generated
  • suno
  • music-generation

המאגר כולל קטעי אודיו מסוננים שנוצרו במודל המוזיקה סונו לצד פרומפטים מפורטים ומטא-דאטה עשיר. הוא פונה למי שחוקר סיווג סגנונות עמוק או בוחן הצמדת טקסט לצליל.

  • 2,583הורדות בחודש
  • 29לייקים

מה זה

האוסף מכיל בין 200 ל־300 רצועות שנוצרו באמצעות מודל Suno V5.5 בחשבון בתשלום במהלך מאי 2026. כל רשומה כוללת קובץ אודיו בפורמט MP3, תמונת עטיפה, את הפרומפט המדויק ששימש ליצירה, וטבלת נתונים עם 32 עמודות שמפרטות סולמות, קצב, תגיות מצב רוח והקשר שידור.

התוכן נבנה לפי חלוקה מוגדרת מראש, כשבעים אחוז ממנו מתמקד בתתי-ז'אנרים מורכבים כמו פסייטרנס פרוגרסיבי, ניאו סול, וג'אז פיוז'ן, ושלושים האחוזים הנותרים מכסים סגנונות מסחריים כמו אמפיאנו, קורידוס טומבאדוס ופופ. החלוקה ההיררכית מכסה עשרה ז'אנרים מרכזיים ומעל מאה תתי-סגנונות, כאשר מוזיקה אלקטרונית תופסת את הנפח הגדול ביותר.

מתאים ל

  • אימון מסווגי סגנונות

    חלוקה להיררכיה של מעל מאה תתי-סגנונות מאפשרת לבחון סיווג אודיו עדין ומדויק.

  • הערכת מודלי טקסט לסאונד

    בדיקת מידת ההתאמה בין טקסט ארוך ומורכב לבין התוצר המוזיקלי שהתקבל בפועל.

  • ניסויי המלצות מוזיקה

    שימוש בעמודת תחנת היעד כדי להעריך התאמת שירים להקשרי האזנה קבועים מראש.

איפה זה נופל

ההטיה הכי בולטת נובעת מהמגבלות של סונו עצמו. המודל מתקבע כמעט תמיד על מקצב של ארבעה רבעים, כך שאין כאן משקלים מורכבים אמיתיים כמו שבע שמיניות גם כשהפרומפט דרש זאת במפורש. בנוסף, ההרמוניה נשארת בתוך סולמות מערביים מקובלים, אין ערוצי אודיו נפרדים אלא רק מיקס סופי, והשירים מתכנסים סביב אורך של שתי דקות. השירה מוגבלת בעיקר לאנגלית, ואין פה תוכן בעברית כלל. ייצוג הסגנונות החוץ-מערביים סובל מרידוד, מה שהאוצר עצמו מסמן באמצעות עמודת דירוג היכולת.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט הזה למוצר מסחרי?

כן, רישיון CC-BY-4.0 מתיר שימוש מסחרי מלא, כולל אימון מודלים ופיתוח נגזרות. התנאי היחיד הוא מתן קרדיט ליוצר הדאטהסט והצהרה ברורה שמדובר בתוכן שנוצר באמצעות בינה מלאכותית.

האם יש במאגר שירים או מילים בעברית?

לא, המאגר מוגדר באנגלית בלבד. חלק מהקטעים קוליים ובחלקם יש נגיעות של ספרדית, אך אין בו שום תוכן קולי או טקסטואלי בעברית.

כמה שוקל הדאטהסט ואיך הוא בנוי?

המאגר קטן יחסית ומכיל בין מאתיים לשלוש מאות רצועות אודיו, סך הכל 1,714 קבצים כולל תמונות העטיפה. כל קובצי האודיו נשמרים כ־MP3 מקושרים לקובץ CSV יחיד שמחזיק את כל המטא-דאטה.

במה הוא שונה מסתם גירוד של קטעים אקראיים מסונו?

המאגר אינו שליפה עיוורת אלא סינון ידני עם חלוקה מחושבת בין סגנונות איכות מורכבים ללהיטים מסחריים. כל קטע כולל תיוג מדויק של שבעים ושלושים אחוז לפי עומק מוזיקלי ודירוג של איכות הביצוע של המודל.

איך טוענים

טוענים את המאגר ישירות דרך ספריית הדאטהסטס ללא צורך באישור גישה ידני. כל המידע המבני מרוכז בקובץ CSV יחיד בשם biblioteca_master שמקושר לקובצי ה־MP3 דרך מזהה UUID. המאגר עצמו קטן בהיקפו, פחות מאלף רשומות, כך שהוא יורד במהירות ואינו דורש נפח אחסון חריג. השדות המרכזיים לעבודה הם הפרומפטים המקוריים, שיוך הז'אנר בשלוש רמות היררכיה, ודירוגי היכולת שהוצמדו לכל סגנון.

from datasets import load_dataset

ds = load_dataset("Kukedlc/suno-ai-music-dataset")

הרישיון

המאגר מופץ תחת רישיון CC-BY-4.0 שמתיר שימוש מסחרי, שינוי ואימון מודלים, בתנאי שמעניקים קרדיט מתאים ליוצר. בנוסף נדרש גילוי נאות על כך שהחומרים נוצרו בבינה מלאכותית, ואסור להשתמש בנתונים כדי לחקות אמנים ספציפיים.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗