GPT
P

pianos

קוד פתוח

ccmusic-databasecc-by-nc-nd-4.02023-05-25

  • music
  • art

הקלטות אודיו ותמונות ספקטרוגרמה של פסנתרים ספציפיים לסיווג איכות צליל ודגמים. מתאים לחוקרי אודיו שמחפשים נתונים מתוייגים לפי יצרן וצליל מבודד.

  • 505הורדות בחודש
  • 52לייקים

מה זה

המאגר מכיל קובצי אודיו בפורמטים שונים ותמונות ספקטרוגרמה של שבעה עד שמונה דגמי פסנתרים, בהם ימאהה, קוואי, סטיינוויי, יאנג צ'אנג, שינגהאי ופרל ריבר. סטודנטים הקליטו צלילים מונופוניים של הפסנתרים, תיעדו את הדגמים וערכו סקר הערכה סובייקטיבי של איכות הצליל בהשתתפות 29 בעלי רקע מוזיקלי.

הנתונים מחולקים לשלושה תתי מאגרים. תת המאגר הבסיסי כולל שבעה דגמים בפורמט אודיו עם 580 דגימות בסך הכל. תת המאגר השני מוסיף הקלטות של פסנתר עומד מתוצרת ימאהה ומגיע ל־668 דגימות. תת המאגר השלישי נבנה לצורכי הערכה, ומכיל 18,352 מקטעי ספקטרוגרמת מל באורך 0.18 שניות שנחתכו מההקלטות.

מתאים ל

  • זיהוי יצרן ודגם פסנתר

    סיווג הקלטות צליל בודד בין שמונה מותגי פסנתרים שונים.

  • סיווג לפי ספקטרוגרמות

    אימון מודלים של ראייה ממוחשבת על תמונות מל קצרות של צלילי נגינה.

  • זיהוי גובה צליל

    בדיקת אלגוריתמים לזיהוי תווים מתוך הקלטות מונופוניות מבודדות.

איפה זה נופל

המאגר מוגבל לפסנתרים בלבד ומכיל חוסר איזון בכמויות הדגימות. בהקלטות של פסנתר סטיינוויי חסרים הקלידים השחורים, מה שפוגע בכיסוי המקלדת המלא. בנוסף, תת המאגר להערכה מבוסס על מקטעים קצרים מאוד של 0.18 שניות, שלא מתאימים למשימות שדורשות הקשר זמני ממושך.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

לא. הרישיון הוא cc-by-nc-nd-4.0, שאוסר מפורשות כל שימוש מסחרי. מותר להשתמש בו רק למטרות מחקר או למידה אישית.

האם המאגר כולל נתונים בעברית?

לא. המאגר מוגדר באנגלית, והוא מורכב כולו מהקלטות אודיו, תמונות ספקטרוגרמה ותוויות טכניות של דגמי פסנתרים.

מי הקליט ותייג את הנתונים בפועל?

הנתונים הוקלטו ותויגו על ידי סטודנטים ממוסדות CCMUSIC ו־CCOM. הציונים הסובייקטיביים נאספו מסקר שבו השתתפו 29 בעלי רקע מוזיקלי.

מה ההבדל בין שלושת חלקי המאגר?

הראשון מכיל 7 מותגים בלבד באודיו. השני מוסיף הקלטות של פסנתר ימאהה, והשלישי מפרק את האודיו ל־18,352 תמונות ספקטרוגרמה קצרות.

איך טוענים

טוענים את המאגר ישירות בספריית datasets דרך פייתון, ללא צורך בהרשאת גישה מיוחדת. צריך להגדיר את תת המאגר הרצוי מבין השלושה, default, 8_class או eval, ולבחור את החלוקה לאימון, ולידציה או בדיקה. הנתונים מגיעים בקובצי חץ ואודיו מקושר, והשדות העיקריים הם קובץ השמע או התמונה ותגית המותג.

from datasets import load_dataset

ds = load_dataset("ccmusic-database/pianos")

הרישיון

המאגר שוחרר ברישיון cc-by-nc-nd-4.0. המשמעות היא איסור מוחלט על שימוש מסחרי, חובת ייחוס ליוצרים, ואיסור על הפצת יצירות נגזרות. אי אפשר לשלב אותו במוצר מסחרי, ואימון מודל עליו מגביל את השימוש למחקר בלבד.

הרישיון המלא ב־Hugging Face ↗