GPT
L

lofi

קוד פתוח

vikhyatkcc-by-nc-4.02024-07-27

מעל 7,000 שעות של מוזיקת לופיי סינתטית שנוצרה באמצעות בינה מלאכותית. המאגר מיועד למי שמחפש אודיו מגוון בסגנון אחיד לאימון מודלים של יצירה או ניתוח מוזיקה.

  • 3,441הורדות בחודש
  • 86לייקים

מה זה

המאגר מכיל קטעי אודיו של מוזיקת לופיי שנוצרו על ידי המודל MusicGen Large של פייסבוק. הטקסטים שהניעו את יצירת המוזיקה הופקו באמצעות מודל השפה Llama 3.1 8B Base, מתוך תהליך שהתחיל בקבוצה ראשונית של 1,960 פרומפטים שנכתבו ידנית. מתוכם נדגמו באקראי 16 פרומפטים בכל פעם במתכונת few-shot כדי לייצר מגוון רחב יותר של תיאורים מוזיקליים.

כל התוכן כאן הוא סינתטי לחלוטין, מהפרומפטים ועד קובצי האודיו הסופיים. המאגר מחולק לקובצי parquet רבים תחת תיקיית data, אך כרטיס הדאטהסט אינו מפרט חלוקה מובנית לסט אימון, בדיקה או וולידציה, ולא מדווח על שלבי סינון או בקרת איכות שבוצעו על הפלטים.

מתאים ל

  • אימון מודלי יצירת מוזיקה

    הזנת שעות רבות של אודיו מוגדר כדי ללמד מודלים קטנים לייצר מוזיקת רקע.

  • מחקר על דאטה סינתטי

    בדיקת ההשפעה של אימון מודל שמע על פלטים של מודל שמע אחר.

  • הערכת צימוד טקסט לשמע

    בחינת ההתאמה בין תיאורי פרומפטים מורכבים לבין קטעי השמע שנוצרו בפועל.

איפה זה נופל

הנתונים כולם נוצרו על ידי מודלים אחרים, מה שאומר שהמאגר יורש את כל המגבלות והעיוותים של MusicGen ושל לאמה. אין כאן נגינה אנושית או הקלטות אמיתיות, והסגנון מוגבל אך ורק ללופיי. בנוסף, חסר מידע בסיסי על אורך כל קטע, קצב הדגימה, אופן הסינון של תוצרים פגומים, או אם הפרומפטים כוללים שפות מעבר לאנגלית.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

לא. הרישיון הוא cc-by-nc-4.0, שאינו מתיר שימוש מסחרי מכל סוג. כל שימוש מוגבל למחקר, הדגמות ופיתוח פנימי שאינו מיועד למכירה.

האם יש במאגר שירים או פרומפטים בעברית?

הכרטיס אינו מזכיר עברית כלל. הפרומפטים נוצרו באמצעות לאמה על בסיס סט פרומפטים מקורי באנגלית, והמוזיקה היא כלית בסגנון לופיי ללא מילים.

איך נוצרו הנתונים בדאטהסט?

היוצר לקח 1,960 פרומפטים ידניים, דגם מהם 16 בכל פעם, והשתמש ב־Llama 3.1 8B כדי להפיק פרומפטים מגוונים. לאחר מכן הזין את הפרומפטים לתוך MusicGen Large לייצור מעל 7,000 שעות מוזיקה.

כמה קבצים יש במאגר ואיך הם נראים?

המאגר כולל 1,032 קבצים, רובם המוחלט קובצי parquet תחת השם dynamic-prompts שמכילים את המידע והאודיו. אין צורך באישור מיוחד כדי להוריד אותם.

איך טוענים

טוענים את הנתונים ישירות דרך ספריית datasets באמצעות המזהה vikhyatk/lofi. הגישה למאגר פתוחה לחלוטין ואינה דורשת אישור מוקדם. הנתונים מאוחסנים בפורמט parquet ומפוצלים ל־1,032 קבצים שונים. לפני שמתחילים להוריד כדאי להכין נפח אחסון משמעותי, שכן מדובר באלפי שעות אודיו. השדות העיקריים שמעניינים אתכם הם קטעי השמע והפרומפטים ששימשו ליצירתם.

from datasets import load_dataset

ds = load_dataset("vikhyatk/lofi")

הרישיון

המאגר מופץ תחת רישיון cc-by-nc-4.0. המשמעות ברורה: אסור להשתמש בנתונים למטרות מסחריות כלשהן, וחובה לתת קרדיט ליוצר. מודל שתאמנו על הדאטהסט הזה לא יוכל לשמש במוצר מסחרי. היוצר הוסיף גם סעיף היתולי על מערכת הכוכבים פליאדות, אבל התנאי המחייב חוקית הוא הגבלת השימוש הלא-מסחרי.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא ב־Hugging Face ↗