GPT
M

medical-prescription-english-audio

קוד פתוח

HumynLabscc-by-4.02025-07-28

  • speech
  • emotional-speech
  • audio-recognition
  • ai-research
  • voice-analysis

המאגר מכיל הקלטות קול של דוברים באנגלית שמקריאים טקסט יחיד של ביקור אצל רופא. הוא מיועד לבדיקות של זיהוי דיבור במבטא הודי וניתוח רגש בקול.

  • 156הורדות בחודש
  • 716לייקים

מה זה

המאגר כולו מבוסס על תסריט קבוע אחד באנגלית. כל המשתתפים מקריאים בדיוק את אותן חמש שורות, שבהן מטופל מתאר לרופא כאבי מפרקים, עייפות בבקרים ובקשה לעדכן את המרשם הקודם. אין כאן שיחות טבעיות או דיאלוגים מורכבים, אלא הקראה מובנית של אותו טקסט רפואי על ידי אנשים שונים.

המבנה של המאגר זעיר ומכיל 23 קבצי שמע בפורמט WAV בלבד, המיוחסים לשמות הדוברים כמו Moklasur Rahman או Adam Tariq. לפי הכרטיס, הרשומות נועדו לייצג דוברי אנגלית במבטא הודי עבור משימות סיווג קולי, זיהוי דיבור ומחקר של מחשוב רגשי, אך הכרטיס אינו מפרט תהליך סינון, ציוד הקלטה או חלוקה לסטים של אימון ומבחן.

מתאים ל

  • בדיקת זיהוי דיבור במבטא

    הערכת ביצועים בסיסית של מודלי ASR על אנגלית במבטא הודי לפי טקסט קבוע מראש.

  • זיהוי טון רגשי בקול

    אימון ובדיקה ראשונית של אלגוריתמים לסיווג רגשות ומצוקה לפי אינטונציה של הקראה.

  • מחקר ראשוני במחשוב רגשי

    ניסויי מעבדה בסיסיים בתחום affective computing לפני מעבר למאגרי מידע מקיפים.

איפה זה נופל

זהו מאגר זעיר של פחות מאלף רשומות, עם 23 קבצים בלבד שכולם מקריאים את אותו המשפט בדיוק. המפרסמים מציינים במפורש שהוא לא מייצג את המגוון הלשוני והרגשי של הודו, ואינו מתאים למערכות בזמן אמת, לסביבות ייצור או לשימוש קליני ואבחוני. אין כאן עברית כלל וההגדרות של רגשות הן סובייקטיביות.

שאלות
נפוצות

האם מותר להשתמש במאגר לפרויקט מסחרי?

כן, הרישיון הוא cc-by-4.0 שמתיר שימוש מסחרי. עם זאת, חובה לתת קרדיט ברור ליוצרים. בנוסף, הכרטיס מציין שהמאגר אינו מיועד למערכות ייצור ולשימוש קליני.

כמה שוקל הדאטהסט והאם ההורדה כבדה?

המאגר קטן מאוד ומכיל 23 קבצי WAV בודדים. אין שום עומס בהורדה והיא מתבצעת כמעט מיידית. הוא מתאים לבדיקות מהירות במחשב מקומי.

האם יש במאגר נתונים בעברית?

לא, המאגר כולל אך ורק אנגלית המוקראת במבטא הודי. אין בו מילים בעברית או תרגום לשפות אחרות. הוא לא יסייע בפיתוח מודלים לשפה המקומית.

איך הדאטהסט נאסף בפועל?

היוצרים נתנו למשתתפים להקריא קטע טקסט יחיד של תלונה רפואית. שמות הקבצים כוללים את שמות המקריאים. הכרטיס לא מציין פרטים טכניים נוספים על אופן ההקלטה או הסינון.

איך טוענים

טוענים את הקבצים ישירות דרך האגינג פייס בעזרת ספריית datasets או על ידי הורדה של 23 קבצי ה־WAV מהמאגר. אין צורך בבקשת אישור גישה מיוחדת והגישה פתוחה. כיוון שמדובר בכמות אפסית של קבצים ההורדה מסתיימת בשניות, וכל קובץ מייצג הקלטה עם שם הדובר בכותרת הקובץ.

from datasets import load_dataset

ds = load_dataset("HumynLabs/medical-prescription-english-audio")

הרישיון

המאגר מופץ תחת רישיון cc-by-4.0. הרישיון מתיר שימוש חופשי כולל שימוש מסחרי, שינוי ושיתוף, בתנאי שנותנים קרדיט מתאים ליוצרים. אין חובת שיתוף תחת אותו רישיון, ומודל שאומן עליו מותר לשימוש כל עוד מקפידים על הייחוס הנדרש.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗