GPT
H

humanoid-everyday

קוד פתוח

USC-PSI-Labapache-2.02025-10-08

מאגר נתוני רובוטיקה שמכיל הקלטות של מניפולציות מורכבות ברובוטים דמויי אדם. המטרה כאן היא למידה מוטורית רב-חושית בתרחישים יומיומיים מגוונים מבוססי הפעלה מרחוק.

  • 13,720הורדות בחודש
  • 51לייקים

מה זה

המאגר מרכז הקלטות של מעל 260 משימות שונות שמחולקות לשבע קטגוריות ראשיות. המשימות מכסות תחומים של מניפולציה עדינה, אינטראקציה בין אדם לרובוט ופעולות שמשלבות תנועה במרחב.

כל הנתונים הוקלטו באמצעות תהליך הפעלה מרחוק בפיקוח אנושי. ההקלטות כוללות רצפים של חיישנים שונים בקצב דגימה של 30 הרץ, ביניהם צילומי וידאו בצבע, נתוני עומק, סריקות ליידאר, מידע ממגעי מישוש וחיישני תנועה אינרציאליים.

המבנה הפנימי מחולק לאלפי קובצי פרקט לפי פרקי זמן שונים תחת תיקיות ייעודיות, כאשר כל פרק מתעד ביצוע של משימה ספציפית.

מתאים ל

  • אימון מדיניות מניפולציה

    למידת חיקוי לתנועות ידיים עדינות ומורכבות על בסיס הדגמות של מפעילים אנושיים.

  • אינטגרציית תנועה ומישוש

    פיתוח מודלים שמשלבים נתוני מגע מחיישני מישוש עם תנועת גוף שלמה במרחב.

  • היתוך חיישנים לרובוטיקה

    בניית מנגנוני תפיסה שמשלבים ליידאר, עומק ותמונה רגילה בקצב דגימה אחיד.

איפה זה נופל

הכרטיס לא מפרט באילו דגמי רובוטים בדיוק השתמשו או איך סיננו הקלטות שכשלו במהלך ההפעלה מרחוק, מה שמחייב בדיקה ידנית של איכות התנועות לפני אימון. המאגר מתמקד בפעולות יומיומיות מסוימות ולא בייצור תעשייתי, כך שהוא לא יתאים למשימות מפעל קשיחות. מעבר לזה, שפת הממשק והתיעוד היא אנגלית בלבד, וכל המידע מגיע מרובוטים שנשלטו על ידי מפעילים אנושיים, מה שמכניס הטיות של סגנון תנועה וזמני תגובה אנושיים.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט הזה במוצר מסחרי?

כן, הרישיון הוא אפאצ'י שתיים אפס, מה שמאפשר שימוש מסחרי חופשי ופיתוח מודלים סגורים. הדרישה העיקרית היא לכלול את הצהרת הזכויות והייחוס המקורי לקבוצת המחקר.

איזה סוג של מידע חיישני שמור בכל דגימה?

ההקלטות כוללות רצפי מולטימדיה בקצב שלושים הרץ, עם וידאו רגיל, עומק, ליידאר, חיישני מגע וחיישני תנועה. הכל נאסף במקביל בזמן שהמפעיל האנושי הדגים את המשימה.

באיזה פורמט הקבצים מגיעים ואיך פותחים אותם?

המידע מסודר בעשרות אלפי קובצי פרקט שמייצגים פרקי הדגמה שונים. הדרך המומלצת לעבוד איתם היא באמצעות חבילת lerobot הייעודית בפייתון, או דרך קוד טעינה ידני מהמאגר בגיטהאב.

האם יש פה תמיכה או רלוונטיות לשפה העברית?

אין שום רלוונטיות לשפה העברית. מדובר בדאטהסט תנועתי לחלוטין שמיועד לרובוטים, והתיעוד של שמות המשימות והקטגוריות כתוב באנגלית בלבד.

איך טוענים

טוענים את המידע ישירות באמצעות ספריית lerobot בגרסה שתיים דרך המחלקה LeRobotDataset, תוך הגדרת סבילות זמנים. הנתונים מאורגנים בעשרות אלפי קובצי פרקט שמחולקים לחלקים, ואין צורך באישור גישה מיוחד כדי להוריד אותם מהמאגר. אם רוצים לחקור את המשימות לפני שמורידים את כל הנפח, המפרסמים צירפו קישור לגיליון נתונים פומבי ולדאטה-לואדר ידני בגיטהאב.

from datasets import load_dataset

ds = load_dataset("USC-PSI-Lab/humanoid-everyday")

הרישיון

הרישיון הוא אפאצ'י שתיים אפס. מותר להשתמש בו לצרכים מסחריים ומחקריים, לשנות אותו ולשלב אותו במוצרים סגורים. התנאי המרכזי הוא שמירה על ייחוס ליוצרים והודעת הרישיון המקורית, בלי חובה לשחרר מודלים שאומנו עליו תחת אותו הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗