GPT
2

2025-challenge-demos

קוד פתוח

behavior-1kmit2025-08-22

  • LeRobot
  • v
  • 2
  • .
  • 1

המאגר כולל הדגמות של פעולות רובוטיקה מגוונות מתוך פרויקט בנצ'מרק של מטלות יומיומיות. הוא מיועד למי שמפתח ומאמן מודלים של בינה מלאכותית פיזית ורובוטיקה בסביבות מורכבות.

  • 126,598הורדות בחודש
  • 36לייקים

מה זה

המאגר מכיל קרוב למאה אלף קבצים שמחולקים לפי משימות ופרקי הדגמה, שנוצרו במקור כחלק מאתגר של שנת 2025 סביב הבנצ'מרק של פרויקט BEHAVIOR-1K. הנתונים מתועדים במבנה של תיקיות משימות, כאשר כל פרק פעולה מלווה בקובץ אנוטציה בפורמט JSON.

המבנה נוצר באמצעות התשתית של LeRobot, והוא מתעד הדגמות התנהגות מתוך מאמץ המחקר שמכסה אלף פעילויות יומיומיות בסימולציה מציאותית וממוקדת אדם. כרטיס המאגר עצמו דל בפרטים נוספים לגבי שלבי הסינון המדויקים, אך המבנה הכללי בנוי סביב קובצי מטא-דאטה והקלטות פרטניות לכל משימה.

מתאים ל

  • אימון מודלי חיקוי רובוטיים

    לימוד מדיניות פעולה באמצעות הדגמות של מטלות יומיומיות מתוך קובצי הפרקים השונים.

  • הערכת ביצועים באתגר 2025

    בדיקת יכולות של סוכנים אוטונומיים על משימות סטנדרטיות מתוך פרויקט BEHAVIOR-1K.

  • פיתוח עם תשתית LeRobot

    הזנת נתוני הדגמות מתועדים לתהליכי עבודה המבוססים על כלי הרובוטיקה של Hugging Face.

איפה זה נופל

כרטיס הנתונים כמעט ריק ואינו מפרט הטיות, אופן איסוף ישיר של ההדגמות או תהליך הניקוי שעברו הקבצים. המקור הוא סימולציה של פעולות יומיומיות, כך שכל יישום מחוץ לסימולטור דורש בדיקת התאמה קפדנית לפער בין סימולציה לעולם האמיתי. אין כאן נתונים בעברית או התייחסות למאפיינים שפתיים כלשהם, והדגש הוא בלעדית על פעולות רובוטיות.

שאלות
נפוצות

האם מותר להשתמש במאגר לפרויקט מסחרי?

כן, המאגר מפורסם תחת רישיון MIT. הרישיון הזה מתיר שימוש מסחרי חופשי, כולל אימון מודלים פנימיים או מוצרים סגורים, כל עוד שומרים על תנאי הייחוס הבסיסיים של הרישיון.

האם יש במאגר טקסטים או תמיכה בעברית?

לא, המאגר כולו מתמקד במשימות רובוטיקה ובאנוטציות טכניות של פרקי תנועה והדגמה. אין בו תוכן טקסטואלי רחב, ואין בו שום התאמה ייעודית לשפה העברית.

מה הפורמט שבו הנתונים מגיעים?

הנתונים מגיעים במבנה תיקיות של ספריות קוד פתוח כמו LeRobot, ומכילים 99,345 קבצים. האנוטציות עצמן נשמרות בקובצי JSON נפרדים לכל פרק של משימה.

איך טוענים

טוענים את הקבצים ישירות מסביבת Hugging Face או באמצעות הכלים הייעודיים של ספריית LeRobot. המאגר פתוח לציבור ואינו דורש אישור גישה מיוחד. כדי לעבוד איתו בצורה יעילה תצטרכו להוריד ולנתח עשרות אלפי קובצי JSON קטנים בתיקיית האנוטציות, לצד בדיקת קובץ המטא-דאטה הראשי שמגדיר את מבנה הנתונים.

from datasets import load_dataset

ds = load_dataset("behavior-1k/2025-challenge-demos")

הרישיון

הרישיון המדווח הוא MIT, וזה נותן חופש פעולה רחב מאוד. אפשר להשתמש בנתונים לפיתוח מסחרי, לשנות אותם ולאמן עליהם מודלים ללא צורך בשיתוף הנגזרות באותו רישיון. החובה היחידה היא לשמור על הודעת זכויות היוצרים והרישיון המקורי בקוד או בהפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא ב־Hugging Face ↗