GPT
E

EO-Data1.5M

קוד פתוח

IPEC-COMMUNITYapache-2.02025-08-28

  • robotics
  • embodied-ai
  • multimodal
  • robot-learning
  • vision-language-action

מאגר ענק לרובוטיקה שמשלב תמונות, טקסט ורצפי פעולות של זרועות. הוא נועד למי שרוצה לאמן מודלים שגם מבינים הוראות וגם יודעים להזיז מפרקים בעולם האמיתי.

  • 11,735הורדות בחודש
  • 24לייקים

מה זה

המאגר מורכב ממיליוני רשומות שמחברות בין שיחה, תצפיות ויזואליות ופקודות הפעלה פיזיות. כל שורה מכילה מזהה מקור, היסטוריית שיחה מרובת תורות, תמונות מזווית אחת או כמה זוויות, וקטורי מצב ורצפי פעולה רציפים של הרובוט. המידע מחולק למשימות שונות כמו שיחה חופשית, חיזוי מסלולים, הצבעה על נקודות וזיהוי אובייקטים במרחב.

הבסיס נאסף מתוך 2.1 מיליון פרקים מפרויקטים קיימים כמו AgiBot-World, Open X-Embodiment ו־RoboMIND, שכוללים פלטפורמות רובוטיות מגוונות כגון Franka, WidowX ו־AgiBot. תהליך הסינון והעיבוד עבר ארבעה שלבים: סינון וידאו, תיוג משולב של בני אדם ומודלי ראייה-שפה, יצירת שאלות ותשובות, ובקרה על איכות התוצרים הסופיים.

מתאים ל

  • אימון מדיניות לרובוטים

    חיזוי ישיר של פעולות מפרקים ותנועה מתוך תמונות מצלמה והוראות הפעלה.

  • מענה חזותי לשאלות במרחב

    אימון מודלים להבנת מסלולים, זיהוי חפצים ופתרון שאלות על מיקום אובייקטים.

  • הסקה רב-שלבית לזרוע רובוטית

    פירוק משימות מורכבות בעולם האמיתי לצעדי פעולה עוקבים.

איפה זה נופל

הטקסט כולו באנגלית בלבד, ואין כאן שום תמיכה בהוראות בעברית ללא תרגום מקדים. חלק ניכר מהתיוגים נוצר על ידי מודלי ראייה-שפה ולא על ידי אדם, מה שעלול להכניס הזיות וטעויות בזיהוי מרחבי. בנוסף, הנתונים מתאימים לפלטפורמות רובוטיות ספציפיות כמו זרועות תעשייתיות, ואם החומרה שלכם שונה משמעותית תצטרכו לבצע התאמות כבדות במרחב הפעולות לפני שזה יעבוד.

שאלות
נפוצות

מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, המאגר מופץ תחת רישיון Apache 2.0 שמאפשר שימוש מסחרי חופשי, כולל אימון מודלים קנייניים. הדרישה העיקרית היא שמירה על הודעות זכויות היוצרים והרישיון המקורי.

האם יש במאגר הוראות בעברית?

לא, כל הטקסטים ושיחות השאלות והתשובות מופיעים באנגלית בלבד. אם המערכת שלכם צריכה לעבוד בעברית, תצטרכו לתרגם את השיחות או להוסיף שכבת התאמה לשפה.

איך המידע הזה נאסף?

הנתונים מבוססים על מעל 2 מיליון פרקי תנועה מפרויקטים כמו Open X-Embodiment ו־AgiBot. החוקרים סיננו את הסרטונים, ייצרו תיוגים משולבים בעזרת מודלי שפה-ראייה ובני אדם, ובנו מהם סטים של שאלות ופעולות.

מה מייחד אותו ממאגרי רובוטיקה רגילים?

במקום להחזיק רק הדגמות תנועה גולמיות, הוא שוזר יחד תמונות מכמה זוויות, שיחה טקסטואלית ורצפי פעולות רציפים. המבנה הזה מכוון ישירות לאימון מודלי בסיס שמשלבים הסקה שפתית עם ביצוע פיזי.

איך טוענים

המאגר מפוצל ל־1,248 קבצי parquet, כך שאין צורך להוריד הכל בבת אחת. טוענים קבצים ספציפיים ישירות באמצעות ספריית datasets של Hugging Face תוך ציון הנתיב לקובץ המבוקש. אין צורך לבקש אישור גישה מיוחד, המאגר פתוח להורדה מיידית. בזמן העבודה כדאי לשים לב לשדות התמונה שמגיעים כבתים או כרשימת תמונות, ולמערכי הפעולות שדורשים התאמה למבנה הקלט של בקר הרובוט שלכם.

from datasets import load_dataset

ds = load_dataset("IPEC-COMMUNITY/EO-Data1.5M")

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש במידע למטרות מסחריות, לשנות אותו, ולאמן עליו מודלים סגורים בלי חובה לחשוף את הקוד שלכם. חובה לתת קרדיט ליוצרים המקוריים ולצרף עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗