GPT
A

ABot-World-Explorer-500h

קוד פתוח

acvlabapache-2.02026-07-30

  • video
  • action-conditioned-video
  • world-model
  • colmap

המאגר מרכז 30,969 סרטוני וידאו עם פקודות מקלדת, מודלים של מצלמה ותיאורי טקסט. הוא מיועד למי שבונה מודלי עולם או מאמן מערכות חיזוי וידאו מותנות פעולה.

  • 28,899הורדות בחודש
  • 25לייקים

מה זה

כל רשומה מייצגת רצף וידאו בודד וכוללת קובץ וידאו בפורמט MP4 לצד ארכיון TAR בלתי דחוס שמכיל את נתוני התיוג. בתוך הארכיון יש קובץ פעולות עם פקודות מקלדת ושינויי מצלמה לפי פריימים, קובץ טקסט עם תיאורי נקודת מבט, סביבה ונרטיב, ומודל תלת ממדי דליל בפורמט טקסטואלי של COLMAP שכולל זוויות צילום ונקודות במרחב.

המקור מגיע מתשתית הנתונים של פרויקט ABot-World שפותח בקבוצת AMAP מבית עליבאבא. הנתונים לא מחולקים מראש לסט אימון, ולידציה ובדיקה, והמזהים של הסרטונים עברו אנונימיזציה באמצעות גיבוב מאובטח, יחד עם הסרת נתיבי מקור פרטיים מתוך התיאורים.

מתאים ל

  • אימון מודלי עולם

    לימוד מודלים שמנבאים את הפריים הבא בווידאו בהתבסס על פקודות מקלדת ושינויי זווית ראייה.

  • הערכת תנועת מצלמה

    בדיקת אלגוריתמים של שחזור תלת ממדי ותנועה במרחב בעזרת נתוני הכיול של COLMAP.

  • למידת ייצוגים לסוכנים

    אימון מודלי ראייה שמקשרים בין תיאורי סצנה טקסטואליים לבין רצפי פעולות של סוכן אוטונומי.

איפה זה נופל

היוצרים מבהירים במפורש שהשם 500h הוא רק מזהה ואינו התחייבות למשך שעות מדויק, ומספר הפריימים או קצב הדגימה אינם אחידים בין הרצפים. בנוסף, יחידות המידה של ההזזה ושל חותמות הזמן אינן מוגדרות מראש בסכמה, ויש מקטעים שבהם מערך התיאורים הזמניים ריק לחלוטין.

אין כאן הבטחה לייצוג גאוגרפי, פיזיקלי או דמוגרפי מאוזן, ואין שום תמיכה בעברית. הטקסטים באנגלית בלבד ועברו צנזורה נקודתית של שמות קבצים, כך שאי אפשר להסתמך עליו כסימולטור מלא לעולם האמיתי בלי לבדוק התאמה מראש.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, רישיון Apache 2.0 מאפשר שימוש מסחרי מלא, כולל אימון מודלים פנימיים והפצת מוצרים. הדרישה העיקרית היא הכללת עותק של הרישיון והודעות זכויות היוצרים בקוד או בתוכנה שמשתמשת בו.

האם יש במאגר נתונים בעברית?

לא. התיוגים, שמות השדות ותיאורי הסצנות כתובים כולם באנגלית בלבד. אם המודל שלכם דורש שפה טבעית בעברית, תצטרכו לתרגם את קובצי התיאורים בעצמכם.

איך נאספו הנתונים ומאיפה הם הגיעו?

הנתונים מגיעים מתשתית הנתונים של פרויקט ABot-World של קבוצת המחקר AMAP. פרטי המקור המדויקים, המיקומים בשרתים ושמות הקבצים המקוריים נמחקו או הוחלפו במזהי גיבוב אנונימיים לפני הפרסום.

האם יש חלוקה מובנית לסט אימון ובדיקה?

לא, הכרטיס מציין במפורש שאין חלוקה סמנטית לחלקים. כל מי שמאמן מודל על הנתונים יצטרך לבצע את החלוקה לאימון, ולידציה ובדיקה באופן ידני לפי המזהים.

איך טוענים

המאגר פתוח להורדה ישירה דרך huggingface_hub ללא צורך באישור גישה מיוחד. הוא מכיל 61,943 קבצים המאורגנים לפי מזהי דגימות אנונימיים, לצד קובץ metadata.jsonl שמרכז את הקישורים לקבצים.

במקום להוריד את כל המאגר בבת אחת, הקוד הרשמי ממליץ להשתמש ב־snapshot_download עם allow_patterns כדי למשוך סרטונים וארכיונים ספציפיים לפי הקידומת של המזהה. בעת חילוץ קובצי ה־TAR, חובה לבדוק את שמות הקבצים והנתיבים ולא לקרוא ישירות לחילוץ גורף.

from datasets import load_dataset

ds = load_dataset("acvlab/ABot-World-Explorer-500h")

הרישיון

המאגר מופץ תחת רישיון Apache 2.0 המאפשר שימוש מסחרי ומחקרי, שינוי והפצה, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. אין חובה לשתף מודלים שאומנו עליו תחת אותו הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗