GPT
M

MathVista

קוד פתוח

AI4Mathcc-by-sa-4.02023-10-15

  • multi-modal-qa
  • math-qa
  • figure-qa
  • geometry-qa
  • math-word-problem

המאגר מרכז 6,141 שאלות המשלבות מתמטיקה וראייה ממוחשבת מתוך 31 מקורות שונים. הוא מיועד למי שרוצה לבחון יכולות הסקה חזותית ומתמטית במודלי שפה וראייה.

  • 17,927הורדות בחודש
  • 225לייקים

מה זה

הנתונים מחולקים לשני חלקים בלבד, שניהם מיועדים למבחן. חלק ה־testmini כולל 1,000 דוגמאות לפיתוח ובדיקות מהירות, וחלק ה־test כולל 5,141 שאלות להערכה מלאה, כשתשובותיו אינן חשופות לציבור.

כל רשומה מורכבת מתמונה לצד שאלה, כאשר המשימות נעות בין שאלות רב-ברירה לשאלות פתוחות, וכוללות מטא-דאטה מפורט על מקור הנתונים. המאגר בוחן שבעה תחומי הסקה שונים, בהם אריתמטיקה, אלגברה, גיאומטריה, סטטיסטיקה, שכל ישר מספרי והסקה מדעית ולוגית.

המקורות מגוונים מאוד. היוצרים בנו שלושה מאגרים חדשים לגמרי עבור חידות חזותיות, גרפים של פונקציות ואיורים ממאמרים אקדמיים, וצירפו אליהם נתונים מעובדים מ־9 מאגרי שאלות מתמטיות ומ־19 מאגרי שאלות ותשובות חזותיות קיימים.

מתאים ל

  • הערכת מודלים רב-חזותיים

    בדיקת יכולת המודל לפענח גרפים ותרשימים מדעיים ולחלץ מהם תשובה מדויקת.

  • מבחן הסקה גיאומטרי ולוגי

    מדידת ביצועים של מודלי ראייה בפתרון חידות היגיון ואיורים גיאומטריים מורכבים.

  • ולידציה מהירה בפיתוח

    שימוש בסט testmini כדי לקבל תמונת מצב מהירה על דיוק המודל במשימות MathQA.

איפה זה נופל

המאגר אינו מכיל נתוני אימון אלא נתוני מבחן בלבד, ולחלק הגדול של 5,141 השאלות אין פתרונות גלויים בקבצים. השפות המדווחות כוללות אנגלית, סינית ופרסית, כך שאין כאן עברית כלל. שאלות רבות נשענות על תרשימים מדעיים וגרפים ברמה אקדמית, שלא תמיד מייצגים בעיות יומיומיות במוצרים סטנדרטיים.

שאלות
נפוצות

האם מותר לאמן מודל מסחרי על הנתונים?

לא, תנאי המאגר אוסרים במפורש להשתמש בו כסט אימון. מותר להשתמש בו לצרכים מסחריים רק כסט לבדיקה והערכת מודלים.

האם המאגר כולל תוכן בעברית?

לא, המאגר מוגדר לשפות אנגלית, סינית ופרסית בלבד. אין בו שאלות או תיוגים בעברית.

למה אי אפשר לראות את התשובות לחלק הגדול?

החלק המלא שכולל 5,141 שאלות נשמר ללא תוויות פתרון פומביות כדי למנוע דליפת מידע ולהבטיח הערכה עיוורת אמינה. פתרונות זמינים רק בחלק ה־testmini הכולל 1,000 דוגמאות.

מאיפה הגיעו השאלות והתמונות?

החוקרים אספו שאלות מ־31 מאגרים שונים בספרות, בהם 9 מאגרי שאלות מתמטיות ו־19 מאגרי שאלות על תמונות. בנוסף הם יצרו שלושה מאגרי נתונים מקוריים עבור חידות היגיון חזותיות, גרפי פונקציות ואיורים ממאמרים מדעיים.

איך טוענים

טוענים את הנתונים ישירות דרך ספריית datasets של Hugging Face בפקודת load_dataset פשוטה. אין צורך לבקש אישור גישה מוקדם או להמתין. הקבצים שמורים בפורמט Parquet, לצד קובץ תמונות מכווץ וקובץ source.json שמפרט את המקורות. בכל דוגמה תמצאו את המזהה pid, שאלת הטקסט, נתיב התמונה, והתשובה עצמה שזמינה רק בחלק המצומצם.

from datasets import load_dataset

ds = load_dataset("AI4Math/MathVista")

הרישיון

התוספות של החוקרים פורסמו ברישיון CC BY-SA 4.0 הדורש ייחוס ושיתוף זהה, אך זכויות התמונות והשאלות המקוריות שייכות ליוצריהן. בנוסף, תנאי השימוש אוסרים במפורש על שימוש במאגר כסט אימון, ומאפשרים שימוש מסחרי אך ורק כסט לבדיקה והערכה.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת שיתוף באותו רישיון

הרישיון המלא ב־Hugging Face ↗