GPT
O

Open-MM-RL

קוד פתוח

TuringEnterprisesmit2026-05-11

  • chemistry
  • physics
  • math
  • biology
  • science

שאלות מדעיות ברמת דוקטורט עם תמונות בודדות ומרובות, המיועדות לפתרון אנליטי מובהק. המאגר מציע תשובות חד משמעיות שמאפשרות בדיקה אוטומטית מלאה לאימון מודלים מבוססי תגמול.

  • 264הורדות בחודש
  • 228לייקים

מה זה

הרשומות מכילות בעיות מתחומי הפיזיקה, המתמטיקה, הביולוגיה והכימיה, כאשר כל רשומה כוללת שאלה, קובצי תמונה מצורפים ותשובה סופית מדויקת. הנתונים מחולקים לפי שלושה מבנים חזותיים עיקריים: בעיות עם תמונה אחת, בעיות עם תמונה מורכבת מרובת פאנלים, ושאלות הדורשות הצלבת נתונים בין מספר תמונות נפרדות במקביל.

השאלות נבנו ונבדקו בשני סבבי ביקורת של מומחים בעלי תואר שלישי בכל תחום, במטרה לוודא שהניסוח חד משמעי ושהמענה נובע ישירות מהמידע החזותי ללא צורך בכתוביות חיצוניות. התשובות עוצבו כך שיהיו דטרמיניסטיות, החל מערכים מספריים וביטויים אלגבריים ועד נוסחאות בפורמט לאטך, כדי לאפשר בדיקת נכונות מוחלטת ללא שיפוט אנושי.

מתאים ל

  • אימון במודל תגמול

    התשובות הדטרמיניסטיות מתאימות להגדרת פונקציית תגמול ישירה בשיטות למידת חיזוק.

  • בנצ'מרק חזותי מרובה מקורות

    בדיקת יכולת המודל להסיק מסקנות מדעיות מתקדמות המפוזרות על פני מספר תמונות נפרדות.

  • בדיקת פתרונות אוטומטית

    הערכת ביצועי מודלים ללא מעורבות אנושית באמצעות השוואת ערכים וביטויים מדויקים.

איפה זה נופל

גודל המדגם הנוכחי קטן מאוד ומונה פחות מאלף רשומות, כך שהוא אינו מספיק לבדו לאימון מודלים גדולים מאפס. המאגר כולו באנגלית בלבד, ואינו בודק יכולות הסבר, ניסוח טקסטואלי או שיחה אינטראקטיבית. נקודת תורפה טכנית מרכזית היא מנגנון הבדיקה: תשובות מתמטיות או יחידות מידה דורשות נרמול קפדני בקוד שלכם כדי למנוע פסילת תשובות נכונות על פערי תחביר.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט לפיתוח מוצר מסחרי?

כן, רישיון mit מתיר שימוש מסחרי מלא ללא הגבלות מיוחדות. נדרש רק להשאיר את הצהרת זכויות היוצרים של המפרסמים. המודלים שמאומנים על הנתונים אינם מחויבים ברישוי פתוח.

האם יש במאגר נתונים בעברית?

לא, כל השאלות, התחומים והתשובות מנוסחים באנגלית בלבד. הבעיות עוסקות בנוסחאות ובניתוח תרשימים מדעיים אוניברסליים, אך הטקסט עצמו אינו מתורגם.

במה הוא שונה ממאגרי שאלות ותשובות מדעיים אחרים?

הוא מתמקד בבעיות שמבוססות על כמה תמונות במקביל ולא רק תמונה אחת עם כתובית. מעבר לכך, כל התשובות סופיות וסגורות, מה שחוסך שימוש במודל שופט ומאפשר בדיקת אמת מוחלטת.

מה הגודל של המאגר והאם נדרש משאב אחסון חריג?

המאגר מכיל פחות מאלף דוגמאות וכולל 69 קבצים בלבד ברמת תמונות בודדות וקובץ נתונים אחד. אפשר להוריד ולהריץ אותו תוך שניות ספורות על כל מחשב פיתוח רגיל.

איך טוענים

טוענים את הדאטהסט ישירות דרך ספריית datasets באמצעות מזהה המאגר, ללא צורך באישור גישה או בהרשמה מוקדמת. הנתונים הטקסטואליים והמטא-דאטה מרוכזים בקובץ parquet יחיד, ולצידו תיקיית קבצים עם תמונות בפורמט png. מדובר במדגם קטן של פחות מאלף רשומות המכיל 69 קבצים בלבד. בעת כתיבת קוד ההערכה, השדות העיקריים לעבודה הם question, המערך files שמצביע לקובצי התמונה הרלוונטיים, ושדה התשובה answer. בנוסף כדאי לשים לב לשדה format שמגדיר אם הקלט דורש ניתוח של תמונה בודדת או כמה תמונות במקביל.

from datasets import load_dataset

ds = load_dataset("TuringEnterprises/Open-MM-RL")

הרישיון

המאגר מופץ תחת רישיון mit. מותר להשתמש בו לצרכים מחקריים ומסחריים, לשנות אותו ולשלב אותו במערכות פנימיות. החובה היחידה היא לשמור על הודעת זכויות היוצרים ונוסח הרישיון המקורי. שימוש בדאטהסט לאימון מודל אינו מחייב אתכם לחשוף את משקלי המודל או לשחרר את התוצרים ברישיון פתוח.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא ב־Hugging Face ↗