GPT
A

aime_2025

קוד פתוח

MathArenacc-by-nc-sa-4.02025-05-10

שאלות מתמטיות קשות מתחרות AIME של שנת 2025 בפורמט מובנה. מיועד למי שצריך לבחון יכולות הסקה מתמטית של מודלים מול שאלות תחרותיות עדכניות.

  • 29,041הורדות בחודש
  • 17לייקים

מה זה

המאגר כולל את השאלות שנלקחו מתחרות המתמטיקה AIME שנערכה בשנת 2025, ומשמשות כחלק ממבחני הביצועים של MathArena. מדובר בסט נתונים קטן שמכיל פחות מאלף רשומות, כאשר כל רשומה מייצגת בעיה מתמטית אחת מתוך התחרות.

המבנה של כל שורה בדאטהסט פשוט וישיר. יש מזהה מספרי לבעיה בשם problem_idx, ניסוח השאלה המלא שמקודד ברובו בפורמט LaTeX תחת השדה problem, תשובה סופית מדויקת שהיא מספר שלם בשדה answer, ותיוג של קטגוריית השאלה ברשימת מחרוזות דרך problem_type.

לפי התיעוד, השאלות חולצו ישירות מחומרי התחרות המקורית של אותה שנה. לאחר החילוץ, הטקסטים הומרו לקוד LaTeX ועברו אימות ידני כדי לוודא שהנוסח והתשובות נכונים לפני שהועלו למאגר.

מתאים ל

  • בנצ'מרק למודלי שפה

    בדיקת יכולת המודל לפתור בעיות מתמטיקה מורכבות ולהגיע לתשובה מספרית נכונה.

  • אימות חילוץ תשובות

    הערכת היכולת של סוכנים לתרגם בעיה בפורמט LaTeX למספר שלם סופי.

  • מחקר אקדמי בהסקה

    מדידת ביצועים של מודלי reasoning מתקדמים מול שאלות תחרותיות משנת 2025.

איפה זה נופל

הנתונים כולם באנגלית ומכילים פחות מאלף דוגמאות, כך שהם מתאימים לבדיקת ביצועים ולא לאימון רחב. אין פתרונות מלאים או שלבי הוכחה, אלא רק תשובה מספרית סופית. אם המודל שלכם מדבר בעברית או מיועד להסביר תהליכים ולא רק לפלוט מספר, המאגר הזה ידרוש התאמות משמעותיות.

שאלות
נפוצות

האם מותר להשתמש בזה במוצר מסחרי?

לא. הרישיון המוגדר הוא CC BY-NC-SA 4.0 שמונע במפורש כל שימוש מסחרי. המאגר מתאים למחקר אקדמי, בדיקות פנימיות ופיתוח שאינו למטרות רווח.

האם יש במאגר שאלות בעברית?

לא. כל הבעיות נלקחו מתחרות AIME בארצות הברית והן כתובות באנגלית בלבד עם סימוני LaTeX. תצטרכו לתרגם אותן אם המטרה היא בדיקה בעברית.

כמה שטח אחסון הדאטהסט דורש?

מדובר במאגר זעיר של פחות מאלף שאלות שנכנס בקובץ Parquet בודד. הוא יורד למחשב תוך שניות בודדות ואינו דורש משאבי זיכרון מיוחדים.

האם יש פתרונות מפורטים צעד אחר צעד?

לא. השדה answer כולל רק מספר שלם שמהווה את התשובה הסופית. המאגר לא כולל שלבי פתרון, נימוקים או הוכחות.

איך טוענים

טוענים אותו ישירות דרך ספריית datasets באמצעות הנתיב MathArena/aime_2025. הנתונים מגיעים בקובץ Parquet בודד לצד קובץ הגדרות בשם eval.yaml, כך שאין צורך באישור גישה מיוחד או בהורדה ממושכת. השדות המרכזיים שמעניינים אתכם להרצה הם problem שמכיל את הטקסט והמשוואות, ו־answer ששומר את המספר הסופי להשוואה מול הפלט של המודל.

from datasets import load_dataset

ds = load_dataset("MathArena/aime_2025")

הרישיון

הרישיון הוא CC BY-NC-SA 4.0, מה שאומר שאסור להשתמש בנתונים האלה לשום מטרה מסחרית. אתם מחויבים לתת קרדיט למחברים, ואם תשנו או תרחיבו את הדאטהסט, תצטרכו להפיץ אותו תחת אותם תנאים בדיוק. אימון מודל מסחרי על הנתונים האלה מהווה הפרה של הרישיון.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא ב־Hugging Face ↗