GPT
A

aime_2026

קוד פתוח

MathArenacc-by-nc-sa-4.02026-02-13

שאלות מתחרות המתמטיקה AIME 2026 בפורמט מסודר שבודק יכולות חשיבה מתקדמות. מי שבונה או בוחן מודלים על בעיות קשות עם תשובה מספרית סופית ירצה את זה בדיוק בשביל מדדי ביצועים.

  • 31,029הורדות בחודש
  • 58לייקים

מה זה

המאגר כולל שאלות מתוך תחרות המתמטיקה AIME לשנת 2026, כפי שהוכנו עבור לוח התוצאות של פרויקט MathArena. כל רשומה כוללת שלושה שדות בלבד: מזהה השאלה בתוך המבחן, נוסח השאלה המלא שמקודד כמחרוזת בפורמט מקור של LaTeX, והתשובה הסופית הנכונה שמוגדרת כמספר שלם.

מקור הנתונים הוא ישירות ממבחני התחרות הרשמיים של אותה שנה. לפי התיעוד של הצוות, השאלות חולצו מתוך חומרי המבחן, עברו המרה ידנית או ממוחשבת לקוד LaTeX, ולאחר מכן עברו תהליך אימות כדי לוודא שהנוסח והתשובות תואמים למקור. אין כאן חלוקה מורכבת לקבוצות אימון ובדיקה נפרדות, אלא קובץ נתונים יחיד שמרכז את הבעיות המאומתות.

מתאים ל

  • הערכת יכולות הסקה

    בדיקת יכולת המודל לפתור בעיות מתמטיות ברמת תחרות ולהגיע לתשובה מספרית מדויקת בלי פשרות.

  • בנצ׳מרק מול מתחרים

    הרצה ישירה כחלק מלוח התוצאות של MathArena להשוואת ביצועים מול מודלים אחרים.

  • בדיקת עיבוד נוסחאות

    בחינה של יכולת המודל לקרוא נכון בעיות מורכבות שמנוסחות במקור כקוד LaTeX.

איפה זה נופל

ההטיה הראשונה היא השפה והתוכן. כל השאלות כתובות באנגלית ובמתמטיקה ברמת אולימפיאדה, כך שאין כאן מילה בעברית ולא תמצאו פה בעיות מתמטיות פשוטות מחיי היום-יום. מעבר לזה, המאגר מספק רק את התשובה המספרית הסופית ולא דרך פתרון מלאה או שלבי ביניים. אם המודל שלכם טועה, תדעו רק שהוא נכשל בתוצאה אבל לא איפה בדיוק החישוב השתבש. בנוסף, מדובר במדגם קטן מאוד של פחות מאלף דוגמאות, כך שהוא טוב למבחן נקודתי אבל לא יספיק לבדו לאימון רחב.

שאלות
נפוצות

האם מותר להשתמש בזה למוצר מסחרי?

לא, הרישיון הוא CC-BY-NC-SA 4.0 שמונע מפורשות שימוש מסחרי. השימוש מוגבל למחקר, הערכה אקדמית ובדיקות שאינן למטרות רווח. אם תאמנו עליו מודל שיימכר ללקוחות, אתם מסתכנים בהפרת תנאי השימוש.

האם השאלות קיימות בעברית?

לא, כל השאלות במאגר מופיעות באנגלית בלבד וכוללות סימונים מתמטיים בפורמט LaTeX. אין תרגום מובנה לעברית בכרטיס המקורי. אם המערכת שלכם עובדת בעברית, תצטרכו לתרגם את השאלות בעצמכם ולוודא שהנוסחאות לא נפגעות בתהליך.

כמה מקום הדאטהסט הזה תופס?

מדובר בנפח זעיר של פחות מאלף שאלות סך הכל, שיושבות בקובץ Parquet בודד. המאגר כולו מורכב מארבעה קבצים בלבד ונטען כמעט מיד לכל סביבת עבודה. אין צורך בתשתית אחסון מיוחדת או בחומרה כבדה כדי לעבוד איתו.

איך הנתונים נאספו ונבדקו?

השאלות נלקחו ישירות מתוך תחרות AIME לשנת 2026. לפי התיעוד, היוצרים חילצו את השאלות מתוך חומרי המבחן המקוריים, המירו אותן לתחביר LaTeX, ווידאו שהשאלות והתשובות הסופיות מדויקות ותואמות לחלוטין לתוכן התחרות.

איך טוענים

אתם מושכים את הקובץ ישירות מתוך Hugging Face בלי צורך באישור גישה מיוחד. הנתונים יושבים בקובץ Parquet בודד תחת התיקייה data, לצד קובץ הגדרות בשם eval.yaml שמיועד להרצת הערכות. מדובר במאגר זעיר של פחות מאלף שאלות, כך שהטעינה לוקחת שניות בודדות ולא דורשת משאבי זיכרון חריגים. בעת העבודה חשוב לוודא שהסביבה שלכם יודעת לעבד תחביר LaTeX בלי לשבור תווים, ולחלץ את שדה התשובה כמספר שלם לצורך השוואה ישירה מול פלט המודל.

from datasets import load_dataset

ds = load_dataset("MathArena/aime_2026")

הרישיון

הרישיון כאן הוא CC-BY-NC-SA 4.0, וזה אומר שאסור לעשות בו שום שימוש מסחרי. מותר להשתמש בו למחקר או לבדיקות פנימיות, אך חובה לתת קרדיט ליוצרים. אם אתם משנים את הנתונים ומפיצים אותם, אתם חייבים לשחרר את התוצר תחת אותו הרישיון בדיוק. אימון מודל מסחרי על הדאטהסט הזה עלול לחשוף אתכם להפרת רישיון.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא ב־Hugging Face ↗