GPT
I

INTELLECT-2-RL-Dataset

קוד פתוח

PrimeIntellectapache-2.02025-04-07

מאגר לאימון למידת חיזוק שמתמקד כולו במשימות מתמטיקה ותכנות עם תשובות שניתן לאמת אוטומטית. הוא נועד למי שרוצה לשפר יכולות היקש ומחשבה שיטתית במודלי שפה בלי להסתבך עם בדיקות ידניות.

  • 302הורדות בחודש
  • 66לייקים

מה זה

המאגר כולל משימות מתמטיקה וכתיבת קוד שמיועדות לאימון מודלים בשיטות למידת חיזוק, בעיקר עם אלגוריתמים כמו GRPO. כל דוגמה בנויה סביב בעיה שהפתרון שלה מדיד ובר אימות ישיר, מה שמאפשר להגדיר פונקציית תגמול אוטומטית וחד משמעית בזמן הריצה בלי להסתמך על מודל שופט או פידבק אנושי יקר.

הנתונים מחולקים לשמונה קובצי פארקט שונים, ללא חלוקה מפורשת בתיעוד לסטים של בחינה או אימות. המפרסמים לא פירטו בכרטיס את המקורות המדויקים שמהם נאספו השאלות או באילו מסננים השתמשו כדי לנקות דליפות אפשריות של מבחנים מוכרים. הדגש העיקרי הוא על תמיכה במטרות אימון עם בקרת אורך חשיבה, כפי שבוצע באימון מודל המקור על גבי חומרה מבוזרת.

מתאים ל

  • אימון למידת חיזוק

    הרצת אימוני חיזוק למודלים בעזרת תגמול מבוסס בדיקות קוד ופתרונות מספריים מדויקים.

  • שיפור היקש במתמטיקה

    כוונון עדין של מודלי קוד ושפה כדי לחדד שלבי פתרון והתמודדות עם בעיות חישוב.

  • בקרת אורך פלט

    ניסויים על התאמת כמות טוקני החשיבה של המודל לפני הפקת התשובה הסופית.

איפה זה נופל

המגבלה הכי בולטת היא המיקוד הצר. המאגר מיועד אך ורק למתמטיקה וקוד, והמפתחים מודים בעצמם שאימון עליו פגע בביצועים במשימות של מעקב אחר הוראות כלליות. אין פה טקסט כללי, אין נתונים בעברית, ואין שום תיעוד בכרטיס על הטיות או על בדיקות של חפיפה מול מבחני ביצועים נפוצים.

שאלות
נפוצות

האם מותר להשתמש במאגר לפרויקט מסחרי?

כן. המאגר משוחרר ברישיון apache-2.0, שמאפשר שימוש מסחרי, שינוי והפצה. התנאי העיקרי הוא מתן קרדיט ושמירה על תנאי הרישיון המקוריים בקבצים.

האם יש במאגר שאלות בעברית?

לא. המאגר מורכב כולו ממשימות מתמטיקה וכתיבת קוד, והניסוחים הם באנגלית בלבד. אם המטרה שלכם היא מודל שמבין עברית, תצטרכו לתרגם את המשימות או לשלב מאגרים נוספים.

איך מאמתים את התוצאות באימון עם המאגר הזה?

המאגר מכיל משימות שניתן לוודא מתמטית או באמצעות הרצת טסטים על הקוד שנכתב. זה מאפשר לבנות סביבת אימון אוטונומית לגמרי, שמחזירה ציון בינארי או רציף לפי נכונות הפתרון.

איך טוענים

טוענים את המאגר ישירות דרך ספריית datasets באמצעות המזהה של PrimeIntellect. המידע שמור בשמונה קובצי פארקט סטנדרטיים, כך שאין צורך באישור גישה מיוחד או בהרשמה מקדימה. מומלץ להוריד קובץ אחד תחילה כדי לבחון את שמות העמודות ומבנה הנתונים לפני שמריצים תהליך אימון מלא.

from datasets import load_dataset

ds = load_dataset("PrimeIntellect/INTELLECT-2-RL-Dataset")

הרישיון

המאגר מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי מלא, שינוי של הנתונים והפצה מחודשת שלהם. מותר לאמן מודלים מסחריים על בסיס המאגר הזה, ואין חובה לשתף את המודל המאומן או יצירות נגזרות תחת אותו הרישיון, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗