GPT
G

gemini-3.1-pro-hard-high-reasoning

קוד פתוח

Roman1111111mit2026-02-21

  • code
  • finance
  • legal
  • agent
  • chemistry

המאגר כולל 5.6 מיליון טוקנים סינתטיים של שאלות קשות במיוחד ופתרונות מפורטים. הוא נועד למי שרוצה לאמן מודלים על שרשראות חשיבה מורכבות במדעים מדויקים, קוד ומתמטיקה גבוהה.

  • 266הורדות בחודש
  • 61לייקים

מה זה

כל רשומה מורכבת מחמישה שדות: תחום ההתמחות, רמת הקושי, ציון מורכבות לוגית של 1 עד 10, שאלת המקור והפלט עם מהלך החשיבה. המיקוד הוא בבעיות שמחייבות לפחות שלושה צעדי היסק רצופים, וכל שאלה שניתן לפתור באמצעות שליפה פשוטה ממאגר נתונים נפסלה מראש.

התוכן נוצר כולו בתהליך סוכנים אוטומטי. Gemini 3 Flash תיפקד כמנהל שייצר את השאלות לפי הוראות קשיחות, ו־Gemini 3.1 Pro במצב High Reasoning ייצר את פתרונות העומק. העבודה כיסתה מעל 60 תחומים תובעניים, ביניהם תורת השדות הקוונטית, הוכחות באפס ידיעה, ליבת לינוקס, קיפול חלבונים ורמות קושי של אולימפיאדות מתמטיקה.

מתאים ל

  • כוונון מודלים קטנים

    זיקוק יכולות היסק של מודל גדול אל תוך מודלים קומפקטיים בגודל 7B עד 70B.

  • מבחן ביצועים להסקה

    שימוש ברשומות כסט בדיקה קשה להערכת ביצועי חשיבה של מודלים מתחרים.

  • אימון למשימות מדעיות

    העמקת היכולת הלוגית בקוד מערכות, הוכחות פורמליות ופיזיקה תיאורטית.

איפה זה נופל

היוצרים מודים שהפתרונות ברמה טכנית קיצונית, עד כדי כך שרק בעלי תואר שלישי באותם תחומים יכולים לבדוק אם התשובות נכונות או מכילות הזיות מתוחכמות. בנוסף, כל החומר נוצר על ידי מכונה, כך שאין כאן אימות אנושי חיצוני. כל הטקסט באנגלית בלבד, ואין פה תוכן בעברית. שרשראות ההיסק הארוכות דורשות חלונות הקשר רחבים במיוחד, מה שיקפיץ את עלויות החישוב בזמן האימון.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט הזה למוצר מסחרי?

כן, הרישיון המדווח הוא MIT. הוא מאפשר שימוש מסחרי, עריכה ושילוב בקוד או במודלים סגורים, בלי דרישה לפתוח את המשקלים של מה שתאמנו.

האם יש במאגר דוגמאות בעברית?

לא, השפה היחידה המדווחת בכרטיס היא אנגלית. כל השאלות ותרגילי ההיסק נכתבו באנגלית סביב מושגים טכניים בינלאומיים.

איך הנתונים נאספו והופקו בפועל?

המידע סינתטי לגמרי. Gemini 3 Flash שימש כסוכן שייצר את השאלות לפי הנחיות מוגדרות, ו־Gemini 3.1 Pro במצב חשיבה גבוהה כתב את הפתרונות בעלות ייצור מדווחת של 70.56 דולר.

איך טוענים

הנתונים יושבים בקובץ full_dataset.jsonl פתוח, בלי צורך בטופסי גישה או אישורים מיוחדים, לצד קובץ README.md. כדי לעבוד איתו פשוט קוראים את קובץ ה־JSONL ישירות בעזרת ספריות טעינה סטנדרטיות. השדות הקריטיים לתהליכי כוונון הם prompt שבו יושבת השאלה המקורית, ו־high_reasoning_output שכולל את שרשרת ההיסק המלאה. מומלץ לסנן מראש לפי שדה reasoning_complexity אם רוצים לחתוך רק את הרמות הגבוהות ביותר של החשיבה.

from datasets import load_dataset

ds = load_dataset("Roman1111111/gemini-3.1-pro-hard-high-reasoning")

הרישיון

המאגר מופץ תחת רישיון MIT. המשמעות היא חופש פעולה כמעט מלא, כולל שימוש מסחרי, שינוי הנתונים ואימון מודלים סגורים או פתוחים, כל עוד שומרים על הודעת זכויות היוצרים של היוצר. אין כאן חובת שיתוף תחת אותו רישיון עבור המודל שתאמנו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא ב־Hugging Face ↗