GPT
R

reasoning-base-20k

קוד פתוח

KingNishapache-2.02024-10-02

  • reasoning
  • synthetic

מאגר שמחזיק שאלות מורכבות לצד תהליך חשיבה מפורט צעד אחר צעד והתשובה הסופית. המטרה כאן היא לאמן מודלים לפתור בעיות מורכבות בעזרת שרשרת מחשבה מסודרת לפני שהם פולטים פלט.

  • 893הורדות בחודש
  • 232לייקים

מה זה

המאגר כולל בעיות מתחומי המדעים, התכנות והמתמטיקה, שנועדו ללמד מודלי שפה להגיע לפתרון דרך שרשרת חשיבה מובנית. כל דגימה בנויה מארבעה שדות מרכזיים שמגדירים את האינטראקציה: שדה המשתמש שמחזיק את שאלת המקור, שדה הסייען שמכיל את התשובה הסופית והנכונה, שדה שרשרת החשיבה שמפרט את שלבי הניתוח עד להגעה לתוצאה, ושדה תבנית שבו הנתונים כבר מסודרים מראש לפי פורמט שיחה מוגדר.

הכרטיס מציין שהעבודה על המאגר עדיין נמשכת, ומי שאצר אותו הוא נישית ג׳יין. הנתונים לא מגיעים בחלוקה רשמית של אימון ומבחן, אלא כקובץ מרכזי יחיד שמכיל את כלל הדוגמאות שנאספו. החומר הגולמי נשען על מבנה שיחה ייעודי שכולל תגיות מיוחדות להפרדה בין תהליך החשיבה לבין המענה המוגמר, כך שניתן לראות בדיוק היכן המודל אמור לחשוב והיכן הוא עונה למשתמש.

המפרסם לא מפרט מה היו מקורות המידע המקוריים, אילו סינונים אוטומטיים או ידניים הופעלו על הדגימות, ואיך אומתו התשובות וההסברים. נכון לעכשיו, המאגר מציג את הדוגמאות כמו שהן, ללא תיעוד על אופן בקרת האיכות של שרשראות החשיבה.

מתאים ל

  • אימון מודלי חשיבה

    כוונון עדין של מודלים קטנים כדי שילמדו לייצר שרשרת חשיבה מפורטת לפני פליטת הפתרון.

  • מחקר אסטרטגיות פתרון

    ניתוח האופן שבו שרשראות מחשבה שונות משפיעות על דיוק התוצאה במדעים ובקוד.

  • בניית נתוני הנחיה

    חילוץ דוגמאות בפורמט צ׳אט מוכן כדי לשלב אותן בתוך סטים גדולים יותר של הוראות.

איפה זה נופל

היוצר מצהיר במפורש שהמאגר עדיין בעבודה. אין שום תיעוד על מקור השאלות, כך שלא ברור אם הן נאספו מבני אדם או יוצרו על ידי מודלים אחרים, ואין בדיקה מדווחת לגבי שגיאות בשרשרת החשיבה או הזיות מתמטיות. כל הטקסטים הם באנגלית בלבד, כך שלמי שמחפש היגיון או שרשראות חשיבה בעברית אין מה לעשות פה בלי תרגום מלא. חובה לבצע בדיקה מדגמית קפדנית של איכות הפתרונות לפני שמשקיעים משאבי מחשוב באימון.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן, הרישיון הוא apache-2.0 ומאפשר שימוש מסחרי חופשי. עליכם לכלול את הצהרת הרישיון והקרדיט המקוריים בהפצה שלכם. הוא אינו מחייב אתכם לפתוח את הקוד של המודל שתאמנו.

האם יש במאגר שאלות או הסברים בעברית?

לא, כל הנתונים מוגדרים תחת השפה האנגלית בלבד. אם המטרה שלכם היא לייצר הסברים בעברית, תצטרכו לתרגם את המאגר בעצמכם או לחפש מקור אחר.

איך הנתונים נאספו ונבדקו?

כרטיס המאגר לא מפרט את מקורות המידע או את תהליך הסינון. ידוע רק שהמאגר נאצר על ידי נישית ג׳יין ושהעבודה עליו עדיין נמשכת, לכן מומלץ לבדוק את איכות הפתרונות באופן עצמאי.

מה מייחד את מבנה הנתונים כאן?

הנתונים כוללים שדה מיוחד של שרשרת חשיבה בנפרד מהתשובה הסופית, ומגיעים כבר עם תבנית שיחה בשם RChatML. התבנית הזו מגדירה מראש תגיות התחלה ייעודיות לשלב המחשבה ולשלב המענה של הסייען.

איך טוענים

הנתונים יושבים בקובץ combined_reasoning.json ומיועדים למשימות יצירת טקסט באנגלית. אין צורך לבקש אישור גישה מיוחד, אפשר למשוך ישירות מקוד פייתון בעזרת ספריית datasets או לקרוא את קובץ ה־JSON ישירות. המבנה מגיע כבר עם תבנית RChatML מובנית, שמשלבת תגית מיוחדת לתהליך החשיבה ותגית נפרדת לתשובת הסייען. כשמכינים את הנתונים לאימון, צריך לשים לב לשדות ה־reasoning וה־assistant, ולהחליט אם משתמשים בתבנית המוכנה מראש או בונים טוקניזציה מותאמת אישית.

from datasets import load_dataset

ds = load_dataset("KingNish/reasoning-base-20k")

הרישיון

המאגר מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי של הנתונים והפצה מחודשת שלהם, בכפוף למתן קרדיט ושמירה על הודעת הרישיון המקורית. אין חובה לשתף נגזרות תחת אותו רישיון, ומותר לאמן עליו מודלים מסחריים בלי לחשוף את הקוד הפנימי שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗