GPT
C

Claude-opus-4.6-TraceInversion-9000x

קוד פתוח

Jackrongapache-2.02026-05-19

  • reasoning
  • trace-inversion
  • synthetic-data
  • chain-of-thought
  • distillation

המאגר מכיל שרשראות חשיבה סינתטיות ומפורטות ששוחזרו מתוך תקצירי החשיבה של קלוד. הוא מיועד למי שרוצה לאמן מודלים פתוחים על צעדי חשיבה מלאים במקום להסתפק בסיכומים דחוסים.

  • 497הורדות בחודש
  • 84לייקים

מה זה

הנתונים מתבססים על המאגר Roman1111111/claude-opus-4.6-10000x, שכלל בעיות, תשובות ותקצירי חשיבה דחוסים של המודל המסחרי. היוצרים השתמשו במודל Jackrong/Trace-Inverter-4B כדי לשחזר מתוך הסיכומים האלה 9,000 שרשראות חשיבה מלאות שלב אחר שלב.

כל רשומה בנויה סביב בעיה, תקציר החשיבה המקורי, התשובה הסופית, ושרשרת חשיבה סינתטית ומפורטת שכוללת יעדים, חישובים ובדיקת נכונות. הדוגמאות המוצגות מתמקדות בתחומי המתמטיקה והפיזיקה, למשל חישובי הסתברות ומציאת קיצון בחשבון אינפיניטסימלי, שבהם היעדר שלבי ביניים מייצר כשלים לוגיים בלמידה.

העיבוד בוצע על בסיס שיטה תיאורטית של שחזור לוגיקה תחת אילוצים, מתוך כוונה להשלים את פערי המידע שמודלים קנייניים מסתירים. הכרטיס אינו מפרט חלוקה מובנית לסט אימון ובדיקה נפרדים.

מתאים ל

  • אימון SFT להסבר שלבים

    לימוד מודלים קטנים לייצר הסברים מפורטים ומובנים בפתרון בעיות חישוביות.

  • אימון ליישור עם DPO

    שימוש בשרשראות המשוחזרות מול תקצירים קצרים כדי לתעדף פירוט לוגי מלא.

  • זיקוק יכולות מתמטיקה

    חיזוק פתרון משוואות וחישובים מורכבים במודלי קוד פתוח כמו LLaMA ו־Qwen.

איפה זה נופל

השרשראות אינן החשיבה האמיתית של קלוד אלא שחזור סינתטי שנוצר באמצעות מודל חיצוני של 4B פרמטרים. מודל כזה עלול להחדיר טעויות לוגיות עדינות, שלבי סרק או אי דיוקים חישוביים שלא היו קיימים במקור. בנוסף, אף שהמטא-דאטה מציג שפות נוספות, הדוגמאות בפועל ממוקדות באנגלית, ועברית כלל אינה נתמכת ברשימת השפות. אי אפשר להכניס את הנתונים ישירות לאימון בלי דגימה ובקרה ידנית של תקינות ההוכחות.

שאלות
נפוצות

האם מותר להשתמש בדאטהסט לפיתוח מוצר מסחרי?

הרישיון הרשמי במאגר הוא apache-2.0, והוא מתיר שימוש מסחרי לחלוטין. הבעיה היא שהנתונים הם תפוקות מזוקקות של מודל מסחרי סגור. עליכם לוודא שהאימון עליהם אינו מפר את תנאי השירות של החברה המקורית לפני שאתם מפיצים מודל עסקי.

האם יש במאגר תמיכה בעברית?

לא. רשימת השפות המדווחת כוללת אנגלית, סינית, קוריאנית, יפנית, רוסית וספרדית בלבד. הדוגמאות בכרטיס כתובות באנגלית, ואין בנתונים טקסט בעברית.

איך נאספו ונוצרו שרשראות החשיבה?

היוצרים לקחו מאגר קיים של עשרת אלפים דוגמאות שכלל רק בעיה, סיכום חשיבה קצר ותשובה. באמצעות מודל ייעודי קטן הם יצרו מחדש שרשרת חשיבה מלאה שמחברת בין השאלה לתשובה הסופית.

מה ההבדל בינו לבין מאגרי CoT רגילים?

רוב המאגרים מציגים חשיבה ישירה של מודל או תקציר שהוא פלט. כאן מדובר בניסיון הנדסה לאחור שמייצר שלבי ביניים יש מאין על בסיס התשובה הסופית, כדי להתגבר על ההסתרה של צעדי החשיבה במודלים המסחריים.

איך טוענים

הקובץ המרכזי שמור כטקסט בפורמט jsonl או jsonl.gz מכווץ, וניתן לטעון אותו ישירות בהזרמה דרך ספריית datasets בלי צורך באישור גישה מיוחד. המאגר כולל בסך הכל שלושה קבצים, כך שההורדה קלה ומהירה. בעת הטעינה כדאי לחלץ את שדות השאילתה, התשובה הסופית ושרשרת החשיבה המשוחזרת, שמשמשת כמטרת הלמידה הראשית באימון.

from datasets import load_dataset

ds = load_dataset("Jackrong/Claude-opus-4.6-TraceInversion-9000x")

הרישיון

המאגר מדווח תחת רישיון apache-2.0, שמתיר שימוש מסחרי, שינוי והפצה ללא דרישה להפיץ את התוצרים באותו רישיון, בכפוף למתן ייחוס. עם זאת, מקור המידע הוא תפוקות של מודל מסחרי קנייני, ולכן עליכם לבדוק שתנאי השימוש של ספק המקור מתירים אימון מודלים מתחרים לפני שאתם משלבים אותו במוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗