GPT
A

agentic-distill-fable-5-sft

קוד פתוח

lordx64agpl-3.02026-06-13

  • agentic
  • chain-of-thought
  • distillation
  • claude
  • claude-fable-5

4,659 דוגמאות אימון מבוססות Claude Fable-5 עם שרשראות חשיבה מלאות וקריאות לכלים. המאגר מיועד למי שרוצה ללמד מודל לתכנת ולהפעיל כלים במקום לפתור בעיות מופשטות.

  • 553הורדות בחודש
  • 59לייקים

מה זה

כל הרשומות מגיעות ממקור יחיד בשם Glint-Research/Fable-5-traces, שמכיל 48,772,554 תווים וממוצע של כ־2.6k תווים למודל Qwen בכל שורה. 81 אחוז מהדוגמאות מסתיימות בהפעלת כלי והשאר בתשובת טקסט רגילה. הנתונים מתעדים שימוש בכלי Claude Code של מפתח בודד לאורך שבוע עבודה יחד עם משימות פיתוח נוספות, כך שהחשיבה בבלוקי ה־think מתמקדת בעריכת קוד ובקריאות לפונקציות.

היוצר סינן רעשי מערכת של Claude Code כמו פקודות סלאש וקודי ANSI, מחק שורות עם חשיבה קצרה מ־50 תווים או ללא עקבות חשיבה, והסיר שש כפילויות. בנוסף נוקו 204 מופעים שבהם נחשפו שני מפתחות API פעילים של Groq מקובצי הגדרות. הטקסט כולו אוגד לעמודת text אחת בתבנית הצ'אט של Qwen, עם תגי XML ייעודיים לקריאות ולתוצאות הכלים.

מתאים ל

  • אימון סוכני קוד

    לימוד מודלים קטנים כיצד לנתח שגיאות, לבצע עריכות קוד ולהפעיל כלי מערכת חיצוניים.

  • זיקוק שרשראות חשיבה

    שיפור יכולת ההסבר העצמית של מודל פתוח בעזרת בלוקי חשיבה טקסטואליים מלאים.

  • אימון מודלי Qwen

    הזנה ישירה של הדוגמאות לתהליך SFT בזכות שימוש מובנה בתבנית השיחה של Qwen.

איפה זה נופל

הנתונים כולם באנגלית ומבוססים כמעט לחלוטין על סביבת העבודה של מפתח אחד, מה שיוצר פיזור צר ומוטה מאוד להרגלי תכנות ספציפיים. אין פה חשיבה לוגית כללית או מגוון רחב של תחומי ידע. המודל שממנו הופק המאגר הושעה עקב מגבלות ייצוא אמריקאיות, ומאגרי מקור חלופיים סובלים מחסימת שרשראות החשיבה. תצטרכו לבדוק היטב שפורמט ה־XML תואם את הכלים שלכם לפני שאתם מתחילים להריץ אימון.

שאלות
נפוצות

האם אפשר להשתמש במאגר לפרויקט מסחרי סגור?

לא מומלץ בלי בדיקה משפטית. המאגר מוגן ברישיון agpl-3.0 שדורש שיתוף קוד מלא של כל מערכת שמריצה אותו, וקיים גם צורך לעמוד בתנאי השימוש של Anthropic לגבי הפקת נתונים ממודלים שלהם.

האם הדאטהסט כולל שרשראות חשיבה אמיתיות?

כן. בניגוד למאגרים אחרים מאותו מודל שבהם שרשרת החשיבה נמחקה ונשארה רק חתימה דיגיטלית, כאן שרשראות החשיבה פתוחות בטקסט מלא בתוך תגיות ייעודיות.

האם יש במאגר תמיכה בשפה העברית?

לא. כל הנתונים באנגלית בלבד, וכוללים שיחות טכניות, פקודות מערכת והסברי קוד.

איך המידע מעוצב ואיך מריצים אותו?

הנתונים יושבים בקובץ parquet בודד עם עמודת טקסט אחת שכבר מעוצבת לפי תבנית הצ'אט של Qwen. אפשר לטעון אותה ישירות לכלי אימון בלי עיבוד מקדים.

איך טוענים

המאגר ציבורי, שוקל קובץ parquet יחיד בתיקיית data ומוכן לעבודה ישירה מול Hugging Face בלי צורך בהרשאות גישה מיוחדות. יש בו עמודה אחת בלבד בשם text שכוללת את הנחיית המערכת, קלט המשתמש, בלוק החשיבה ותשובת המודל. הוא בנוי להזנה מיידית לתוך SFTTrainer עם הגדרת train_on_responses_only. שימו לב שתגיות הכלים עטופות ב־XML מותאם ולא בטוקנים המקוריים של Qwen, כך שצריך לחלץ אותן באמצעות ביטוי רגולרי אם אתם משנים את מבנה האימון.

from datasets import load_dataset

ds = load_dataset("lordx64/agentic-distill-fable-5-sft")

הרישיון

המאגר מופץ תחת רישיון agpl-3.0 שירש מהמאגר שממנו נלקח. הרישיון מחייב לשתף כל שינוי וקוד תחת אותו רישיון פתוח ומחמיר, כולל גישה לקוד במקרה של מתן שירות ברשת. בנוסף, מדובר בפלטים של מודל של חברת Anthropic, כך שחובה לוודא שאימון ושימוש בתוצרים עומדים במדיניות השימוש הרשמית שלהם.

הרישיון המלא ב־Hugging Face ↗