GPT
O

Open-SWE-Traces

קוד פתוח

nvidiacc-by-4.02026-04-16

  • code
  • synthetic
  • tools
  • agents
  • software

nvidia עומדים גם מאחורי NVIDIA AI, ויש עליו סקירה כאן.

עקבות ריצה מלאות של סוכני קוד מול תקלות אמיתיות מגיטהאב. מתאים למי שרוצה לאמן מודל להשתמש בכלים, לתקן באגים בקוד ולבצע זיקוק ביצועים בלי לייצר דאטה סינתטי מאפס.

  • 22,049הורדות בחודש
  • 117לייקים

מה זה

הרשומות מכילות תיעוד מלא של אינטראקציות סוכן, כולל שיחות, קריאות לכלים ותוצאות סביבה, לצד התיקון שנוצר מול הפאטץ הרשמי. המקור מגיע מבעיות אמיתיות שנלקחו ממאגר SWE-rebench-V2 ברישיונות קוד פתוח מתירניים, שעליהן הופעלו סוכנים כמו OpenHands, SWE-agent ו־mini-swe-agent.

ההרצות סונתזו במקור באמצעות מודלים כמו Minimax-M2.5 ו־Qwen3.5-122B, ומאוחר יותר נוספו ריצות של Qwen3.6-27B, DeepSeek-V4-Flash ו־Qwen3.8-27B. הגרסה הראשונה כללה 207,489 מסלולים, אך סוננו ממנה מקרים בעייתיים של מניפולציות גיט וכך ירד חלקה ל־151 אלף רשומות, כאשר התפלגות השפות נשענת בעיקר על פייתון, Go, טייפסקריפט וג׳אווהסקריפט.

מתאים ל

  • אימון סוכני קוד מונחי כלים

    כוונון עדין למודלים כדי שילמדו לקרוא לקונסולה, לנתח שגיאות ולבצע תיקוני באגים מורכבים בריבוי שלבים.

  • זיקוק תהליכי חשיבה למודל קטן

    העברת יכולות הסקת מסקנות ותכנון ממודלים גדולים למודלים קומפקטיים שמיועדים לעבודה מקומית או זולה.

  • ניתוח ודיבוג אסטרטגיות סוכן

    בדיקת מסלולי כשל של סוכנים מובילים כדי לזהות היכן הם נתקעים בלולאות עבודה או בעריכות קוד שגויות.

איפה זה נופל

חלק גדול מהמסלולים לא פתרו את הבעיה, ובחלקם סטטוס ההצלחה כלל אינו ידוע, כך שאימון עיוור ללא סינון שדה ההצלחה יחדיר למודל דפוסי שגיאה. מעבר לכך, המפתחים נאלצו להסיר עשרות אלפי רשומות שכללו התנהגות פסולה של מעקפי גיט. שפות מערכת ותיקות כמו C ו־C פלוס פלוס כמעט לא קיימות במאגר, ואין שום ייצוג לשפות שאינן אנגלית בקוד ובתיאורי התקלות.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח מוצר מסחרי?

כן. הרישיון הוא CC BY 4.0 והיוצרים מציינים במפורש שהדאטהסט מוכן לשימוש מסחרי ולא מסחרי. יש להקפיד על מתן קרדיט ליוצרים ולוודא עמידה ברישיונות הפתוחים של המאגרים המקוריים.

האם יש במאגר תמיכה או נתונים בעברית?

לא. הנתונים מבוססים על תקלות וקוד ממאגרי תוכנה בינלאומיים בגיטהאב. כל השיחות, ההנחיות והתיעוד כתובים באנגלית בלבד.

האם כל הדוגמאות במאגר מייצגות פתרונות נכונים?

ממש לא. המאגר מכיל כמות גדולה מאוד של הרצות שנכשלו או שלא ידוע אם הצליחו. חובה לסנן את הנתונים לפי שדה ההצלחה כדי לא לאמן על פתרונות שגויים.

איך נאסף המידע שבתוך המאגר?

הבעיות נדגמו ממאגר SWE-rebench-V2 ברישיונות מתירניים. עליהן הריצו מודלים מובילים בתוך סביבות סוכנים כמו OpenHands ו־SWE-agent, ותיעדו את כל שלבי העבודה והקוד.

איך טוענים

הנתונים יושבים במבנה של 214 קבצי Parquet המחולקים לפי סוכנים ומודלים, ללא צורך באישור גישה מיוחד. אפשר לקרוא אותם ישירות באמצעות ספריית datasets או קורא Parquet סטנדרטי. בעבודה השוטפת חשוב להתמקד בשדה ההודעות שמכיל את תהליך החשיבה והכלים, בשדה התיקון של המודל מול תיקון המקור, ובמזהה ההצלחה שמסמן אם הבאג נפתר בפועל.

from datasets import load_dataset

ds = load_dataset("nvidia/Open-SWE-Traces")

הרישיון

המאגר מופץ תחת רישיון CC BY 4.0, המאפשר שימוש מסחרי, שינוי והפצה, כל עוד מעניקים קרדיט מתאים ליוצרים. רישיון זה אינו מחייב שיתוף באותם תנאים, ומאפשר לאמן מודלים לשימוש פנימי או מסחרי, בכפוף לרישיונות המקוריים של מאגרי הקוד שמהם נלקחו הבעיות.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗