GPT
H

HelpSteer3

קוד פתוח

nvidiacc-by-4.02025-03-13

  • human-feedback
  • reinforcement-learning

nvidia עומדים גם מאחורי NVIDIA AI, ויש עליו סקירה כאן.

המאגר מכיל דוגמאות מרובות שיחה עם ציוני העדפה ונימוקים כתובים. אנבידיה בנו אותו כדי לאמן מודלי תגמול שמנצחים מבחני ביצועים מובילים בתחום.

  • 6,679הורדות בחודש
  • 116לייקים

מה זה

במאגר יש 40,476 דוגמאות העדפה המחולקות ל־95% אימון ו־5% ולידציה, לצד תיקיות ייעודיות לנתוני משוב ועריכה. כל רשומה כוללת היסטוריית שיחה במבנה תואם OpenAI, שתי תגובות שונות, ציון העדפה כולל בין מינוס 3 לפלוס 3, ודירוגים פרטניים מעד שלושה מתייגים שונים שהוסיפו נימוק קצר של משפט או שניים להחלטה שלהם.

התוכן נחלק לארבעה תחומים: כללי, מדעים מדויקים, קוד, ושפות שונות. את שלושת התחומים הראשונים תייגה חברת Scale AI, ואת תחום השפות תייגה חברת Translated. בפניות בתחום הקוד כל הטקסט באנגלית ושדה השפה מציין שפת תכנות, ואילו בתחום הרב-לשוני שדה השפה מציין שפה טבעית אך אין בו בעיות תכנות.

מתאים ל

  • אימון מודלי תגמול

    לימוד מודל לדרג איכות תשובות על בסיס ציוני העדפה מדורגים.

  • פיתוח שופט אוטומטי

    שימוש בנימוקי המתייגים לאימון מודל שמסביר את הבחירה שלו.

  • הסקה מבוססת עריכה

    שיפור תשובות בזמן אמת באמצעות נתוני הפידבק והתיקון שבמאגר.

איפה זה נופל

אם המוצר שלכם פונה לשוק המקומי בישראל, הדאטהסט לא יעזור הרבה לאימון שפה כי עברית כלל אינה נכללת ברשימת השפות הנתמכות. בנוסף, כל המשימות בתחום הקוד מנוסחות באנגלית בלבד. קיים גם סיכון להטיה מערכתית בבחירת התשובות, מאחר שכל התיוגים נשענים על שתי חברות מיקור חוץ מסוימות שהנחו את המתייגים שלהן לפי סטנדרטים ספציפיים.

שאלות
נפוצות

האם יש במאגר תמיכה בעברית?

לא. המאגר תומך ב־12 שפות ובהן אנגלית, סינית, גרמנית וספרדית, אך עברית אינה מופיעה ברשימת השפות שנסרקו ותויגו.

האם מותר להשתמש בו למוצר מסחרי?

כן, רישיון cc-by-4.0 מתיר שימוש מסחרי מלא באימון ופיתוח מערכות. התנאי היחיד הוא ציון ייחוס מתאים לאנבידיה בפרסום או בתיעוד.

איך נאספו ונומקו התיוגים?

חברות Scale AI ו־Translated סיפקו את התיוגים. לכל זוג תשובות נקבע ציון מספרי ממינוס 3 עד פלוס 3, ועד שלושה בודקים שונים כתבו הסבר תמציתי להעדפה שלהם.

איך טוענים

הנתונים מחולקים ל־12 קבצים מכווצים בפורמט jsonl.gz לפי סוגי המשימות: preference, edit, feedback, ו־edit_quality. הגישה פתוחה לחלוטין ואין צורך באישור מיוחד מחשבון Hugging Face. כדי לעבוד איתו צריך לפרוק את הקבצים ולעבד את שדה ה־context שדורש התייחסות למבנה שיחה מרובה תורות, לצד חילוץ של score ו־reasoning מתוך מערך התיוגים.

from datasets import load_dataset

ds = load_dataset("nvidia/HelpSteer3")

הרישיון

המאגר מופץ ברישיון cc-by-4.0. הרישיון מתיר שימוש מסחרי מלא, כולל אימון מודלים פנימיים והפצה של שירותים המבוססים עליהם, ללא חובת שיתוף של הנגזרות באותו רישיון. החובה היחידה היא מתן קרדיט ברור למפרסמים המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא ב־Hugging Face ↗