GPT
U

ubuntu_osworld_file_cache

קוד פתוח

xlangaiapache-2.02025-05-27

קבצי עזר לבדיקת סוכני בינה מלאכותית בסביבת שולחן עבודה אמיתית. המאגר מיועד למי שמריץ את הבנצ'מרק של OSWorld וצריך גישה יציבה לנתוני התשתית.

  • 1,447,343הורדות בחודש
  • 50לייקים

מה זה

המאגר כולל 720 קבצים שמשמשים תרחישי הערכה עבור סוכנים אוטונומיים. המבנה שלו מחולק לפי תיקיות של תוכנות מוכרות במערכת אובונטו, ביניהן דפדפני כרום ופיירפוקס, עורך התמונות גימפ, חבילת ליברה אופיס על שלל רכיביה, עורך הקוד ויז'ואל סטודיו קוד ותוכנת הדוא"ל ת'נדרבירד. ישנה גם תיקייה ייעודית למשימות שמשלבות מספר יישומים במקביל.

בתוך כל תיקיית יישום ישנן תת תיקיות לפי מזהה התרחיש הספציפי, ושם יושבים הקבצים עצמם. התוכן מגוון וכולל תמונות כמו צילומי מסך וקובצי ייחוס, מסמכי טקסט, גיליונות אלקטרוניים, מצגות, קובצי הגדרות במבנה ג'ייסון, בסיסי נתונים מסוג אסקיולייט וארכיוני זיפ. במקור החומרים ישבו על גוגל דרייב והועברו לכאן כדי למנוע קישורים שבורים ולהבטיח שחזור מדויק של הניסויים.

מתאים ל

  • הרצת מבחני OSWorld

    משיכת קובצי עזר ישירות במהלך ריצת סקריפטים לבדיקת ביצועי סוכנים במערכת ההפעלה.

  • שחזור תרחישי כשל

    הורדה ידנית של בסיסי נתונים ותמונות כדי לנתח למה סוכן נכשל במשימה ספציפית.

  • הקמת סביבות בדיקה

    שימוש בקובצי דוגמה מוכנים מראש לצורך בניית משימות אוטומציה חדשות על תוכנות שולחניות.

איפה זה נופל

זהו מאגר קבצים טכני שמשרת סביבה מסוימת, ולא סט נתונים סטנדרטי ללמידת מכונה. אין בו שאלות, תשובות או תיוגים שאפשר ללמוד מהם ישירות. החומרים מותאמים אך ורק למשימות ההערכה שנבנו במסגרת הפרויקט של OSWorld. הכרטיס אינו מפרט תמיכה בשפות שאינן אנגלית, והקשר המקומי הישראלי נעדר לחלוטין. אם המטרה שלכם היא לאמן מודל שפה מאפס או לייצר מאגר ידע רחב, אין לכם מה לחפש כאן בלי הקוד המלא של סביבת הבדיקה.

שאלות
נפוצות

האם מותר להשתמש בקבצים לפיתוח מוצר מסחרי?

המאגר עצמו מוגדר תחת רישיון אפאצ'י 2.0 שמאפשר שימוש מסחרי. יחד עם זאת, התיעוד מפנה לבדיקת הרישוי המלא במאגר המקורי של הפרויקט. כדאי לבדוק קבצים מסוימים, במיוחד תמונות וארכיונים, לפני שמשלבים אותם באופן ישיר במוצר.

האם יש בדאטהסט תמיכה בעברית?

אין שום אזכור לתמיכה בעברית במסמכי המאגר. כל התרחישים, שמות הקבצים וההגדרות מתבססים על תוכנות שולחניות בתצורת ברירת המחדל שלהן בשפה האנגלית. בדיקת סוכנים מול ממשקים מקומיים בעברית תדרוש יצירת קבצים עצמאית.

מה הגודל הכולל של המאגר?

הכרטיס מדווח על 720 קבצים בסך הכל, אך אינו מציין את המשקל הכולל בגיגה בייטים. הקבצים מנוהלים באמצעות מערכת אחסון לקבצים גדולים. אין צורך להוריד את כל המאגר למחשב, ומספיק למשוך רק את הקבצים ששייכים ליישום הנבדק.

איך המידע הזה נאסף במקור?

הקבצים נאספו ונבנו כחלק מתרחישי בדיקה לסוכנים רב מודליים בסביבת מערכת ההפעלה. במקור כל הקבצים אוחסנו בשיתוף דרך גוגל דרייב. הצוות העביר אותם במלואם להאגינג פייס כדי למנוע קישורים שבורים ולספק גישה יציבה ומהירה יותר.

במה המאגר הזה שונה מדאטהסט רגיל לאימון?

לא מדובר בקובץ טבלאי או באוסף טקסטים לאימון מודלים. זהו מאגר קבצי קלט שנועדו לשמש סוכנים בזמן ביצוע משימות אמיתיות במחשב, למשל מסמך לעריכה או תמונה לפתיחה בתוכנה. הוא שימושי בעיקר להרצה ולמדידה, ולא ללימוד עיוור של נתונים.

איך טוענים

המאגר פתוח לחלוטין לציבור ואינו דורש הרשמה או אישור גישה מראש. לא טוענים אותו כטבלת נתונים רגילה דרך פקודת הטעינה הרגילה, אלא ניגשים לקבצים בודדים לפי צורך. אפשר למשוך כל קובץ ישירות באמצעות כתובת הרשת המלאה שלו שכוללת את שם היישום, מזהה התרחיש ושם הקובץ, או להוריד אותו בקוד פייתון בעזרת הפונקציה הייעודית מספריית האגינג פייס. הקבצים מנוהלים דרך מנגנון האחסון לקבצים גדולים של גיט, כך שאין צורך לשכפל את כל 720 הקבצים מראש אם אתם מריצים רק בדיקה נקודתית מול יישום ספציפי כמו גימפ או ליברה אופיס.

from datasets import load_dataset

ds = load_dataset("xlangai/ubuntu_osworld_file_cache")

הרישיון

המאגר מדווח תחת רישיון אפאצ'י 2.0. הרישיון מתיר שימוש מסחרי, שינוי והפצה של הקוד והתוכן, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי. עם זאת, התיעוד מציין שחלק מהקבצים כפופים לתנאי הפרויקט המקורי, ולכן מי שמשלב את הקבצים או מאמן עליהם מודל למוצר מסחרי חייב לוודא שאין הגבלות פרטניות על נכסי המדיה והמסמכים שנכללים בתוכו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗