GPT
I

infinite-dataset-hub

רץ בדפדפן

infinite-dataset-hubרישיון לא דווח2024-07-16

  • gradio

היישום מייצר מערכי נתונים סינתטיים לפי דרישה בעזרת מודל שפה ושומר אותם ישירות לחשבון שלכם. מתאים למי שצריך דוגמאות נתונים מהירות לבדיקות ולפיתוח.

  • הורדות בחודש
  • 290לייקים

מה זה

אתם מקלידים מונח חיפוש בשורת הטקסט, והמערכת פונה אל מודל השפה Qwen/Qwen3-Coder-30B-A3B-Instruct כדי להמציא רעיונות למאגרי נתונים מתאימים. בכל תוצאה מוצגים שם המאגר, תגיות תיאור ותצוגה מקדימה קצרה במבנה טבלאי של CSV, לצד תיאור מילולי של השדות.

ברגע שבוחרים מאגר מסוים, אפשר לבקש הרחבה של הנתונים כדי לקבל טבלה שלמה יותר. הקוד מעבד את פלט הטקסט של המודל באמצעות pandas, מחלץ את שורות ה־CSV מתוך בלוקי הקוד ומציג אותן בטבלה אינטראקטיבית שכוללת מספור שורות.

אם מחברים חשבון של Hugging Face בהגדרות הצד, היישום יוצר מאגר חדש ישירות תחת המשתמש או הארגון שלכם, ציבורי או פרטי לפי בחירה. הוא בונה בעצמו כרטיס תיעוד מלא עם תיאור המודל ושאילתת החיפוש המקורית.

מתאים ל

  • ייצור נתוני דמה לבדיקות

    יצירה מהירה של טבלאות CSV מובנות כדי להזין סביבות פיתוח בלי להשתמש במידע רגיש.

  • אב טיפוס לאפליקציות

    בניית שלד נתונים ראשוני ומותאם אישית עבור הדגמת ממשקים ומערכות בשלבי תכנון.

  • בניית מאגרים לתרגול

    יצירה ושמירה של מערכי נתונים ישירות לחשבון הפרטי לצורך תרגול ניתוח נתונים ב־pandas.

איפה זה נופל

הנתונים סינתטיים לחלוטין ונוצרים על ידי מודל שפה, ולכן עלולים להכיל מידע שגוי או מומצא. בנוסף, מנגנון הפענוח תלוי ביכולת של המודל לפלוט תחביר CSV תקין, ואם הפלט נשבר מתקבלת שגיאת ניתוח. הממשק כולל גם בדיקת תוכן מובנית שחוסמת פלטים לא הולמים, ולא מתאים לעבודה עם קבצים חיצוניים קיימים.

שאלות
נפוצות

האם השימוש ביישום עולה כסף?

הכלי זמין לשימוש חופשי בדפדפן. אין צורך בתשלום כדי לחפש או לייצר טבלאות. אם בוחרים לשמור את המאגר שנוצר, צריך רק חשבון חינמי ב־Hugging Face.

מה קורה עם הקבצים והמידע שלי?

אתם לא מעלים קבצים משלכם לתוך הממשק, אלא רק מזינים מונחי חיפוש. התוצאה שנשמרת עולה ישירות לחשבון האישי שלכם, וניתן להגדיר אותה כמאגר פרטי או ציבורי לפי בחירתכם בהגדרות.

במה הכלי שונה מפנייה ישירה למודל?

במקום לכתוב הנחיות מדויקות לקבלת פורמט CSV, הכלי מטפל בהנדסת הפרומפטים ובחילוץ הטבלאות. בנוסף הוא יוצר עבורכם את המאגר המרוחק בלחיצת כפתור וכותב את כרטיס התיעוד שלו.

האם אפשר להריץ את היישום מקומית?

הקוד בנוי בעזרת ספריית gradio סטנדרטית ומשתמש ב־InferenceClient של Hugging Face. ניתן להוריד את קובץ app.py ולהריץ אותו במחשב, אך נדרשת גישה לרשת כדי לתקשר עם ה־API של המודל.

איך משתמשים

מקלידים מילת מפתח בשורת החיפוש ולוחצים על כפתור הזכוכית המגדלת. ברשימה שמופיעה בוחרים מאגר, לוחצים על Generate Full Dataset כדי לייצר את הטבלה המלאה, ולאחר מכן על שמירה לחשבון או שיתוף קישור. תצוגת הבסיס עובדת בלי הרשמה, אך שמירת המאגר דורשת לחיצה על כפתור ההתחברות של Hugging Face. השרת רץ על תצורת מעבד בסיסית, אך יצירת הטקסט נשענת על שירות ה־Inference של המודל ולכן תלויה בעיקר בזמני התגובה של ה־API.

הרישיון

הרישיון של היישום לא דווח במאגר. במצב כזה תנאי השימוש בקוד אינם מוגדרים רשמית, והנתונים המיוצרים נשלטים על ידי תנאי הרישיון של מודל הבסיס Qwen ומדיניות הפלטפורמה המארחת.

הרישיון המלא ב־Hugging Face ↗