GPT
M

MM-Food-100K

קוד פתוח

Humanbased-AIopenrail2025-08-12

מאה אלף תמונות אוכל עם פירוק גרמים, ערכים תזונתיים ושיטות בישול. מיועד למי שמנסה ללמד מודל לחשב קלוריות מתמונה ולא רק לזהות שמדובר בפיצה.

  • 279הורדות בחודש
  • 71לייקים

מה זה

המאגר מכיל תמונות אמיתיות של ארוחות, רובן אוכל ביתי או מנות ממסעדות, יחד עם פירות וירקות ומוצרים ארוזים. המקור הוא פרויקט משותף של Codatta ו־Binance שבו כחמישים אלף משתמשים העלו מעל מיליון תמונות. אחרי סינון של תמונות מטושטשות ולא רלוונטיות, החוקרים דגמו מאה אלף רשומות מתוך המיליון שנאספו.

התיוג משלב עבודה אנושית ומודלים. משתמשי הפרויקט תייגו שמות, גדלי מנות ואזורים, לאחר מכן מודלים כמו GPT-4o ו־Qwen השלימו מרכיבים, פרופיל תזונתי ושיטות בישול, ולבסוף בודקים אנושיים עברו על הפלטים ותיקנו שגיאות. כל רשומה כוללת קישור לתמונה ומבנה נתונים עם כמויות בגרמים, חלבון, שומן, פחמימות, קלוריות ומדד אמינות למקור הצילום.

מתאים ל

  • הערכת קלוריות מתמונה

    אימון מודלים להערכת משקל וערכים תזונתיים של מנות ביתיות ומסעדה לפי צילום סלולרי.

  • זיהוי מרכיבים במנה

    חילוץ רשימת רכיבים ושיטת ההכנה מתוך תמונת ארוחה לצורך ניהול יומן תזונה.

  • בנצ'מרק למודלי ראייה

    בדיקת יכולות של מודלי ראייה גדולים בהבנת הרכב מנות מורכבות ולא מבושלות.

איפה זה נופל

הערכים התזונתיים והמשקלים עברו דרך מודלי שפה, ואף על פי שהיה שלב תיקון אנושי, מדובר בהערכות ולא במדידות מעבדה. תמונות שמסתמכות על קישורים חיצוניים עלולות להישבר עם הזמן אם השרת המארח ייפול. הטקסט כולו באנגלית בלבד, ואין פירוט על המטבחים המיוצגים, כך שייתכן חוסר איזון במנות מקומיות ומאכלים ישראליים. בנוסף, חובה לבדוק את עמודת ההסתברות כדי לסנן תמונות שהורדו מהרשת במקום צילומי משתמשים.

שאלות
נפוצות

האם מותר להשתמש במאגר לפיתוח אפליקציה מסחרית?

לא. המאגר שוחרר תחת רישיון OpenRAIL לשימוש לא מסחרי בלבד. כדי להשתמש בנתונים במוצר מסחרי צריך ליצור קשר ישיר עם Codatta ולקבל רישיון מתאים.

כמה שוקל הדאטהסט והאם התמונות כלולות בו?

המאגר בהאגינג פייס כולל בעיקר קובץ CSV עם קישורים חיצוניים לתמונות ולא את קובצי התמונה עצמם. נפח ההורדה הראשוני של הטקסט קטן מאוד, אך שמירת מאה אלף התמונות דורשת הורדה נפרדת שצורכת עשרות גיגה בייטים ונפח אחסון מקומי.

האם יש במאגר ייצוג למאכלים מישראל או כיתוב בעברית?

כל המטא-דאטה, שמות המנות והמרכיבים כתובים באנגלית בלבד. המקור מבוסס על משתמשי קמפיין בינלאומי ואין בו התאמה או הבטחה לייצוג של מאכלים ישראליים מקומיים.

מה ההבדל בין המאגר הזה למאגרי תמונות אוכל כמו Food-101?

מאגרים ותיקים מספקים בדרך כלל רק את שם המנה לצורכי סיווג תמונה פשוט. כאן מקבלים גם פירוק למשקל משוער של כל רכיב, שיטת הבישול וחישוב של שומן, חלבון, פחמימות וקלוריות.

איך טוענים

המאגר מגיע כקובץ CSV בלי קובצי התמונות עצמם. העמודה הראשונה היא קישור רשת, ולכן לפני שמתחילים לאמן תצטרכו להריץ סקריפט הורדה עצמאי כדי למשוך את מאה אלף התמונות לדיסק שלכם. הנתונים באנגלית, פתוחים להורדה ישירה ללא טופס בקשה, והשדות העיקריים לעבודה הם קישור התמונה, רשימת המרכיבים עם המשקלים והאובייקט של הערכים התזונתיים.

from datasets import load_dataset

ds = load_dataset("Humanbased-AI/MM-Food-100K")

הרישיון

הרישיון הוא OpenRAIL שמגביל את השימוש למטרות מחקר ופיתוח לא מסחריות בלבד. אסור לשלב את המאגר או מודלים שאומנו עליו במוצר מסחרי, אלא אם פונים למפרסמים ומקבלים רישיון בתשלום. בנוסף קיימות הגבלות שימוש אתיות המובנות ברישיונות RAIL.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא ב־Hugging Face ↗