GPT
P

PoseMaker

רץ בדפדפן

jonigatacreativeml-openrail-m2023-02-16

  • gradio

הכלי מייצר ומחלץ תנוחות גוף מתוך תמונות או קובצי מבנה כדי להתאים אותן ליצירת תמונות. הוא מיועד למי שצריך שלד מדויק עבור עבודה עם מודלים ויזואליים.

  • הורדות בחודש
  • 136לייקים

מה זה

מעלים תמונה של אדם או מזינים נתוני שלד בפורמט JSON, והממשק מחלץ את מנח הגוף באמצעות רכיב פנימי שמנתח נקודות ציון פיזיות. אפשר לקבוע ממדי תמונה ברוחב ובגובה שנעים בין 512 ל־1024 פיקסלים בקפיצות של 64, ולייצא את התוצאה כקובץ או כמבנה נתונים.

הקוד משתמש בספריית עיבוד תמונה OpenCV לצד מודול ייעודי לחילוץ שלד גוף אנושי. בצד התצוגה מקבלים אזור עבודה ויזואלי שמאפשר לראות את התנוחה, לעדכן גדלים, לשמור את התוצאה או להחליף את המידע ישירות בעזרת טקסט מובנה.

מתאים ל

  • חילוץ תנוחה מתמונה קיימת

    מעלים צילום גוף ומפיקים ממנו את מבנה המפרקים כדי להלביש עליו דמויות חדשות.

  • ייבוא שלדי JSON לעבודה

    מזינים קוד מבנה קיים ישירות לתוך תיבת הטקסט כדי לקבל תצוגה גרפית מדויקת.

  • התאמת גדלים ליצירת תמונה

    מכוונים את הפלט למידות מדויקות בין 512 ל־1024 פיקסלים לפי צורכי הפרויקט.

איפה זה נופל

הבעיה המרכזית כרגע היא שהיישום לא פעיל ומציג שגיאה פנימית, כך שאי אפשר להריץ בו פקודות ישירות ברשת. מעבר לזה, הממשק מוגבל לממדים מרובעים או מלבניים עד 1024 פיקסלים בלבד. מי שבונה על פענוח של תנוחות מורכבות או מרובות משתתפים יצטרך לבדוק את הקוד עצמאית, כי אין כאן כלי תיקון ידניים מפורטים מעבר לייבוא ערכי טקסט חלופיים.

שאלות
נפוצות

האם הכלי עובד כרגע בדפדפן?

לא, השרת שמארח אותו נמצא במצב של שגיאת הרצה. כדי להשתמש בו יש צורך להוריד את הקוד ולהפעיל אותו בסביבה מקומית משלכם. עד שהיוצר יתקן את התקלה, העמוד ברשת לא מגיב לפעולות.

האם השימוש בו עולה כסף?

הקוד והעמוד פתוחים לשימוש חופשי ואין דרישה לתשלום או להזנת פרטי אשראי. תצטרכו רק חשבון מתאים בפלטפורמה אם תרצו לשכפל את הקוד אל הסביבה שלכם. הרישיון מאפשר גם שימושים מסחריים בכפוף לתנאים שלו.

מה קורה לתמונות שמעלים לממשק?

הקבצים נשלחים לעיבוד בשרת המרוחק שבו מאוחסן הקוד ואינם נשמרים רק על המחשב שלכם. מאחר שמדובר בסביבת הדגמה פתוחה, עדיף לא לטעון תמונות רגישות או מסמכים מזהים. לפרטיות מלאה עדיף להריץ את המודול ישירות אצלכם במחשב.

האם אפשר להשתמש בקובצי טקסט במקום תמונות?

כן, המערכת כוללת תיבת קלט ייעודית עבור קובצי שלד בפורמט JSON. אפשר להדביק לשם נתוני נקודות מוכנים מראש ולטעון אותם במקום לנתח צילום מחדש. זה מאפשר לחבר את הכלי לתהליכים אוטומטיים אחרים שפולטים מבנים כאלה.

איך משתמשים

נכנסים לממשק ובוחרים את ממדי הפלט הרצויים בעזרת שני מכוונים. כדי להוציא תנוחה מצילום, פותחים את אזור הערכת התנוחה, מעלים קובץ ולוחצים על ייבוא או החלפה. אם רוצים להשתמש בערכים כתובים, פותחים את לשונית הנתונים, מדביקים את הטקסט בתיבה ומאשרים. התהליך תוכנן לרוץ על מאיץ גרפי ייעודי, אבל כרגע העמוד מדווח על שגיאת זמן ריצה ולא ניתן לבצע בו פעולות בדפדפן.

הרישיון

הפרויקט פורסם תחת רישיון CreativeML OpenRAIL M שמתיר שימוש מסחרי ומחקר, אך אוסר שימושים מזיקים או פוגעניים. מאחר שהיישום יושב על שרת ציבורי, כל תמונה או נתון שמעלים נשלחים לרשת, ולכן לא מומלץ להעלות מידע פרטי.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא ב־Hugging Face ↗