GPT
R

ReActor

קוד פתוח

Gourieffmit2023-12-17

זהו מאגר משקולות ונכסים מוכנים להחלפת פנים, שמרכז קבצי מודלים עבור תוספי יצירת תמונה כמו ComfyUI ו־WebUI. מי שמוריד אותו מחפש רכיבי הרצה ישירים ולא נתוני אימון גולמיים.

  • 165,255הורדות בחודש
  • 308לייקים

מה זה

בניגוד למה ששם הקטגוריה מרמז, לא תמצאו כאן שורות נתונים, תמונות גולמיות לאימון או טבלאות. המאגר כולל 30 קבצים שמיועדים כולם לשמש כמשאבי הרצה עבור תוספי החלפת פנים, בראשם ComfyUI-ReActor וגרסת ה־WebUI המקבילה. מדובר בחבילת נכסים טכנית שמאגדת מודלים מאומנים מראש מכמה מקורות שונים ברשת, בלי תהליך סינון נתונים שמתועד בכרטיס.

התוכן מחולק לתיקיות ייעודיות לפי תפקידי העיבוד. יש כאן מודלים לזיהוי ותיחום פנים בפורמטים כמו face_yolov8m.pt, ארכיון דחוס buffalo_l.zip שמקורו בפרויקט InsightFace, ותיקיית שיקום פנים שמכילה קבצים כמו GFPGAN, CodeFormer, GPEN ו־RestoreFormer_PP. חלק מהקבצים נשמרים כמשקולות PyTorch בסיומת pth או pt, ואחרים מומרים למבנה ONNX כדי לאפשר הרצה יעילה.

מתאים ל

  • החלפת פנים מקומית

    שילוב מודלי הזיהוי וההחלפה בתוך צמתי ComfyUI או WebUI לעיבוד תמונות ישיר.

  • שיקום וחידוד תווי פנים

    הרצת רכיבי GFPGAN או CodeFormer כדי לשפר חדות של תווי פנים מטושטשים אחרי עיבוד.

  • איתור ותיחום פנים

    שימוש במשקולות YOLOv8 הנמצאות במאגר כדי לזהות מיקומי פנים בתמונות.

איפה זה נופל

אם בניתם על אימון מודל משלכם, אין כאן חומר גלם לעבודה. אין דאטהסט של פנים, אין תיוגים ואין מידע על גיל, מגדר או מוצא של נתוני המקור שעליהם אומנו המשקולות. המאגר משקף לחלוטין את מה שיוצרי המודלים המקוריים בחרו להכניס אליהם, כולל כל עיוות או כשל תאורה אפשרי. מעבר לזה, הכרטיס לא מציין תהליכי בקרה, שפות או מטא-דאטה, כך שחובה לבדוק כל קובץ בנפרד לפני שמסתמכים עליו.

שאלות
נפוצות

האם מותר להשתמש במאגר לפרויקט מסחרי?

לא באופן מלא. למרות שהמאגר מציג רישיון MIT, חלק ניכר מקובצי המודלים שבפנים מוגדרים תחת תנאי שימוש לא-מסחריים בלבד. אם המוצר שלכם מסחרי, מותר להשתמש רק ברכיבים הבודדים שנושאים רישיון חופשי כמו Apache 2.0.

האם יש כאן תמונות או שורות נתונים לאימון?

לא. זה אינו מאגר נתונים במובן הרגיל, ואין בו תמונות גולמיות, טקסטים או דוגמאות אימון. מדובר אך ורק בקובצי משקולות של מודלים מוכנים להרצה.

איך החומרים נאספו למאגר הזה?

יוצר המאגר אסף משקולות ממגוון פרויקטים עצמאיים ברשת, בהם DeepInsight, TencentARC ומפתחי קוד פתוח נוספים. המטרה היתה לרכז את כל התלויות הנדרשות לפעולת תוסף ReActor במקום אחד.

האם המאגר רלוונטי לעבודה עם שפות או טקסט בעברית?

אין במאגר שום רכיב של שפה או טקסט. כל הקבצים עוסקים אך ורק בעיבוד ראייה ממוחשבת, זיהוי פנים והחלפתם ברמת הפיקסלים, כך שלשפה אין שום השפעה על פעולתם.

איך טוענים

טעינת הקבצים לא נעשית דרך פונקציות טעינת מערכי נתונים רגילות בקוד, אלא בהורדה ישירה של קובצי המודל הנחוצים מתוך תיקיות המאגר. הגישה פתוחה לחלוטין ללא צורך בהרשאה מוקדמת או באישור תנאים. תצטרכו לבחור ידנית את הקובץ המתאים למשימה שלכם, למשל קובצי ONNX לשיקום פנים או משקולות הזיהוי, ולהציב אותם בתיקיית המודלים של התוסף או פרויקט ההרצה. שמות הקבצים והנתיבים המדויקים בתיקיות המשנה קריטיים, כי התוספים מצפים למצוא אותם במבנה מוגדר מראש כדי שהזיהוי והחלפת הפנים יעבדו בלי שגיאות.

from datasets import load_dataset

ds = load_dataset("Gourieff/ReActor")

הרישיון

המאגר עצמו מוגדר תחת MIT, אבל זה מטעה ומסוכן להסתמך על זה באופן עיוור. קובצי המודלים שבפנים מגיעים עם רישיונות שונים לחלוטין של יוצריהם המקוריים. חלקם, כמו GFPGAN ו־RestoreFormer_PP, שוחררו תחת Apache 2.0 שמתיר שימוש מסחרי בכפוף לייחוס. לעומת זאת, רכיבים מרכזיים כמו buffalo_l, CodeFormer ו־inswapper מוגדרים במפורש לשימוש לא-מסחרי בלבד. מודל שתריצו בעזרתם יהיה כפוף למגבלות האלה ואסור לשימוש מסחרי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא ב־Hugging Face ↗