GPT
H

h94-IP-Adapter-FaceID-SDXL

רץ בדפדפן

r-neuschulzרישיון לא דווח2024-01-08

  • gradio

הדגמה שיוצרת תמונות מבוססות טקסט תוך שמירה על תווי פנים מתמונות שתעלו. היא מתאימה למי שרוצה לבדוק התאמת פנים אישית במודלי SDXL בלי התקנות מקומיות כבדות.

  • הורדות בחודש
  • 99לייקים

מה זה

אתם מעלים תמונות פנים של אדם, כותבים תיאור טקסטואלי חופשי, ומקבלים תמונה חדשה שמשלבת את מראה הפנים בתוך הסצנה שהגדרתם. יש אפשרות להגדיר הנחיה שלילית לסינון תוצאות לא רצויות, ולקבוע מראש את המשקל של הטקסט מול המשקל של תמונת המקור.

מאחורי הקלעים רץ שילוב של IP-Adapter-FaceID יחד עם מנוע SDXL, כאשר הקוד מחבר ניתוח פנים של ספריית InsightFace עם מודלים כמו Juggernaut XL. המערכת מחלצת וקטור מאפיינים מתווי הפנים ומשתמשת בו כדי לכוון את תהליך יצירת התמונה, במקום להסתמך רק על מילים.

מתאים ל

  • בדיקת מודל FaceID

    בוחנים את רמת הדיוק של IP-Adapter על דמויות אמיתיות לפני שמגדירים סביבת עבודה מקומית.

  • הפקת דיוקנאות מותאמים

    יוצרים תמונות קונספט של אדם מסוים בסגנונות וסביבות שונות לפי הנחיות טקסט מדויקות.

  • ניסויי משקלים ויזואליים

    בודקים איך שינוי האיזון בין הטקסט לבין מאפייני הפנים משפיע ישירות על התוצאה הסופית.

איפה זה נופל

הממשק מדגים שילוב מאוד מסוים עם Juggernaut XL, כך שהוא לא נותן תמונה מלאה על ביצועי המודל בחיבור לבסיסים אחרים שמוזכרים ברקע. הקוד כולל התייחסות למסננים שמגבילים יצירת תכנים מסוימים ופנים של צד שלישי, מה שעשוי לחסום יצירות תמימות. בנוסף, חילוץ הפנים רגיש לתאורה ולזוויות צילום חדות, ולא תמיד שומר על זהות מושלמת.

שאלות
נפוצות

האם השימוש באפליקציה כרוך בתשלום?

הגישה לממשק דרך הדפדפן היא בחינם ואינה דורשת תשלום. המשאבים מוקצים באמצעות חומרה שיתופית, ולכן ייתכנו זמני המתנה כשיש עומס משתמשים.

מה קורה עם התמונות שמעלים לכלי?

הקבצים נשלחים לעיבוד במעבד הגרפי שמריץ את הקוד כדי לחלץ את תווי הפנים. כדאי לקחת בחשבון שהתוכן מועבר לתשתית ענן ציבורית, ולא כדאי להעלות חומרים רגישים.

האם אפשר להריץ את היישום באופן מקומי?

הקוד בנוי בעזרת ספריות קוד פתוח כמו diffusers ו־Gradio, כך שניתן להריץ אותו במחשב אישי. עם זאת, היוצר מציין שדרוש כרטיס מסך עם לפחות 24 גיגה-בייט זיכרון כדי להריץ את השילוב הזה בצורה תקינה.

במה ההדגמה הזו שונה משימוש במודל עצמו?

כאן מקבלים צינור מוכן מראש שמחבר את המודל ל־Juggernaut XL עם סליידרים קבועים להשפעת הפנים והטקסט. בעבודה ישירה עם המודל בקוד פתוח אפשר לחבר אותו לכל מודל בסיס ולשלוט בכל שלב בתהליך.

איך משתמשים

גוררים תמונות פנים לאזור ההעלאה, ממלאים את שדות הפרומפט ולוחצים על Submit. התהליך מתבצע על מאיץ גרפי ייעודי מסוג Zero-A10G שמוקצה לפי דרישה, כך שזמן ההמתנה תלוי בעומס ובזמינות החומרה באותו רגע. אין צורך בהרשמה מיוחדת או בהגדרות שרת כדי להתחיל לייצר תמונות ישירות מהדפדפן.

הרישיון

הרישיון לא דווח במאגר, ולכן אין אישור מפורש לשימוש מסחרי בקוד או בתוצרים. כל התמונות שאתם מעלים והתוצאות שנוצרות עוברות דרך השרתים שמריצים את היישום.

הרישיון המלא ב־Hugging Face ↗