GPT
Z

Zen-Style-Shape

רץ בדפדפן

fotographeraiapache-2.02025-04-08

  • gradio

הכלי מעביר סגנון מתמונה אחת לתמונה אחרת תוך שמירה על המבנה המקורי. הוא מתאים למי שרוצה לעצב מחדש תמונה קיימת בעזרת טקסט ורפרנס סגנוני.

  • הורדות בחודש
  • 103לייקים

מה זה

אתם מעלים תמונת מקור שקובעת את המבנה, תמונת סגנון שנותנת את המראה הוויזואלי, וכותבים הנחיית טקסט. הממשק מאפשר לקבוע בעזרת סליידרים את עוצמת הסגנון, עוצמת קווי המתאר, עומק השדה ומספר הצעדים בריצה. התוצאה שיוצאת היא תמונה חדשה שמשלבת בין הצורות של המקור לעולם הוויזואלי של הסגנון.

מאחורי הקלעים הקוד מבוסס על צנרת של ComfyUI שמשלבת מודלים של FLUX.1 יחד עם Redux, מפענחי טקסט של T5, ומודל DepthAnythingV2 לחישוב עומק. בנוסף רצים שם מודלים של ControlNet ו־Canny לשמירה קפדנית על קווי המתאר, לצד מודל ראייה SigLIP שמנתח את מאפייני הסגנון. הממשק מכיל גם דוגמאות מוכנות מראש לטעינה מהירה של שילובים.

מתאים ל

  • החלפת סגנון אמנותי

    הלבשת שפה גרפית של איור או ציור על צילום קיים בלי לאבד את תווי הפנים והקומפוזיציה.

  • עיבוד הדמיות ומוצרים

    המרת מודל תלת ממדי פשוט או סקיצה לתמונה ריאליסטית בעזרת תמונת רפרנס לחומרים ותאורה.

  • שמירה על גבולות עצמים

    יצירת גרסאות חדשות לסצנות מורכבות תוך נעילת זוויות המצלמה והמרחקים בעזרת מפת עומק וקווי מתאר.

איפה זה נופל

הבעיה המיידית היא שהעמוד מושהה ולא פעיל כרגע, מה שמחייב שכפול של הפרויקט לחשבון שלכם כדי לנסות אותו. מעבר לכך, מדובר בשרשור מורכב של מודלים עתירי משאבים, מה שאומר שעל מעבד פשוט או ללא מאיץ גרפי חזק החישובים ייקחו זמן רב או ייכשלו. כמו כן, שילוב של סליידרים מרובים לעומק, קווי מתאר וסגנון דורש ניסוי וטעייה כדי לא לקבל תמונה מעוותת.

שאלות
נפוצות

האם האפליקציה עובדת כרגע בחינם באתר?

לא באופן ישיר. האפליקציה נמצאת במצב מושהה, ולכן כפתור הייצור לא יגיב עד שהיוצרים יפעילו אותה מחדש או שתשכפלו אותה לסביבה שלכם.

אפשר להריץ את זה על המחשב האישי?

כן, הקוד מבוסס על Gradio ומשתמש ברכיבי ComfyUI מוכרים שזמינים ברשת. תצטרכו כרטיס מסך חזק מאוד עם זיכרון משמעותי כדי לטעון ולהריץ במקביל את כל מודלי ה־FLUX והעיבוד הנלווים.

מה קורה לתמונות שאני מעלה?

העיבוד מתבצע בצד השרת שמריץ את הקוד, אך כרגע כשהעמוד מושהה לא מתבצעת תעבורה כזו. אם תריצו עותק משלכם, המידע יישאר בסביבה שבה בחרתם לארח אותו.

במה זה שונה מיצירת תמונה רגילה ב־FLUX?

יצירה רגילה מסתמכת בעיקר על טקסט ומייצרת פריסה אקראית. כאן משולבים מודלים לזיהוי עומק וקווי שלד שמכריחים את התוצאה להישאר מדויקת לצורות המקוריות שהזנתם.

איך משתמשים

בפועל נכנסים לדפדפן, טוענים את שתי התמונות, מגדירים את הפרמטרים ולוחצים על כפתור הייצור. כרגע לא תצליחו להריץ את זה ישירות בעמוד כי האפליקציה נמצאת במצב מושהה. בנוסף, חומרת השרת הרשומה היא מעבד בסיסי בלבד, כך שגם כשהיא מופעלת ומשתמשת במנגנון הקצאת משאבים, מדובר במודלים כבדים מאוד שלא ייצרו תמונה ברגע.

הרישיון

הפרויקט מפורסם ברישיון קוד פתוח מסוג Apache 2.0. הרישיון הזה מתיר שימוש חופשי ושינוי של הקוד, אך לגבי התמונות שמעלים או מפיקים, צריך לשים לב לתנאי השימוש המסחרי של מודלי הבסיס ממשפחת FLUX.1 dev שמופעלים בפנים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗