GPT
F

flx-upscale

רץ בדפדפן

fantaxyרישיון לא דווח2024-06-06

  • gradio

הגדלת תמונות בעד פי ארבעה תוך שחזור פרטים באמצעות בינה מלאכותית. מיועד למעצבים, צלמים ויוצרי תוכן שצריכים להגדיל קבצים קטנים בלי לקבל מריחות.

  • הורדות בחודש
  • 241לייקים

מה זה

מעלים תמונה בפורמט נתמך, בוחרים מכפיל הגדלה של עד פי ארבעה ומקבלים קובץ JPEG מוגדל. התוצאה מוצגת בממשק עם סליידר שמאפשר להשוות את הלפני והאחרי ישירות על המסך.

מאחורי הקלעים רץ שילוב של מודל הבסיס FLUX.1-dev יחד עם jasperai/Flux.1-dev-Controlnet-Upscaler. בניגוד להגדלה רגילה שרק מותחת פיקסלים, המערכת הזו מייצרת פרטים חדשים על בסיס הבנת התמונה תוך שמירה על המבנה המקורי באמצעות ControlNet. הקוד מריץ את הצינור בפורמט bfloat16 ומגביל את תקציב הפיקסלים לרזולוציה של עד 1024x1024 כדי לעמוד במגבלות הזיכרון.

מתאים ל

  • הכנת גרפיקה למסכים חדים

    הגדלת תמונות רשת ישנות או קטנות בעד פי ארבעה כך שייראו חדות במסכי תצוגה מודרניים.

  • חידוד איורים דיגיטליים

    שחזור והוספת פרטים לאיורים ברזולוציה נמוכה תוך שמירה על קווי המתאר המקוריים.

  • שיפור תמונות מוצר

    הגדלת תמונות מוקטנות של מוצרים לקטלוגים דיגיטליים ומכירות ברשת.

איפה זה נופל

ההגדרה מוגבלת לתקציב מקסימלי של 1024x1024 פיקסלים, כך שאי אפשר לייצר כאן פוסטרים ענקיים לדפוס ישירות מהדפדפן. מעבר לכך, מודל דיפוזיה שממציא פרטים עלול לעוות טקסטים קטנים או לשנות פרטי פנים עדינים, במיוחד אם מגזימים עם עוצמת ה־ControlNet או קובעים צעדים נמוכים מדי.

שאלות
נפוצות

האם השימוש באפליקציה בחינם?

הגישה לממשק באתר Hugging Face חופשית, אך כרגע הספייס נמצא במצב מושהה. אם היוצר יחזיר אותו לפעילות, השימוש הבסיסי אינו כרוך בתשלום.

כמה זמן לוקח לתמונה להתעבד?

המפרט דורש כרטיס מסך עם CUDA כדי לפעול בזמן סביר. מאחר שהחומרה המוגדרת כעת היא מעבד בלבד והמצב מושהה, העיבוד אינו מתבצע עד לעדכון החומרה.

האם אפשר להריץ את הכלי במחשב האישי?

כן, הקוד מבוסס על Diffusers ו־PyTorch ומוריד את המשקולות ישירות מ־Hugging Face. תצטרכו מחשב עם מעבד גרפי חזק ותמיכה ב־bfloat16 כדי להריץ את FLUX.1-dev מקומית.

מה ההבדל בין זה לבין מודל FLUX הרגיל?

האפליקציה מוסיפה שכבת ControlNet ייעודית של Jasper AI שמתמקדת בהגדלה. היא מקבלת תמונה קיימת ומייצרת פרטים סביב המבנה שלה, במקום לייצר תמונה חדשה לגמרי מטקסט.

איך משתמשים

טוענים תמונה, קובעים את מספר צעדי החישוב בין 8 ל־50, בוחרים מכפיל הגדלה ועוצמת שליטה של ControlNet, ולוחצים על Run. אפשר לקבע סיד מספרי או לבחור בערך אקראי.

כרגע העמוד מוגדר במצב PAUSED ורץ על תשתית cpu-basic. בלי מאיץ גרפי ייעודי של CUDA, מודל כבד כזה לא מסוגל לתת תוצאה מהירה, ולמעשה כרגע לא ניתן להריץ אותו כלל עד שהיוצר יפעיל את הספייס מחדש.

הרישיון

הרישיון של המרחב עצמו לא דווח. מודל הבסיס הוא FLUX.1-dev של חברת Black Forest Labs, שמגיע במקור עם תנאי שימוש מגבילים למחקר ולשימוש לא מסחרי. בהיעדר רישיון מוגדר לפרויקט כולו, לא מומלץ לבנות עליו לפרויקטים מסחריים.

הרישיון המלא ב־Hugging Face ↗