GPT
F

FLUX.1-dev-LoRA-add-details

קוד פתוח

Shakker-Labsother2024-08-30

  • diffusers
  • text-to-image
  • stable-diffusion
  • lora
  • image-generation

תוספת קטנה של משקולות שנועדה לתקן את המראה הפלסטיקי של תמונות אנושיות. היא מתלבשת על מודל הבסיס כדי להוציא מרקם עור אמיתי וחדות בלי להסתבך עם מילות הפעלה מיוחדות.

  • 665 MBמשקל הקבצים
  • 2,348הורדות בחודש
  • 204לייקים

מה זה

מדובר במתאם LoRA שפותח על ידי Dote ושוחרר דרך Shakker-Labs, שיושב ישירות על גבי FLUX.1-dev. המטרה המרכזית שלו ממוקדת מאוד, שיפור הריאליזם, חידוד פרטים עדינים והשגת מראה עור טבעי יותר בהפקת תמונות מטקסט. המשקל הכולל של הקבצים עומד על 665 מגה בייט, כך שמדובר בהרחבה קלה להורדה שלא דורשת שכפול של המודל הראשי.

בניגוד לתוספים שמחייבים אתכם לזכור פרומפטים מוזרים, כאן אין צורך במילת הפעלה ייעודית בכלל. אתם כותבים את התיאור הרגיל שלכם, והמשקולות עושות את העבודה לבד. מעבר לזה, הכותבים מציינים שאפשר לשחק עם ערך ההשפעה, הסקייל, ואפילו להוריד אותו לערכים שליליים אם רוצים דווקא לרכך פרטים או להתרחק מהאפקט הריאליסטי.

מתאים ל

  • דיוקנאות ריאליסטיים

    יצירת פורטרטים שדורשים מרקם עור אמין במקום מראה חלק מדי, בלי לשנות את מבנה הפרומפט המקורי.

  • רינדור דמויי פילם

    שילוב עם פרומפטים של צילום קולנועי שבהם חידוד הפרטים הקטנים מוסיף עומק לתמונה.

  • שליטה עדינה בחדות

    משחק עם סקייל חיובי או שלילי כדי להגביר פרטים או לרכך את התמונה בהתאם לצורך.

איפה זה נופל

בכרטיס המודל אין מבחני ביצועים כמותיים, אין נתונים מספריים על מהירות או שיפור באיכות, ואין שום תיעוד של מערך הנתונים שעליו הוא אומן. לא ברור איך הוא מתנהג על סגנונות שאינם צילומי אנשים, כך שצריך לבדוק ידנית שהוא לא הורס איורים או מריץ עיוותים על עצמים דוממים לפני שמשלבים אותו בצורה אוטומטית.

שאלות
נפוצות

חייבים לכתוב מילים מיוחדות בפרומפט כדי שהתוסף יעבוד?

לא. היוצרים מציינים במפורש שאין מילות הפעלה, וכל מה שצריך זה לחבר את המשקולות בצינור הריצה ולהגדיר את עוצמת ההשפעה.

אפשר להריץ אותו בלי להוריד את FLUX.1-dev המלא?

לא באופן מקומי. זהו קובץ LoRA קטן שנשען לחלוטין על מודל הבסיס, כך שחייבים לטעון את FLUX המקורי אלא אם משתמשים בממשק הרשת שלהם.

איך מריצים

כדי להשתמש בו מקומית תצטרכו סביבת פייתון עם ספריית diffusers, ולטעון תחילה את FLUX.1-dev המלא בפורמט bfloat16. מכיוון שמודל הבסיס עצום, מדובר בריצה כבדה מאוד שדורשת כרטיס מסך חזק עם נפח זיכרון מכובד רק כדי להחזיק את הבסיס, בעוד שהקובץ של ה־LoRA עצמו, ששוקל 665 מגה בייט, כמעט לא יוסיף עומס.

אם אין לכם חומרה ייעודית כזו בענן או על השולחן, היוצרים מאפשרים להתנסות בו ישירות דרך ממשק האתר של Shakker AI. בקוד עצמו הם ממליצים על guidance_scale של 3.5 עם 24 צעדים וסקייל מוגדר כברירת מחדל על 1.0.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Shakker-Labs/FLUX.1-dev-LoRA-add-details")
img = pipe("a photo").images[0]

הרישיון

הרישיון מוגדר כ־other ולא כרישיון קוד פתוח סטנדרטי דוגמת MIT או אפאצ'י. הוא שוחרר תחת הרשאות של Shakker AI והיוצר Dote, מה שאומר שאסור להניח שמותר להשתמש בו במוצר מסחרי. מי שמתכנן להפיץ אותו באפליקציה חייב לבדוק ישירות מולם את תנאי השימוש המדויקים כדי לא להסתבך עם זכויות יוצרים.

הרישיון המלא בעמוד המודל ↗