GPT
B

Boreal

קוד פתוח

kudzueyeרישיון לא דווח2024-08-12

  • diffusers
  • text-to-image
  • stable-diffusion
  • lora
  • flux

התאמת LoRA מוקדמת ל־Flux-Dev שנועדה לחלץ תמונות מציאותיות ופחות מלאכותיות. המטרה היא לשבור את עומק השדה הרדוד והמראה המעובד שמאפיין את מודל הבסיס.

  • 172 MBמשקל הקבצים
  • 137הורדות בחודש
  • 105לייקים

מה זה

מדובר ב־LoRA נסיוני בשם Boreal-FD שמיועד למודל Flux-Dev, ומבוסס על סט נתונים שמכוון למה שהיוצר מכנה Boring Reality. מודלי תמונה נוטים לייצר קומפוזיציות קבועות עם מרכז ברור, טשטוש רקע מוגזם ומראה פלסטי. המשקלים האלה מנסים להכריח את המודל להציג מרקם עור אמיתי, פוזות מגוונות, רקעים עמוקים ומורכבות סביבתית גבוהה יותר, במקום שוב אותה תמונת פרופיל מלוטשת.

הפרויקט נמצא בשלבי עבודה מוקדמים מאוד ומגיע עם אזהרה כנה מהמפתח. אין כאן הבטחה לתמונות מושלמות מהקופסה, אלא ניסיון להרחיב את טווח הידע הוויזואלי שהמודל מציג בלי שיסתיר אותו מאחורי קיצורי דרך אסתטיים. כדי להפעיל את ההשפעה של המשקלים בפרומפט, מילת ההפעלה הנדרשת היא photo.

מתאים ל

  • ריסון תאורה מוגזמת

    ניקוי האסתטיקה המבריקה של Flux-Dev לטובת מראה יומיומי ולא מבוים.

  • מרקם עור אותנטי

    יצירת דמויות עם פגמים טבעיים במקום עור פלסטי חלק מדי.

  • קומפוזיציה עם רקע עמוק

    בניית סצנות מורכבות ללא טשטוש רקע כבד שמסתיר את הסביבה.

איפה זה נופל

היוצר עצמו מצהיר שהתוצאות עלולות להיות מעוותות ורחוקות מלהיות טובות. קיימת בעיה מוכרת של נקודות דהויות על גבי התמונה, במיוחד כשמבקשים מושגים פחות מוכרים. בנוסף, גרסת ה־1000 צעדים נוטה להתאמת יתר חריפה, מה שפוגע בהבנת הפרומפטים ומייצר עיוותים ויזואליים. אל תבנו על זה למערכת בייצור, נדרשים פה המון ניסיונות עד שיוצא פלט שמיש.

שאלות
נפוצות

למה התמונות יוצאות מעוותות או עם נקודות מוזרות?

היוצר מציין במפורש שהמודל נמצא באימון יתר מוקדם. תופעת הנקודות הדהויות עדיין קיימת בגרסאות האלה, במיוחד במושגים מורכבים, ויש להוריד את עוצמת המשקלים או להחליף סיד כדי לעקוף את זה.

איך לגרום למודל להגיב למשקלים האלה?

חובה לכלול בפרומפט את מילת ההפעלה photo. מעבר לכך צריך להגדיר עוצמת LoRA בין 0.5 ל־2.0 וערכי guidance בין 3.0 ל־5.0 עד שמגיעים לאיזון הנכון.

איך מריצים

כדי להשתמש במשקלים האלה תצטרכו להלביש אותם מעל Flux-Dev בסביבת diffusers או ממשק כמו ComfyUI. קובצי ה־safetensors שוקלים בסך הכול 172 מגה בייט, כך שההורדה מהירה, אבל עצם ההרצה של מודל הבסיס דורשת מאיץ גרפי חזק מאוד עם זיכרון וידאו נרחב.

בפועל נדרש כאן המון כוונון ידני. המפתח ממליץ לשחק עם עוצמת ה־LoRA בטווח שבין 0.5 ל־2.0, ולכוון את ה־guidance בין 3.0 ל־5.0 לצד בדיקת מגוון רחב של סידים. אם אין לכם חומרה ייעודית שמריצה את Flux מקומית, פשוט תשלמו לפי שימוש בשירותי ענן שמאפשרים טעינת קובצי משקלים מותאמים אישית.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("kudzueye/Boreal")
img = pipe("a photo").images[0]

הרישיון

הרישיון לא דווח בעמוד המודל. במצב כזה אין אישור שימוש מוגדר, ואי אפשר לדעת אם מותר לשלב את המשקלים במוצר מסחרי או להפיץ אותם הלאה. מעבר לכך, מדובר בהתאמה ל־Flux-Dev, שמגיע עם תנאי שימוש מגבילים משל עצמו. כל עוד אין רישיון ברור, השימוש מתאים למחקר והתנסות אישית בלבד.

הרישיון המלא בעמוד המודל ↗