GPT
K

Kontext-Style-Loras

קוד פתוח

Owen777רישיון לא דווח2025-07-04

  • diffusers
  • Style
  • Ghibli
  • FluxKontext
  • Image-to-Image

אוסף של מתאמי סגנון שמיועדים להמרת תמונה לתמונה מעל מודל הבסיס של פלוקס קונטקסט. הוא נותן מענה מהיר כשרוצים להלביש סגנונות אמנותיים ואיוריים שונים על תמונה קיימת.

  • 7.4 GBמשקל הקבצים
  • 2,009הורדות בחודש
  • 129לייקים

מה זה

המאגר כולל מעל עשרים מתאמי לורה שונים שמיועדים להרצה מעל FLUX.1 Kontext Model עבור משימות תמונה לתמונה. הרעיון כאן הוא לקחת תמונת מקור ולהמיר אותה לשורה של סגנונות אמנותיים וסגנונות קריקטורה, במקום לנסח פרומפטים מורכבים מאפס ומבלי להחליף את כל מודל הבסיס.

האימון נעשה באמצעות קוד שהועלה לגיטהאב בשם Kontext-Lora-Trainer, והסתמך על זוגות תמונות ממאגר OmniConsistency שנוצרו בעזרת GPT-4o. המפרסמים לא שיתפו ציוני בנצ'מרק או מדידות איכות מספריות, אלא הציגו תמונות השוואה בלבד, כך שאי אפשר להסתמך על מדד טכני אובייקטיבי לגבי דיוק שמירת הפרטים של תמונת המקור.

מתאים ל

  • הסבת תמונות לאיור

    הלבשת סגנונות קריקטורה על תמונות קיימות באמצעות מתאמים ממוקדים שנבנו למשימה הזו.

  • בדיקות סגנון ויזואלי

    בחינה מהירה של עשרים סגנונות אמנות שונים ישירות דרך הספייס המקוון בלי צורך בהתקנה מקומית.

  • פיתוח עם diffusers

    שילוב מתאמי לורה בתוך צינור עיבוד תמונה מבוסס פלוקס בעזרת קוד האימון שהמפתחים שיתפו.

איפה זה נופל

כרטיס המודל דל במידע טכני ולא מספק שום מדד ביצועים, דרישות חומרה מדויקות או רשימה מסודרת של שמות עשרים הסגנונות. האימון התבסס לחלוטין על נתונים סינתטיים מבוססי מודל אחר, מה שעלול לגרור עיוותים או פגמים ויזואליים שקשה לחזות מראש. שפת התיוג היא אנגלית בלבד, ואין שום תיעוד לגבי היכולת של המתאמים לשמור על טקסט בתמונות או להתמודד עם הנחיות בעברית.

שאלות
נפוצות

האם חייבים להוריד את כל 7.4 הגיגה בייט של המאגר?

לא. המאגר מכיל 29 קבצים עבור מעל עשרים סגנונות שונים, והמפתחים יצרו מאגר נפרד לכל מתאם תחת הארגון Kontext-Style. אפשר למשוך רק את הסגנון המסוים שאתם צריכים לפרויקט.

האם אפשר להשתמש במודל הזה ישירות לייצור מוצר מסחרי?

כרגע לא מומלץ בכלל לעשות את זה. היוצרים לא דיווחו על רישיון שימוש, ובלי רישיון מוגדר אסור להניח שהשימוש המסחרי מותר. עדיף לפנות ליוצרים לפני שמשלבים את הקבצים במערכת מסחרית.

איך מריצים

כדי להריץ את המתאמים צריך להתקין את ספריית diffusers, לטעון את מודל הבסיס FLUX.1 Kontext, ולהלביש עליו את קובצי המשקולות הרצויים מתוך 29 הקבצים שבמאגר. המאגר כולו שוקל 7.4 גיגה בייט ומחולק בין הסגנונות השונים, כך שאתם לא חייבים להוריד הכל בבת אחת.

המפרסמים פתחו ספייס ייעודי בהאגינג פייס שמאפשר לבדוק את המתאמים ברשת בלי להוריד דבר. בנוסף הם חילקו את המתאמים למאגרים נפרדים בארגון Kontext-Style, מה שמקל על משיכת מתאם בודד במקום להסתבך עם כל החבילה המלאה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Owen777/Kontext-Style-Loras")
img = pipe("a photo").images[0]

הרישיון

לא דווח רישיון במאגר. מבחינה משפטית מדובר בשטח הפקר, ואתם לא יכולים לדעת אם מותר לשלב את המתאמים האלה במוצר מסחרי או להפיץ אותם הלאה. עד שהיוצרים לא יעדכנו רישיון מפורש, שילוב של הקבצים בפרודקשן מסחרי חושף אתכם לסיכון של הפרת זכויות יוצרים.

הרישיון המלא בעמוד המודל ↗