GPT
F

Flux2-Klein-9B-Consistency

קוד פתוח

dx8152apache-2.02026-03-05

  • diffusers
  • lora
  • image-to-image

הפיתוח הזה מיועד למי שמחפש עקביות ויזואלית בעיבוד תמונה לתמונה בלי להסתבך עם פרומפטים מורכבים. מדובר בהתאמת משקלים קלה שמתלבשת על בסיס קיים וחוסכת עבודה ידנית מיותרת.

  • 632 MBמשקל הקבצים
  • 46,344הורדות בחודש
  • 479לייקים

מה זה

מדובר במשקלי LoRA שמיועדים למשימות תמונה לתמונה, ומטרתם לשמור על עקביות חזותית של דמויות ופרטים בין יצירות שונות. היתרון המרכזי כאן הוא היכולת להשיג תוצאה אחידה בלי להזין מילות הנחיה מיוחדות או טריגרים מסורבלים, מה שמפשט את שרשרת העבודה בצורה ניכרת.

היוצר עדכן את הקבצים לגרסה שנייה בעקבות בעיות שעלו בהרצה המקורית. הגרסה הנוכחית מתמקדת בתיקון עיוותי צבע, ניקוי רעשים ופרטים עודפים שגרמו לתמונות להיראות מלוכלכות, וריסון רוויית יתר של צבעים שהופיעה ביצירות קודמות. זה פתרון ממוקד מאוד שבא לפתור חוסר יציבות שמוכר לכל מי שמייצר רצפי תמונות.

מתאים ל

  • שמירה על דמויות ברצף

    מאפשר לייצר רצף פריימים של אותה דמות בלי שינויי מראה חדים, ובלי צורך במילות מפתח ייעודיות.

  • עריכת תמונה לתמונה

    מתאים לשינוי סצנות קיימות תוך שמירה על המבנה והצבעים המקוריים ללא רוויית יתר.

  • צינורות יצירה באוטומציה

    משתלב בקלות בתוך ComfyUI או diffusers לפרויקטים שדורשים תוצאה אחידה בכמויות גדולות.

איפה זה נופל

הכרטיס מציג פתרונות לבעיות קודמות, אבל עצם התיקון מעיד על נקודות התורפה הטבעיות שלו. בגרסאות קודמות המודל נטה להעמיס פרטי סרק, ליצור תחושת לכלוך בתמונה ולהקפיץ את הרוויה לרמות לא טבעיות, וגם בגרסה מתוקנת צריך לבדוק היטב שגווני העור והצבעים הכלליים לא סוטים.

בנוסף, התיעוד לא כולל שום מדדים כמותיים או ציוני מבחן מסודרים, כך שאין דרך לדעת מראש איך הוא יתנהג על סגנונות שלא מופיעים בתמונות הדוגמה.

שאלות
נפוצות

האם הקובץ הזה כולל את כל המודל שצריך כדי לייצר תמונות?

לא. מדובר בקובצי LoRA קלים בנפח של 632 מגה בייט שנועדו להתלבש על מודל בסיס קיים. כדי לעבוד איתם תצטרכו להחזיק בסביבה שלכם את מודל הבסיס המתאים ולהפעיל אותם יחד.

האם צריך להגדיר מילות מפתח מיוחדות כדי להפעיל את העקביות?

לפי הצהרת היוצר אין צורך במילות טריגר או ניסוחים מיוחדים בפרומפט. המודל אמור לספק את השמירה על העקביות בצורה ישירה דרך מנגנון התמונה לתמונה.

איך מריצים

בגלל שמדובר בקובצי LoRA במשקל כולל של 632 מגה בייט ולא במודל מלא של תשעה מיליארד פרמטרים, ההורדה מהירה וההטמעה פשוטה. אתם טוענים את המשקלים ישירות לסביבת diffusers או מחברים אותם לתוך תהליך עבודה קיים בתוכנת ComfyUI לצד מודל הבסיס המתאים.

המשמעות היא שדרישות החומרה נגזרות לחלוטין ממודל הבסיס שעליו מלבישים את התוסף. אם יש לכם חומרה חלשה מכדי להחזיק מודל כזה בזיכרון המקומי, היוצר מפנה לשירותי ענן שבהם אפשר להריץ את התהליך דרך הדפדפן.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("dx8152/Flux2-Klein-9B-Consistency")
img = pipe("a photo").images[0]

הקבצים

6 קבצים במאגר, 632 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י 2.0. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של הקוד והמשקלים, ושילוב שלהם בתוך מוצרים סגורים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים וצירוף עותק של הרישיון המקורי בכל הפצה של הקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗