GPT
K

krea2-outpaint

קוד פתוח

yijunwang2other2026-07-14

  • diffusers
  • krea-2
  • lora
  • outpainting
  • image-editing

מתאם LoRA שמרחיב תמונות לקנבס גדול יותר תוך שמירה על הפיקסלים המקוריים ומיקומם המדויק. הוא מיועד לריצה מהירה של שמונה צעדים על Krea 2 Turbo.

  • 219 MBמשקל הקבצים
  • 2,385הורדות בחודש
  • 43לייקים

מה זה

מדובר במתאם rank-32 ששוקל 219 מגה-בייט ומיועד למשימות הרחבת תמונה. בשונה ממתאמי תמונה רגילים, הוא ממפה את הטוקנים של תמונת המקור לקואורדינטות של תיחום היעד בתוך גריד הלטנטים, מה שעוזר לו להבין בדיוק איפה המקור יושב ביחס לשאר הקנבס ולשמור על כיווני תאורה, פרספקטיבה ומרקמים.

ההרצה מתבצעת בשמונה צעדים בלבד מול מודל הבסיס Krea 2 Turbo, עם guidance scale מאופס ומשקל LoRA מלא. על כרטיס RTX 5090 בסביבת INT8, מעבר יחיד כזה לקח בין 3.6 ל־4.2 שניות ברזולוציות שנבדקו, לצד קידוד פרומפט של כעשירית השנייה. בסיום התהליך מוחזרים הפיקסלים המקוריים פנימה עם ריכוך קצוות של 32 פיקסלים כדי למנוע הבדלי פענוח בתפר.

מתאים ל

  • הרחבת תמונה לצדדים

    התאמת תמונות ריבועיות לפורמט רחב או אנכי בשמונה צעדים תוך שמירה מלאה על התמונה המקורית.

  • השלמת רקע סביב אובייקט

    בניית המשך לסצנות תלת-ממדיות, איורים או צילומים תוך התחשבות מדויקת במיקום המקור על הקנבס.

  • התאמת תמונות לעימוד גרפי

    הגדלת שטח התמונה לכיוון מוגדר מראש לפי קואורדינטות פיקסלים מדויקות.

איפה זה נופל

המתאם עובד רק על חלוקה מלבנית ולא מתאים למסכות מותאמות אישית או לתיקוני inpainting שרירותיים. שטחים חסרים גדולים מדי גורמים לו לייצר נושא שני או סצנה שלא קשורה למקור. בנוסף, מיקום תמונה במרכז מחייב שני מעברי גנרציה נפרדים, מה שעלול לצבור עיוותים ושינויים בין שלב לשלב, ותקציב הקידוד המוגבל ל־384 פיקסלים מעדיף מבנה כללי על פני שחזור פרטים זעירים.

שאלות
נפוצות

אפשר להשתמש בו לתיקון פגמים בתוך התמונה?

לא. הוא מיועד להרחבה מלבנית מחוץ לגבולות התמונה ולא יודע לעבוד עם מסכות מותאמות אישית של inpainting. לפעולות כאלה המפתח מפנה לגרסה אחרת בשם Krea 2 AnyPaint.

האם אפשר להטעין את המשקלים כ־LoRA רגיל ב־Diffusers?

לא, טעינה רגילה לא תעבוד. המתאם דורש טיפול מיוחד בקואורדינטות המקור ובזיכרון ה־K/V, ולכן חייבים להריץ אותו דרך קובצי הקוד שמגיעים איתו במאגר.

איך מריצים

אי אפשר לטעון אותו עם הקוד הרגיל של Diffusers או טועני LoRA סטנדרטיים. צריך להשתמש בקובצי הפייתון המצורפים בריפו, כמו pipeline.py ו־outpaint.py, שמטפלים בחישובי המיקום וב־K/V cache של המקור. דוגמת הקוד מוגדרת לרוץ ב־BF16, ודורשת התקנה של ספריות כמו diffusers, transformers, accelerate ו־safetensors.

מבחינת חומרה, המדידות בוצעו על RTX 5090 עם תשתית מכווצת ל־INT8, שאינה מצורפת לחבילה. אם אין לכם מעבד גרפי חזק שיכול להחזיק את מודל הבסיס Krea 2 ואת המתאם, הריצה המקומית ב־BF16 תהיה כבדה ואיטית בהרבה, ובמצב כזה עדיף לחפש פתרון מנוהל.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("yijunwang2/krea2-outpaint")
img = pipe("a photo").images[0]

הרישיון

המשקלים משוחררים תחת רישיון Krea 2 Community License ומחייבים עמידה בכללי השימוש שלו, כולל הוספת מנגנוני סינון תוכן וחובת גילוי שמדובר בתוכן שנוצר בבינה מלאכותית. קוד הפייתון והצינורות הנלווים מופצים תחת רישיון Apache-2.0.

הרישיון המלא בעמוד המודל ↗