GPT
A

Anything2Real

קוד פתוח

lrzjasonapache-2.02026-01-03

  • diffusers
  • lora
  • image-to-image

המודל ממיר איורים, ציורים ודמויות אנימה לתמונות שנראות מצולמות. הוא שומר על הקומפוזיציה המקורית ומלביש עליה תאורה ומרקם של תצלום אמיתי.

  • 1.7 GBמשקל הקבצים
  • 166,153הורדות בחודש
  • 138לייקים

מה זה

מדובר באימון LoRA שמיועד למשימות תמונה לתמונה, ספציפית מעל מודל הבסיס Qwen Edit 2511 וגם Flux2 Klein. במקום לנסח פרומפט מחדש ולקוות שהמחשב יבין את הזווית, המודל הזה לוקח את האיור הקיים, מזהה את הדמויות והעצמים, ומשנה רק את הסגנון לצילום ריאליסטי. המשקל הכולל של הקבצים עומד על 1.7 גיגה בייט, כך שמדובר בתוספת קלה יחסית שמתלבשת על מודל עריכה קיים.

הגרסה הזו, שנקראת 2601 A, משלבת משקלי שכבות מגרסאות קודמות כדי לפתור פשרות מעצבנות. הגרסה שקדמה לה התקשתה מאוד בהמרת עיניים מצוירות למבנה אנושי אמין, בעוד גרסת האלפא שלטה טוב בתאורה וצל אבל איבדה את הצבעוניות המקורית. המטרה כאן היא לייצר איזון בין שמירה על תווי היצירה המקורית לבין תאורה וסביבה שנראות כמו צילום אמיתי ולא כמו רינדור תלת ממד פלסטיקי.

מתאים ל

  • המרת איורי קונספט לצילום

    מאפשר לבדוק איך סקיצה או ציור דמות ייראו בעולם האמיתי בלי לבנות פרומפט מאפס.

  • ריאליזם לאנימה וקומיקס

    מתאים ליוצרים שרוצים לקחת ציורים קיימים ולהפיק מהם גרסה ריאליסטית ששומרת על הפוזה המקורית.

  • עריכת תמונות מבוססת Qwen

    משתלב ישירות בתוך צינורות עבודה קיימים של Qwen Edit 2511 לצורך פוטוריאליזם מהיר.

איפה זה נופל

ההגדרה של ריאליזם סובייקטיבית מאוד והיוצר מודה במפורש שלא תמיד מגיעים לתוצאה משכנעת. העלאת עוצמת המודל מעבר לטווח המומלץ לא תפתור בעיות אמינות אלא רק תשבור את התמונה, ובמקרים כאלה צריך לשלב LoRA נוסף של ריאליזם או להחליף מודל בסיס. בנוסף, חובה לצרף תיאור טקסטואלי מפורט לצד התמונה כדי שהמערכת תבין נכון את הפרטים הקטנים, אחרת ההמרה עלולה לייצר עיוותים באזורים מורכבים.

שאלות
נפוצות

האם המודל הזה עובד לבד מייצור טקסט?

לא. מדובר במשקלי LoRA למשימת תמונה לתמונה, והוא דורש מודל בסיס כמו Qwen Edit 2511 או Flux2 Klein יחד עם תמונת קלט שרוצים להמיר.

מה לעשות אם התוצאה עדיין נראית מצוירת או לא אמינה?

היוצר ממליץ לא להעלות את העוצמה מעל 1, אלא להוסיף תיאור מילולי מדויק יותר של התמונה, להחליף מודל בסיס, או לשלב LoRA נוסף של פוטוריאליזם.

איך מריצים

כדי להריץ אותו צריך מודל בסיס תואם, בעיקר Qwen Edit 2511 או Flux2 Klein, ואת ספריית diffusers או סביבת ComfyUI. הריצה המומלצת מבוססת על כרטיס כמו RTX 4090, בעיקר בגלל הדרישות של מודל הבסיס ולא בגלל קובץ ה־LoRA עצמו שתופס נפח קטן. משתמשים בפרומפט פשוט בנוסח של בקשת שינוי לצילום ריאליסטי בתוספת תיאור התמונה, עם עוצמת מודל שבין 0.75 ל־1.0.

אם אין לכם כרטיס מסך חזק מקומית, עדיף להריץ את ה־workflow על שירותי ענן דוגמת RunningHub שכבר מציעים תבנית מוכנה למודל הזה. מי שמחפש תוצאה יותר תלת ממדית יכול לבחור בקובץ f2k_anything2real, בעוד שקבצי ה־A מכוונים ספציפית למראה ריאליסטי נקי.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("lrzjason/Anything2Real")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים ופרטיים, לשנות את הקוד ולהפיץ אותו הלאה, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי. אין כאן הגבלה על מכירת תוצרים שנוצרו בעזרתו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗