GPT
Q

Qwen-Image-Edit-2511-Anime

קוד פתוח

prithivMLmodsapache-2.02026-01-02

  • diffusers
  • lora
  • image-generation
  • anime
  • image-to-image

מתאם משקלים קטן שממיר תמונות קיימות לסגנון אנימה שטוח. הוא שומר על התנוחה והפרופורציות המקוריות בעזרת הנחיה בסיסית.

  • 225 MBמשקל הקבצים
  • 3,819הורדות בחודש
  • 52לייקים

מה זה

מדובר במתאם LoRA ששוקל 225 מגה בייט, המיועד לעבודה על גבי מודל הבסיס של Qwen לעריכת תמונות. המטרה כאן ממוקדת מאוד, לקחת תמונה נתונה ולהפוך אותה לאיור בסגנון cel shading בלי להרוס את הקומפוזיציה. הוא תואם לגרסאות 2509 ו־2511 של מודל המקור ומאומן לפעול עם מילת הפעלה קבועה.

בניגוד למודלים שמייצרים תמונה מאפס וממציאים זוויות, המתאם הזה שומר על הפרופורציות של האובייקט, זווית המצלמה והתנוחה של המקור. הכרטיס מציג חיבור למודל תאורה של ארבעה צעדים, מה שאמור לתת תוצאות חדות ומהירות בעיבוד הפיקסלים, בלי לחכות עשרות צעדי דיפוזיה.

כל הקבצים יושבים בפורמט שמתחבר ישירות לספריית diffusers הרגילה בפייתון. אין פה ארכיטקטורה חדשה אלא כוונון נקודתי שפותר בעיה ספציפית של שמירה על מבנה בעת מעבר בין סגנונות ויזואליים.

מתאים ל

  • המרת פורטרטים לאנימה

    הופך תמונות פנים לאיור תוך שמירה מלאה על זווית הראש והמבט המקוריים.

  • עיבוד מהיר לגרפיקה

    מאפשר הפקה מהירה בארבעה צעדי דיפוזיה בשילוב מודל תאורה מתאים.

  • סטיילינג עקבי לחיות וחפצים

    משמר את הפרופורציות של האובייקט המקורי בלי לעוות את הגבולות שלו.

איפה זה נופל

המתאם מוגבל לסגנון אנימה יחיד ומסתמך על מילת הפעלה ספציפית מאוד באנגלית. הוא לא נבדק על טקסט בעברית, והתיעוד מציין התאמה רק לאנגלית. בנוסף, חובה להחזיק ולהריץ את מודל הבסיס של Qwen כדי להשתמש בו, כך שאי אפשר להסתמך רק על הקבצים הקטנים שמורידים מכאן.

שאלות
נפוצות

האם אפשר להריץ את הקבצים האלה ישירות בלי מודל נוסף?

לא. זהו מתאם LoRA ששוקל 225 מגה בייט וחייב להיטען מעל מודל הבסיס Qwen-Image-Edit-2511 או 2509. בלעדיו אין לקבצים האלה יכולת ייצור עצמאית.

איזה פרומפט צריך להזין כדי לקבל את הסגנון?

היוצר הגדיר את הביטוי Transform into anime כמילת ההפעלה של המתאם. כדאי להשתמש בנוסח הזה כדי לוודא שהסגנון מוחל כמו שצריך על התמונה.

איך מריצים

טוענים את מודל הבסיס של Qwen דרך diffusers ב־bfloat16 ומלבישים עליו את משקלי ה־LoRA האלה. המשקל של המתאם עצמו זניח, אבל מודל הבסיס מחייב כרטיס מסך עם זיכרון גרפי מתאים, כאשר בסביבת אפל אפשר להפנות אותו ל־mps במקום ל־cuda.

בזמן הריצה מעבירים לתהליך את תמונת המקור יחד עם מחרוזת ההפעלה המדויקת באנגלית. אם אין לכם חומרה ייעודית להרצת מודל הבסיס ברקע, עדיף להשתמש בשרת מרוחק כי 225 המגה בייט האלה לא עובדים לבד בלי המנוע המלא מאחוריהם.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("prithivMLmods/Qwen-Image-Edit-2511-Anime")
img = pipe("a photo").images[0]

הקבצים

4 קבצים במאגר, 225 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים ופרטיים, לשנות את הקוד ולהפיץ אותו הלאה, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. לפני שילוב במוצר כדאי לוודא גם את תנאי הרישיון של מודל הבסיס שבו משתמשים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗