GPT
N

NetaYume-Lumina-Image-2.0

קוד פתוח

duongveapache-2.02025-08-06

  • diffusion-single-file
  • stable-diffusion
  • text-to-image
  • comfyui

מודל תמונה שמכוון בדיוק למי שצריך אסתטיקה של אנימה ומכיר תיוג של Danbooru. הוא שומר על יכולת ליצור אנשים ריאליסטיים בזכות בסיס חזק, אבל הדגש כאן הוא איור יפני מדויק.

  • 103 GBמשקל הקבצים
  • 139,260הורדות בחודש
  • 71לייקים

מה זה

מדובר בכיוונון עדין שנשען על Neta-Lumina ועל בסיס Lumina-Image-2.0 של מעבדת שנחאי, כשהמטרה המרכזית שלו היא שיפור של ממש באיכות איורי אנימה. החיבור הזה משלב שלד תמונה מכוונן עם מפענח ה־VAE של Flux.1 dev ומקודד הטקסט Gemma-2-2b. השילוב הזה נועד לתת מענה לשני עולמות: שמירה על ידע כללי וריאליזם מהמודל המקורי, לצד קווים חדים, צבעוניות עמוקה והצללות חלקות בסגנון יפני.

ההבדל מורגש בהבנה של דמויות מוגדרות מראש מתוך מאגר Danbooru ופרטים קטנים שנמרחים לעיתים קרובות במודלים כלליים, כמו טקסטורות של בגדים, אביזרים ותסרוקות מורכבות. אין כאן טבלת ציונים רשמית, אבל המבנה ההיברידי של הרכיבים מיועד להבנה טובה יותר של תגיות טקסטואליות ביחס למודלים שלא אומנו ספציפית על הדאטה-סט הזה.

מתאים ל

  • יצירת דמויות אנימה לפי תגיות

    הוא מאומן ישירות על Danbooru ומזהה שמות, בגדים ומאפיינים ספציפיים בדיוק גבוה.

  • איורי קונספט עם רקעים מורכבים

    הארכיטקטורה יודעת לייצר טקסטורות של בדים, אביזרים ופרטי רקע עשירים בלי להימרח.

  • שילוב ריאליזם ואיור יפני

    הבסיס מגיע מ־Lumina המקורי, מה שמאפשר מעבר מאנימה טהורה לדמויות אנושיות מציאותיות.

איפה זה נופל

הקובץ המרכזי שוקל המון, והכרטיס לא מספק נתוני מהירות, צריכת זיכרון מינימלית או מדדי השוואה מספריים מול מודלים פופולריים אחרים. בנוסף, כדי לקבל תוצאות מדויקות בדמויות אנימה צריך להשתמש בפורמט תיוג קשיח של Danbooru ובפרומפט מערכת ייעודי, מה שאומר שטקסט חופשי וטבעי לחלוטין עלול לתת תוצאות פחות עקביות.

שאלות
נפוצות

איך הכי נכון לכתוב לו פרומפטים כדי לקבל תוצאה טובה?

היוצר ממליץ להגדיר פרומפט מערכת קצר שמבהיר שהמודל מיועד לייצר תמונות על בסיס תגיות Danbooru. לאחר מכן, עדיף להזין תגיות מוגדרות ומוכרות מהמאגר ולא תיאורים ספרותיים ארוכים, לצד בחירה ב־40 עד 50 צעדים.

האם חייבים להוריד את כל 103 הגיגה-בייט שמופיעים במאגר?

לא בהכרח. המאגר מכיל קובץ all in one שמרכז את כל הרכיבים הדרושים לעבודה בתוך ComfyUI, כך שאפשר לחסוך מקום ולא להוריד את כל הגרסאות המפוצלות אם עובדים בסביבה הזו.

איך מריצים

ההורדה כבדה מאוד ומגיעה ל־103 גיגה-בייט שמפוזרים בעשרים ואחד קבצים, אם כי יש קובץ Safetensors יחיד שכולל את המקודד, ה־VAE והשלד לעבודה ישירה ב־ComfyUI. כדי להריץ משקלים כאלה בצורה סבירה מקומית, תצטרכו כרטיס מסך חזק עם זיכרון וידאו נדיב במיוחד, אחרת תיתקלו בזמני יצירה איטיים מאוד.

המפתח ממליץ על 40 עד 50 צעדי דגימה עם ערכי CFG שבין 4 ל־7, תוך שימוש בסאמפלר Euler a או res_multistep. אם אין לכם חומרה ייעודית מקומית עם שטח אחסון מהיר פנוי, עדיף להרים מופע ענן עם מעבד גרפי מתאים לפי שעה במקום להעמיס את המחשב האישי.

pip install -U huggingface_hub
hf download duongve/NetaYume-Lumina-Image-2.0

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו מחדש ולשלב אותו בקוד סגור, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי ומציינים שינויים אם נעשו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗