GPT
Z

Z-Image-Lora

קוד פתוח

nphSiapache-2.02025-12-01

  • diffusers
  • text-to-image
  • lora
  • safetensors
  • z-image

מאגר ענק של קבצי LoRA שמיועד לייצר פנים של מאות מפורסמים ודמויות מוכרות. הוא מתאים למי שרוצה לשלב דמויות ספציפיות ישירות במודל Z-Image.

  • 33.1 GBמשקל הקבצים
  • 261,557הורדות בחודש
  • 147לייקים

מה זה

זהו אוסף מסיבי הכולל קרוב לאלף קבצי משקולות LoRA נפרדים שפותחו עבור משפחת המודלים Tongyi-MAI Z-Image, כולל גרסת הטורבו. המשקל הכולל מגיע ל־33.1 גיגה בייט, כאשר כל קובץ אומן ברזולוציה של מגה פיקסל אחד באמצעות OneTrainer על בסיס תמונות מהרשת הציבורית. המטרה הבלעדית של החבילה היא דיוק תווי פנים של שחקנים, ספורטאים ודמויות תרבות.

השוני העיקרי כאן לעומת מודלים כלליים הוא הצורך בתחביר קפדני מאוד. המודלים אומנו עם מילות הפעלה ייחודיות בתבנית שכוללת סוגריים וקידומת קבועה. כתיבה גנרית לחלוטין תיכשל ולא תפעיל את המאפיינים שנלמדו. בנוסף, קיימות מילות מפתח מיוחדות לשילוב מאפיינים כאשר קובץ בודד מכיל מספר מטרות אימון במקביל.

מתאים ל

  • יצירת דמויות ידועות בתמונות

    המודל מאפשר הזרקת תווי פנים מדויקים של מאות אנשי ציבור ומפורסמים לתוך מנוע Z-Image.

  • בדיקת התאמה לדמויות שונות

    מאגר הקבצים המגוון מתאים לבחינת היכולת של Z-Image לשמור על דיוק פנים בתנאי תאורה שונים.

  • שילוב LoRA ברינדור מהיר

    המשקולות נבדקו עם גרסת הטורבו של Z-Image ב־9 צעדי דגימה בלבד לקבלת תוצאות תוך שניות.

איפה זה נופל

המודל תלוי לחלוטין במילות הטריגר המדויקות. אם תכתבו תיאורים כלליים כמו אישה או תשתמשו בתיוגים רגילים, לא תקבלו את הדמות הרצויה. היוצר מציין במפורש שמות שמבלבלים את המודל, ומקרים שבהם הידע הפנימי של מודל הבסיס מוגבל או מצונזר ומחייב להסיר את השם האמיתי מהפרומפט. נוסף על כך, היוצר אוסר על יצירת תוכן עירום או פורנוגרפיה של מפורסמים, וההיבט המשפטי של שימוש בדמויות אמיתיות במוצר מסחרי בעייתי מאוד.

שאלות
נפוצות

האם צריך להוריד את כל 33 הגיגה בייט כדי לעבוד?

לא. המאגר מורכב ממאות קבצים נפרדים, וכל קובץ אחראי על דמות אחרת. מורידים רק את הקובץ של הדמות הספציפית שרוצים להפיק וטוענים אותו מעל מודל הבסיס.

איך לגרום למודל לייצר את הפנים הנכונות?

חייבים להשתמש במילת ההפעלה המדויקת של אותה דמות לפי ההוראות, כולל הקידומת הייעודית בסוגריים. פרומפט רגיל לא יפעיל את המשקולות של ה־LoRA כראוי.

איך מריצים

אין שום סיבה להוריד את כל 33 הגיגה בייט למחשב. השימוש הנכון הוא לבחור רק את קובץ ה־safetensors שרלוונטי לדמות שאתם צריכים, ולטעון אותו בעזרת diffusers מעל מודל הבסיס של Z-Image. תהליך היצירה נשען על המפרט של מודל הבסיס, כאשר בתמונות התצוגה המפתח השתמש בגרסת הטורבו בקוונטיזציה של Q8 עם דוגם Euler ורק 9 צעדים.

אם אין לכם כרטיס מסך חזק שמסוגל להחזיק את Z-Image בזיכרון ה־VRAM, להריץ מקומית יהיה סיוט ארוך ואיטי. במקרה כזה, עדיף בהרבה לשלוח את הפרומפטים למופע ענן שכור לפי שעה או שירות API שמחזיק את המודל וטוען את שכבת ה־LoRA הרצויה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("nphSi/Z-Image-Lora")
img = pipe("a photo").images[0]

הקבצים

996 קבצים במאגר, 33.1 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0, שמאפשר שימוש מסחרי, שינוי והפצה של הקוד והמשקולות. עם זאת, היוצר מצרף תנאי שימוש נוקשים שאוסרים על יצירת תוכן עירום או זיופים של מפורסמים. מעבר להגבלות הרישיון היבש, שימוש מסחרי בדמויות של אנשים אמיתיים כפוף לחוקי פרטיות וזכויות פרסום.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗