GPT
E

Ekmix-Diffusion

קוד פתוח

EK12317creativeml-openrail-m2022-12-18

  • diffusers
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image
  • en

שילוב מודלים ליצירת תמונות אנימה ואמנות פסטל מסוף 2022. הוא מיועד למי שמחפש סגנון מאויר עם קווים חדים ומוכן להוריד עשרות גיגה־בייט.

  • 52.2 GBמשקל הקבצים
  • 2,625הורדות בחודש
  • 60לייקים

מה זה

המאגר הזה מכיל גרסאות מיזוג של מודלי תמונה מבוססי דיפיוז'ן, בדגש על שילוב בין ריאליזם לאנימה וסגנון המוגדר כפסטל. היוצר שילב כאן כמה מודלים ורכיבי LoRA שונים ביחסים ספציפיים, כולל שימוש בטכניקת מיזוג לפי שכבות (block weighted merge).

במקום מודל אחד ממוקד, המאגר מציע פיצול לכמה כיוונים סגנוניים כמו Ekmix-Pastel ו־Ekmix-gen4, לצד תוספות Hypernetworks. אין כאן מדידות ביצועים מסודרות או בנצ'מרקים, אלא דוגמאות פרומפטים ישירות ממשק WebUI, עם הגדרות ספציפיות כמו Clip skip ברמה 2 ודגימת DPM++ 2M Karras או Euler a.

מתאים ל

  • איורי דמויות אנימה

    המודל כוונן ספציפית לפרומפטים מפורטים של דמויות בסגנון יפני עם דגש על שיער ועיניים.

  • תמונות בסגנון פסטל

    גרסת הפסטל שלו מיועדת ליצירת מראה רך עם קווי מתאר ברורים בלי לאבד פרטים.

  • שילוב LoRA ידני

    המאגר כולל סקריפטים וקבצים מפוצלים למי שרוצה להמשיך למזג משקלים ביחסים מותאמים אישית.

איפה זה נופל

הכרטיס מציג עבודה נסיונית בלי שום תיעוד מסודר על נתוני האימון. היוצר עצמו מציין שחלק מתוספי ה־Hypernetworks (סגנונות 3 ו־4) אינם מוצלחים ודורשים אימון מחדש, והתוצאות תלויות מאוד בפרומפט שלילי אגרסיבי כדי לא לקבל תמונות באיכות ירודה. בנוסף, המודל מכוון רק לאנגלית, לא נבדק על משימות כלליות מעבר לדמויות אנימה, ולא מתאים כבסיס למוצר שדורש יציבות או תוצאות מגוונות.

שאלות
נפוצות

חייבים להוריד את כל 52 הגיגה כדי לעבוד איתו?

לא. המאגר מכיל גרסאות שונות, קובצי LoRA ורכיבים נפרדים. אפשר לבחור רק את קובץ המודל הרלוונטי שרוצים לבדוק, למשל גרסת ה־safetensors המרכזית, ולחסוך את רוב שטח האחסון.

המודל מבין הנחיות בעברית?

לא. המודל מוגדר עבור השפה האנגלית בלבד, וכל דוגמאות הפרומפטים שנבדקו עליו מסתמכות על תגיות באנגלית בסגנון המקובל במאגרי תמונות אנימה.

איך מריצים

לא מורידים כאן קובץ בודד ורצים. המאגר שוקל 52.2 גיגה־בייט ומחולק ל־37 קבצים שכוללים משקלים, קובצי LoRA שונים ורכיבי Hypernetworks, כך שצריך לבחור ידנית את הקובץ או המיזוג הספציפי שרוצים לבדוק.

בשביל להריץ אותו צריך כרטיס מסך ביתי סביר עם זיכרון ייעודי, בעבודה מקומית דרך ספריית diffusers או ממשקי Stable Diffusion מוכרים. אין למודל הזה שירות API מנוהל ומוכן, כך שאם אתם רוצים להשתמש בו, תצטרכו להוריד את הקבצים ולהרים את התשתית בעצמכם.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("EK12317/Ekmix-Diffusion")
img = pipe("a photo").images[0]

הקבצים

37 קבצים במאגר, 52.2 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא creativeml-openrail-m. הוא מתיר שימוש מסחרי ויצירת תוצרים חופשית, אבל מטיל מגבלות שימוש מוגדרות שאוסרות על פגיעה באנשים, יצירת תוכן מזיק או הטעיה. אם אתם משלבים אותו במוצר, אתם מחויבים לכלול את תנאי הרישיון ולהעביר את המגבלות האלה הלאה למשתמשי הקצה שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗