GPT
D

DucHaitenAIart

קוד פתוח

DucHaitencreativeml-openrail-m2022-12-28

  • diffusers
  • safetensors
  • stable-diffusion
  • text-to-image
  • image-to-image

הכלאה בין אנימה תלת ממדית לחומרים ריאליסטיים, עם צבעוניות עמוקה ותאורה מוקפדת. אם אתם מכוונים לסגנון פיקסאר מלוטש שלא דורש תיקוני פנים נוספים, הוא נותן מענה ישיר.

  • 860Mפרמטרים
  • 82.7 GBמשקל הקבצים
  • 1,200הורדות בחודש
  • 181לייקים

מה זה

המודל הזה לוקח יצירת תמונות מטקסט לכיוון מאוד מוגדר של אנימה בתלת ממד עם טקסטורות ריאליסטיות. עם 860 מיליון פרמטרים, הוא מתבסס על ארכיטקטורת תמונות מוכרת אך מכויל להפיק חדות גבוהה, זוויות צילום מגוונות ותאורה מורכבת ישר מהפרומפט, בלי צורך בכלים נלווים להגדלה או לתיקון פנים.

היוצר מעיד שגרסה זו מקבלת תיאורים מורכבים יותר מהגרסאות הקודמות, אם כי היא פחות גמישה ואקראית מגרסת הבטא הישנה. הוא מיועד בעיקר למי שמחפש דמויות מסוגננות ומלוטשות באנגלית, ויודע לייצר גם תוכן למבוגרים אם דוחפים אותו לשם באמצעות מילות מפתח מתאימות.

מתאים ל

  • יצירת דמויות תלת ממד

    מתאים לעיצוב קונספט של דמויות בסגנון פיקסאר ואנימה, כשהמטרה היא תאורה חיה בלי צורך בריטוש ידני.

  • איורי פנטזיה ודוגמנות

    מפיק תנוחות גוף מורכבות ותאורה ריאליסטית לפי תיאור טקסטואלי מפורט באנגלית.

  • הפקת תוכן למבוגרים

    מסוגל לייצר תמונות עירום מסוגננות בעזרת תיוג מתאים, אף שאינו מיועד להארדקור מוחלט.

איפה זה נופל

הסגנון נוטה חזק מאוד לאנימה תלת ממדית, ולא כולם יאהבו את המראה הזה. היוצר מציין מפורשות שדמויות של מפורסמים כבר לא עובדות טוב בגרסה הזו, ושיש בעיה קבועה בפרטים של שיניים. מעבר לזה, המודל דורש רשימה ארוכה וכבדה של מילות שלילה ומילות איכות קבועות כדי להיראות טוב, ואם מוסיפים יותר מדי מילות חדות, הוא מתחיל להתעלם משאר הפרומפט.

שאלות
נפוצות

האם חייבים להוריד את כל 82 הגיגה כדי להשתמש במודל?

ממש לא. המשקל העצום נובע מכך שהמאגר מכיל עשרות קבצים מגרסאות שונות של הפיתוח, כולל גרסאות בטא ישנות. בפועל אתם צריכים להוריד רק את קובץ המשקולות של גרסה 3.1 שבו אתם מתכוונים להשתמש.

האם המודל עובד טוב עם טקסטים והנחיות בעברית?

לא, השפה הנתמכת לפי התיעוד היא אנגלית בלבד. כדי לקבל תוצאות מדויקות תצטרכו לכתוב פרומפטים באנגלית, ורצוי להשתמש בהנחיות האיכות והשלילה שהיוצר ממליץ עליהן.

איך מריצים

טכנית מריצים אותו דרך ספריית diffusers בפייתון, והוא נשען על הדוגם DPM++ 2S a Karras לתוצאות הטובות ביותר. בשביל מודל של 860 מיליון פרמטרים מספיק כרטיס מסך ממוצע עם 8 עד 12 גיגה זיכרון כדי לייצר תמונה במהירות סבירה.

הבעיה האמיתית היא נפח האחסון. המאגר כולל 33 קבצים ששוקלים יחד 82.7 גיגה בייט, בגלל גרסאות שונות כמו v3.1 ובטא ישנות שנשמרו שם יחד. במקום להוריד את כל המאגר העצום הזה לשרת מקומי, עדיף לבודד רק את קובצי המשקולות הספציפיים שאתם צריכים.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("DucHaiten/DucHaitenAIart")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא CreativeML OpenRAIL-M. הוא מאפשר שימוש מסחרי, אבל מטיל מגבלות שימוש ספציפיות כמו איסור על הפצת תכנים פוגעניים, יצירת מידע רפואי מוטעה או פעולות לא חוקיות. אם אתם משלבים אותו במוצר שלכם, אתם מחויבים לכלול את תנאי הרישיון ולהחיל את אותן הגבלות שימוש על המשתמשים שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗