GPT
T

Taiyi-Stable-Diffusion-1B-Chinese-v0.1

קוד פתוח

IDEA-CCNLcreativeml-openrail-m2022-10-31

  • diffusers
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image
  • zh

גרסה מוקדמת של סטייבל דיפיוז'ן שמיועדת להזנת פרומפטים ישירות בסינית. מתאים למי שצריך תמונות מביטויים ומושגים מקומיים בלי תרגום לאנגלית בדרך.

  • 8.9 GBמשקל הקבצים
  • 499הורדות בחודש
  • 442לייקים

מה זה

במקום לאמן מודל תמונה מאפס או לתרגם טקסט באנגלית, הצוות של פנגשנבאנג לקח את סטייבל דיפיוז'ן 1.4 המקורי והחליף לו את רכיב הטקסט. הם הקפיאו את כל חלקי יצירת התמונה ואימנו אך ורק מקודד טקסט סיני מסוג טאיאי קליפ רוברטה כדי לחבר ביטויים בסינית ישירות לייצוג הוויזואלי הקיים.

האימון נעשה על עשרים מיליון צמדי תמונה וטקסט שסוננו משני מאגרים סיניים גדולים, לפי ציון דמיון של מעל 0.2 במדד קליפ. התהליך רץ על שלושים ושניים כרטיסי אי מאה במשך מאה שעות בסך הכול עבור אֶפּוֹק יחיד. התוצאה היא מודל שיודע להבין שירה סינית קלאסית, ניבים או תיאורי מקומות, בלי לאבד את יכולת הציור הכללית של הגרסה המקורית שעליה הוא נשען.

מתאים ל

  • יצירת איורים מפרומפט סיני

    מבין שירה סינית עתיקה וביטויים תרבותיים ישירות מהטקסט, בלי תיווך של תרגום לאנגלית שמאבד כוונה.

  • אימון דרימבוט מותאם לסין

    מאפשר לבצע כוונון עדין על אובייקטים וסגנונות מקומיים באמצעות התשתית והמדריכים של הפרויקט.

  • שילוב בממשקי ווב מקומיים

    מתחבר ישירות לתוכנות ממשק משתמש קיימות של סטייבל דיפיוז'ן עבור יוצרים שכותבים בסינית בלבד.

איפה זה נופל

הכרטיס מצהיר בפירוש שמדובר בגרסה ראשונית מאוד שנלמדה על אפוק בודד בלבד. עשרים מיליון דוגמאות זה מאגר מסונן יחסית אך צנוע, ומקודד הטקסט עלול לפספס תיאורים מורכבים. בנוסף, רכיב התמונה הבסיסי נשאר מודל ישן מסוף 2022, כך שכל הבעיות המקוריות של עיוותי אנטומיה, ידיים ושילוב טקסט בתוך הציור קיימות כאן במלואן. עברית לא נתמכת בכלל.

שאלות
נפוצות

אפשר להזין לו הנחיות בעברית או באנגלית?

עברית לא תעבוד בכלל כי מקודד הטקסט אומן על סינית בלבד. לגבי אנגלית, אף שהמפתחים מציינים רקע דו לשוני, הדגש המוחלט של האימון הוא סינית, כך שעבור אנגלית עדיף להשתמש בסטייבל דיפיוז'ן רגיל.

כמה זיכרון וידאו צריך בפועל בשביל להריץ אותו?

בטעינה של חצי דיוק המודל דורש כרטיס מסך עם לפחות שישה עד שמונה גיגה בייט של זיכרון ייעודי כדי לייצר תמונה ברזולוציה סטנדרטית. אם תנסו לטעון אותו בדיוק מלא, תצטרכו כרטיס חזק בהרבה.

איך מריצים

מריצים אותו בקלות דרך ספריית דיפיוזרס בפייתון עם פייפליין סטנדרטי של סטייבל דיפיוז'ן. הורדת המשקלים דורשת קרוב לתשעה גיגה בייט, ובשביל מהירות סבירה וחיסכון בזיכרון צריך כרטיס אנבידיה עם תמיכה בחישובי חצי דיוק וטעינה ישירה לקודה.

אם אין לכם כרטיס גרפי מתאים בשרת, המודל הזה כבד מדי למעבד רגיל. במקרה כזה עדיף לפנות למרחב ההדגמה בגרדיו או להרים שרת מנוהל לעיבוד תמונה, במיוחד אם אתם רק בודקים התאמה לפרויקט.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("IDEA-CCNL/Taiyi-Stable-Diffusion-1B-Chinese-v0.1")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא קריאייטיב אם אל אופן רייל אם. מותר להשתמש בו לצרכים מסחריים ומחקריים בחינם, בתנאי ששומרים על הגבלות השימוש המוגדרות ברישיון נגד יצירת תוכן פוגעני, מסוכן או מטעה, ומצרפים את נוסח הרישיון המקורי למשתמשי הקצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗