GPT
A

AnyLoRA

קוד פתוח

Lykoncreativeml-openrail-m2023-03-23

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

מודל תמונה שמבוסס על סטייבל דיפיוז'ן 1.5 ומיועד לייצור תמונות מטקסט. מי שמחפש בסיס מאומן היטב להרצת שכבות לורה ימצא כאן נקודת זינוק מוכרת.

  • 860Mפרמטרים
  • 41.8 GBמשקל הקבצים
  • 7,355הורדות בחודש
  • 51לייקים

מה זה

מדובר בכוונון עדין של ראנוויי 1.5 שיושב על ארכיטקטורה של שמונה מאות ושישים מיליון פרמטרים. המטרה של המודל היא לספק בסיס יציב שמגיב טוב לפרומפטים באנגלית ומסתדר עם תוספות אימון חיצוניות, בלי לשבור את המבנה המקורי של סטייבל דיפיוז'ן.

המשקל הכולל של הריפוזיטורי מגיע ליותר מארבעים ג'יגה בגלל עשרות קבצים וגרסאות שמורות, אבל המודל עצמו רץ על פייפליין סטנדרטי של ספריית דיפיוזרס. היוצר לא צירף לכרטיס מדדי ביצועים מספריים או מבחני השוואה מסודרים, אלא רק דוגמת קוד עם סדרן מסוג דיס מולטי-סטפ שמכוון לקבלת תמונה חדה בעשרים צעדים בלבד.

מתאים ל

  • אימון שכבות התאמה

    הוא משמש כבסיס יציב לאימון והרצה של קובצי לורה ספציפיים לסגנונות או דמויות.

  • יצירת פורטרטים

    ההגדרות המוצעות על ידי היוצר מפיקות דמויות חדות ומפורטות בעשרים צעדי ריצה בלבד.

  • ריצה מקומית על חומרה זולה

    הוא מתאים למי שרוצה לייצר תמונות על מחשב ביתי בלי לשלם על כרטיסי מסך יקרים.

איפה זה נופל

הכרטיס לא מפרט על מה בדיוק המודל אומן ולא מציג שום מדידות השוואתיות מול גרסאות אחרות. בנוסף, הוא מבין רק אנגלית, כך שפרומפטים בעברית יפיקו תוצאות שבורות לחלוטין. נפח הקבצים בשרת מנופח מאוד ביחס למודל בודד, מה שמחייב זהירות בהורדה כדי לא לסתום את הדיסק סתם.

שאלות
נפוצות

האם צריך להוריד את כל 41 הג'יגה-בייט כדי להשתמש בו?

לא, התיקייה מכילה קבצים כפולים וגרסאות שמורות שונות. בקוד הטעינה מגדירים משיכה של קובצי חצי דיוק בלבד, והספרייה תוריד רק את הקבצים הנחוצים להרצה שתופסים כמה ג'יגה בודדים.

האם המודל תומך בהנחיות בעברית?

לא, המודל אומן ומיועד לשפה האנגלית בלבד. אם תכתבו פרומפט בעברית תקבלו תמונות חסרות הקשר, כך שחובה לתרגם את הטקסט לאנגלית לפני ששולחים אותו לפייפליין.

איך מריצים

כדי להריץ אותו מקומית טוענים את המשקלים דרך ספריית דיפיוזרס עם טורץ' בחצי דיוק. כרטיס מסך ביתי עם שמונה ג'יגה זיכרון וידאו יספיק פה בלי בעיה, בדיוק כמו בכל מודל 1.5 רגיל, ואין שום צורך במערכי שרתים מורכבים.

הריפוזיטורי כולל שלושים ושבעה קבצים בנפח כולל של מעל 41 ג'יגה, כך שלא מושכים את כל התיקייה אלא מגדירים במפורש את גרסת הדיוק הרצויה. אם אתם צריכים רק תמונה בודדת פעם ביום, חבל להחזיק תשתית דולקת ועדיף לשלוח בקשה לנקודת קצה שמארחת אותו לפי קריאה.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Lykon/AnyLoRA")
img = pipe("a photo").images[0]

הקבצים

37 קבצים במאגר, 41.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא קריאייטיב אם-אל אופן-רייל אם. הוא מאפשר שימוש מסחרי ביצירות ובהפצה, אבל מחייב אתכם לכלול את תנאי הרישיון המקוריים ואוסר במפורש על שימושים פוגעניים, הפקת חומרים לא חוקיים או הטעיה של משתמשי קצה.

  • שימוש מסחרי
  • שינוי הקוד
  • מגבלות שימוש ברישיון

הרישיון המלא בעמוד המודל ↗