GPT
D

DreamlikeArt-Diffusion-1.0

רץ בדפדפן

phenomenon1981רישיון לא דווח2023-01-07

  • gradio

ממשק פשוט שמייצר שתי תמונות מטקסט בעזרת מודל הציור Dreamlike Diffusion. מתאים למי שרוצה לבדוק סגנון אמנותי ספציפי בלי להתקין סביבת עבודה מקומית.

  • הורדות בחודש
  • 93לייקים

מה זה

אתם מקלידים תיאור קצר בתיבת הטקסט, ומקבלים שתי תמונות שנוצרות במקביל. הקוד מחבר בין שני כלים שונים: מצד אחד מודל התמונות dreamlike-art/dreamlike-diffusion-1.0, ומצד שני מחולל פרומפטים בשם MagicPrompt Stable Diffusion שנועד להרחיב רעיונות בסיסיים לתיאורים מפורטים יותר בלחיצת כפתור אחת.

בממשק יש סליידר שנקרא Noise Level עם טווח שנע בין אפס לשלוש בקפיצות של 0.1, לצד שתי תיבות טקסט נפרדות. הטכניקה מבוססת על מודל דיפיוז'ן שעבר אימון ספציפי כדי לייצר מראה אמנותי מובהק, בשילוב הרחבת הטקסט האוטומטית שמוסיפה פרטים ויזואליים לפני הרינדור עצמו.

מתאים ל

  • בדיקת סגנון התמונות

    צפייה מהירה בתוצאות שמפיק המודל מול תיאור טקסטואלי חופשי.

  • הרחבת רעיונות לכתיבה

    שימוש במחולל הפרומפטים המובנה כדי לקבל ניסוחים עשירים לתמונות.

  • ניסוי ברמות רעש

    בדיקת השפעת מחוון הרעש מטווח אפס עד שלוש על התוצר הסופי.

איפה זה נופל

הבעיה המיידית היא שההדגמה שבורה ולא זמינה לשימוש בגלל RUNTIME_ERROR. בנוסף, חומרת מעבד בסיסית לא מתאימה להרצת מודלי דיפיוז'ן בקצב סביר, כך שגם אם המתכנת יתקן את התקלה, זמן ההמתנה יהיה ארוך ומייגע. אין כאן הגדרות מתקדמות כמו גודל תמונה, מספר צעדים או סיד ספציפי לשחזור תוצאות, אלא רק מחוון רעש אחד.

שאלות
נפוצות

האם האפליקציה עובדת כרגע בדפדפן?

לא, נכון לעכשיו היא נמצאת במצב של שגיאת ריצה ואי אפשר לייצר דרכה תמונות. תצטרכו להמתין שמי שבנה אותה יעדכן את הקוד או יתקן את התלויות. עד שזה יקרה, הממשק פשוט תקוע ולא מגיב.

כמה זמן לוקח לייצר תמונה?

האפליקציה מוגדרת על מעבד בסיסי ללא מאיץ גרפי. יצירה של שתי תמונות במקביל על חומרה כזאת עשויה לקחת דקות ארוכות לכל בקשה. זו חומרה חלשה מאוד עבור מודלים מהסוג הזה.

האם אפשר להריץ את הכלי באופן מקומי?

הקוד בנוי בעזרת ספריית gradio וטוען את המודל ישירות. מי שיש לו סביבת פייתון מתאימה וכרטיס מסך טוב יכול להוריד את הקבצים ולהריץ אותם על המחשב שלו. זה גם יפתור את בעיית האיטיות של המעבד הציבורי.

במה הממשק הזה שונה משימוש ישיר במודל?

הממשק הזה מציע שכבת עזר בדמות כפתור שמייצר פרומפטים מורחבים באופן אוטומטי. הוא מחבר בין שני מודלים שונים כדי לחסוך לכם כתיבה מפורטת. עם זאת, הוא מחסיר שליטה על פרמטרים טכניים חשובים אחרים.

איך משתמשים

בפועל אתם כותבים רעיון, יכולים ללחוץ על Magic Prompt כדי לקבל הרחבה לניסוח, מכוונים את רמת הרעש ולוחצים על כפתור Generate Images. כרגע אי אפשר באמת להריץ את זה, כי האפליקציה נמצאת במצב שגיאת ריצה. מעבר לזה, החומרה שמוגדרת לה היא מעבד בסיסי בלבד, מה שאומר שגם כשהיא חוזרת לפעול, יצירת שתי תמונות על מעבד כזה לוקחת המון זמן ביחס לכרטיס מסך ייעודי.

הרישיון

הרישיון לא דווח בעמוד של האפליקציה. המשמעות היא שאין הרשאה ברורה ומפורשת לשימוש מסחרי בתמונות שיוצאות ממנה, וקשה לדעת מה המעמד החוקי של התוצרים בלי לבדוק בנפרד את תנאי השימוש של המודל המקורי.

הרישיון המלא ב־Hugging Face ↗