GPT
S

Stable-Diffusion-3-FREE

רץ בדפדפן

markmagicרישיון לא דווח2024-06-12

  • gradio

הממשק מייצר תמונות מטקסט ישירות בדפדפן על בסיס מודל מדיום. הוא מיועד למי שרוצה לבדוק הנחיות טקסטואליות בלי להגדיר סביבת עבודה מקומית.

  • הורדות בחודש
  • 92לייקים

מה זה

אתם כותבים תיאור טקסטואלי ומקבלים תמונה בגלריה שבמסך. המערכת מבוססת על הקוד של diffusers וטוענת ישירות את המשקולות של stabilityai/stable-diffusion-3-medium ברמת דיוק של float16, יחד עם שימוש במתזמן מסוג DPMSolverMultistepScheduler.

מתחת לתיבת ההנחיה הראשית יש תפריט הגדרות מתקדמות. אפשר להפעיל בו הנחיה שלילית כדי להרחיק אלמנטים לא רצויים, לקבוע את ממדי התמונה בסליידרים של גובה ורוחב, לבחור כמה תמונות לייצר במקביל, ולכוון ידנית את מספר הצעדים ואת ערך הסיד. יש בממשק גם דוגמאות מוכנות שאפשר להריץ בלחיצה כדי לראות איך המודל מגיב להנחיות ספציפיות בלי לנחש ערכים מהראש.

מתאים ל

  • בדיקת הנחיות טקסט

    כתיבת תיאור ובדיקה מהירה של האופן שבו המודל מפרש מילים וסגנונות.

  • השוואת הגדרות יצירה

    שינוי ערכי סיד, צעדים והנחיות שליליות כדי לראות את ההשפעה על התוצאה.

  • הפקת תמונות לפי מידה

    שליטה בגובה וברוחב של התוצר הסופי דרך הסליידרים המובנים בממשק.

איפה זה נופל

הבעיה המרכזית היא שהחלל מושהה ולא מקבל פקודות כרגע. מעבר לזה, הממשק מבוסס על גרסת המדיום בלבד ולא על הגרסה המלאה של המודל, ולכן היכולות שלו מוגבלות ביחס למה שהוצג בהכרזות הרשמיות של הטכנולוגיה. הריצה מוגבלת לחומרת מעבד בסיסית, כך שגם אם הממשק היה פעיל, בקשה לייצור מספר תמונות ברזולוציה גבוהה או עם מספר צעדים גדול הייתה נתקלת בזמני תגובה איטיים או בקריסה. אין כאן אפשרות להעלות תמונת מקור כדי לשנות אותה, אלא רק להזין טקסט מאפס.

שאלות
נפוצות

האם השימוש באפליקציה כרוך בתשלום?

הגישה לממשק היא ללא תשלום ופתוחה ישירות בדפדפן. עם זאת, נכון לעכשיו החלל נמצא במצב מושהה ולא פעיל. כדי להשתמש בו תצטרכו לשכפל אותו לעצמכם, ושם עשויות לחול עלויות לפי החומרה שתבחרו להקצות.

מה קורה עם הקבצים וההנחיות שאני מזין?

אתם לא מעלים קבצים לממשק אלא מקלידים הנחיות טקסט בלבד. הממשק מציג דוגמאות ציבוריות, אך כל הנחיה שמוזנת נשלחת לשרת שמריץ את הקוד. מאחר שמדובר בהדגמה ציבורית, לא כדאי להקליד טקסטים רגישים או פרטיים.

כמה זמן לוקח לייצר תמונה?

החומרה שמוגדרת להדגמה היא מעבד בסיסי ללא כרטיס מסך ייעודי. יצירת תמונה בודדת במודל כזה על מעבד יכולה לקחת דקות ארוכות. אם האפליקציה תופעל מחדש עם גישה למעבד גרפי דרך המודול המתאים, הזמן ירד לשניות בודדות.

האם אפשר להריץ את הכלי הזה במחשב המקומי?

כן, הקוד מבוסס על ספריות פתוחות ומשתמש בקוד פייתון רגיל עם ספריית diffusers. אפשר להוריד את קובץ הקוד ולהריץ אותו על המחשב שלכם, אך תצטרכו כרטיס מסך מתאים עם מספיק זיכרון כדי להחזיק את המודל.

במה הממשק הזה שונה מהמודל עצמו?

הממשק הזה הוא רק מעטפת גרפית שנבנתה כדי להציג את המודל בצורה פשוטה בדפדפן. הוא מפעיל גרסה מסוימת שהיא גרסת המדיום, עם הגדרות קבועות מראש של מתזמן ורמת דיוק, ולכן הוא לא מייצג בהכרח את מלוא הביצועים של המודל המלא.

איך משתמשים

בפועל מקלידים טקסט, בוחרים אם לשנות הגדרות מתקדמות כמו מידות או סיד, ולוחצים על כפתור ההפעלה Run. פס התקדמות מציג את שלבי העיבוד של התמונה בזמן אמת. עם זאת, האפליקציה נמצאת כרגע במצב מושהה, כך שאי אפשר להריץ אותה בדפדפן בלי שהיוצר יפעיל אותה מחדש או שתשכפלו אותה לחשבון שלכם. החומרה שמוגדרת לה היא מעבד בסיסי בלבד, וקוד המקור משתמש במודול spaces. אם אין הקצאה של מעבד גרפי בזמן הריצה, תהליך יצירת תמונה במודל כזה על מעבד רגיל יהיה אטי מאוד וכרוך בהמתנה ארוכה.

הרישיון

היוצר לא דיווח על רישיון ספציפי בעמוד של האפליקציה. משמעות הדבר היא שאין תנאי שימוש ברורים לגבי התמונות שנוצרות, ולא ברור אם מותר להשתמש בהן לצרכים מסחריים. מודל הבסיס של חברת סטביליטי כפוף לתנאי השימוש המקוריים שלו, ולכן מומלץ לבדוק את הרישיון שלהם ישירות לפני כל שימוש מעבר לניסוי אישי.

הרישיון המלא ב־Hugging Face ↗