GPT
S

VIDraft/stable-diffusion-3.5-large-turboX

רץ בדפדפן

VIDraftother2025-03-11

  • gradio
  • mcp-server

מייצר תמונות מטקסט בעזרת גרסה מזוקקת של מודל SD3.5 בשמונה צעדים בלבד. מתאים למי שרוצה לבדוק יצירת תמונות מהירה דרך הדפדפן בלי להקים סביבה מקומית כבדה.

  • הורדות בחודש
  • 106לייקים

מה זה

כותבים תיאור טקסטואלי של מה שרוצים לראות ומקבלים תמונה בודדת. הממשק מציע גם הגדרות מתקדמות למי שרוצה לשלוט בפרטים, כמו פרומפט שלילי, סיד, מידות רוחב וגובה, ומשחק עם כמות צעדי הריצה וסולם ההנחיה.

מאחורי הקלעים רץ המודל tensorart/stable-diffusion-3.5-large-TurboX, שמבוסס על צינור הדיפוזיה של SD3.5 Large עם סקדולר מותאם של FlowMatchEulerDiscreteScheduler עם shift שמוגדר ל־5. הרעיון כאן הוא זיקוק שמאפשר לייצר תוצאה בשמונה צעדים במקום עשרות, בלי לאבד לגמרי את האיכות של המודל הגדול.

מתאים ל

  • בדיקת רעיונות ויזואליים

    הקלדה מהירה של תיאור כדי לראות קומפוזיציה ראשונית בשמונה צעדים לפני רינדור ארוך.

  • ניסוי במודל מזוקק

    בחינה של איכות התוצאות שמפיק הזיקוק של TensorArt מול מודלים רגילים של SD3.5.

  • יצירת רקעים במידות שונות

    התאמת גובה ורוחב בסליידרים כדי לייצר תמונה מותאמת לפרופורציות של מסך או באנר.

איפה זה נופל

הבעיה המיידית היא הסטטוס, האפליקציה נמצאת במצב שגיאת ריצה ולכן אי אפשר להשתמש בה כרגע בדפדפן. מעבר לכך, מודל של שמונה צעדים מוותר על חלק מאיכות הפירוט לטובת המהירות, כך שלא תקבלו את אותה רמת דיוק של המודל המלא.

הממשק מקבל הנחיות באנגלית. פרומפטים בעברית צפויים להניב תוצאות עקומות או להתעלם לחלוטין מחלקים בתיאור, כיוון שהאימון של המודל המקורי מבוסס בעיקר על אנגלית.

שאלות
נפוצות

האם השימוש באפליקציה כרוך בתשלום?

לא, הכניסה דרך הדפדפן היא בחינם ואינה דורשת תשלום. עם זאת, כרגע האפליקציה תקועה בשגיאת ריצה ולא מייצרת פלט בפועל.

כמה זמן לוקח לכל תמונה להיווצר?

האלגוריתם עצמו מתוכנן לרוץ בשמונה צעדים בודדים, כך שעל כרטיס מסך מתאים הוא מייצר תמונה תוך שניות ספורות. יחד עם זאת, אם ההפעלה נתקלת בשגיאה או בתור עמוס, הזמנים מתארכים.

האם אפשר להריץ את זה על המחשב שלי במקום בדפדפן?

כן, הקוד משתמש בספריית diffusers של פייתון וטוען את המשקלים ממאגר פתוח בשם tensorart/stable-diffusion-3.5-large-TurboX. מי שמחזיק במחשב עם כרטיס מסך תומך של אנבידיה יכול להעתיק את הקוד ולהריץ אותו באופן עצמאי.

במה הגרסה הזו שונה מ־SD 3.5 Large הרגיל?

מדובר בגרסה מזוקקת של המודל, שעברה אופטימיזציה כדי להגיע לתוצאה טובה בכמות קטנה מאוד של שמונה צעדי חישוב. המודל המקורי דורש בדרך כלל עשרות צעדים, מה שהופך את הגרסה הזו למהירה בהרבה אך מעט פחות מדויקת בפרטים מורכבים.

איך משתמשים

מקלידים תיאור בשדה הפרומפט, פותחים את ההגדרות המתקדמות אם רוצים לשנות מידות או לקבע סיד, ולוחצים על Run. המערכת מציגה פס התקדמות בזמן שהתמונה נוצרת.

הקוד משתמש במנגנון spaces כדי לנתב את העיבוד לכרטיסי מסך בעת הריצה, אך בפועל החומרה הבסיסית המוגדרת היא מעבד רגיל, והעמוד מדווח כרגע על שגיאת ריצה. כשהממשק לא מופעל כראוי, הלחיצה על הכפתור פשוט לא תפיק תמונה עד שהתקלה תתוקן.

הרישיון

הרישיון מוגדר כ־other ולא כקוד פתוח סטנדרטי, מה שדורש בדיקה פרטנית של תנאי השימוש של TensorArt לפני שימוש מסחרי בתמונות. הממשק פתוח בדפדפן ולא ברור מה הכללים לגבי שמירת הפרומפטים או התמונות שנוצרות בשרת.

הרישיון המלא ב־Hugging Face ↗