GPT
S

stable-diffusion-3.5-medium-turbo

קוד פתוח

tensorartother2024-12-13

  • diffusers
  • safetensors
  • gguf
  • text-to-image
  • en

גרסת טורבו מזוקקת של מודל התמונה מבית StabilityAI, שנועדה לחתוך זמני רינדור. היא מתאימה למי שרוצה לייצר תמונות במעט צעדים בלי להחזיק כרטיסי מסך מפלצתיים.

  • 2.5Bפרמטרים
  • 24.5 GBמשקל הקבצים
  • 2,724הורדות בחודש
  • 73לייקים

מה זה

מדובר בגרסה מזוקקת של המודל המקורי, שפותחה כדי להאיץ את תהליך יצירת התמונות מטקסט. במקום להריץ עשרות צעדי דגימה כמקובל במודלים בגודל כזה, הגרסה הזו מגיעה לתוצאה בכארבעה עד שמונה צעדים בלבד. זה חוסך זמן חישוב יקר ומאפשר תפוקה גבוהה יותר לכל שרת.

היוצרים שחררו את המשקלים גם כמודל מלא וגם כקובצי התאמה מסוג LoRA. ההבדל המרכזי מול מה שרץ כרגע בשוק הוא שילוב המבנה של המודל המקורי עם צמצום משמעותי של זמני הרינדור, יחד עם זרימות עבודה מוכנות לממשקים פופולריים כמו ComfyUI.

מתאים ל

  • רינדור תמונות מהיר

    הוא מפיק תוצאה סבירה בארבעה עד שמונה צעדים, מה שמאפשר להציג תמונה למשתמש כמעט בזמן אמת.

  • בדיקת פרומפטים בזול

    זמן הרינדור הקצר מקל על איטרציות מהירות של עיצובים ורעיונות בלי לשרוף שעות עיבוד יקרות.

  • חיבור לממשקי ComfyUI

    היוצרים צירפו תרשימי עבודה מוכנים, כך שאפשר לחבר אותו בקלות לצנרת עבודה קיימת.

איפה זה נופל

המודל תומך באנגלית בלבד. פרומפטים בעברית פשוט לא יניבו את התוצאה המבוקשת בלי תרגום מוקדם. בנוסף, זיקוק למעט צעדים גורם לפעמים לעיוותים באנטומיה ובפנים, בעיה שהמפתחים ניסו לתקן בעדכונים מאוחרים יותר. אם הדיוק בפרטים זעירים קריטי למוצר שלכם, ארבעה צעדים לא תמיד יספיקו.

שאלות
נפוצות

האם המודל מבין הוראות בעברית?

לא. המודל אומן על אנגלית בלבד. אם האפליקציה שלכם מקבלת קלט בעברית, תצטרכו להעביר את הטקסט דרך מודל שפה שיתרגם אותו לאנגלית לפני שליחת הפרומפט.

עדיף להוריד את הצ'קפוינט המלא או את ה־LoRA?

אם כבר יש לכם את מודל הבסיס מותקן על השרת, קובץ ה־LoRA הקטן יחסוך לכם המון מקום בדיסק וזמן הורדה. אם אתם מתחילים מאפס במערכת נקייה, הורדת הצ'קפוינט המלא תחסוך כאב ראש של חיבור כמה קבצים יחד.

איך מריצים

כדי להריץ אותו עצמאית תצטרכו סביבת פייתון מודרנית עם ספריית diffusers וכרטיס מסך תומך CUDA, כשבפועל כדאי לפחות 16 גיגה זיכרון גרפי בגלל גודל המשקלים ומבנה המודל. אפשר למשוך את הצ'קפוינט המלא או לחבר קובץ LoRA ייעודי למודל הבסיס כדי לחסוך בהורדות.

אם אתם בונים שירות שדורש מענה מיידי של אלפי בקשות במקביל ואין לכם תשתית שרתים ייעודית, ניהול של 24.5 גיגה של קבצים בזיכרון הופך לנטל. במקרה כזה כדאי לשקול קריאה לשירות מנוהל חיצוני.

ollama run hf.co/tensorart/stable-diffusion-3.5-medium-turbo:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כמותאם אישית ולא כקוד פתוח חופשי. מכיוון שמדובר במודל שנגזר מפיתוח של חברה מסחרית אחרת, חובה לבדוק היטב את תנאי השימוש המקוריים באתר שלהם לפני שמשלבים אותו במוצר מסחרי שפתוח למשתמשי קצה.

הרישיון המלא בעמוד המודל ↗