GPT
S

shuttle-3.1-aesthetic

קוד פתוח

shuttleaiapache-2.02024-11-29

  • diffusers
  • safetensors
  • gguf
  • text-to-image
  • image-generation

מודל תמונה שמייצר פלט ברמה גבוהה בתוך ארבעה עד שישה צעדים בלבד. הוא מתאים למי שרוצה חלופה מהירה לפיתוחים מסחריים כבדים עם רישיון קוד פתוח אמיתי.

  • 12Bפרמטרים
  • 114 GBמשקל הקבצים
  • 1,671הורדות בחודש
  • 131לייקים

מה זה

המודל הזה מבוסס על Shuttle 3 Diffusion ועבר תהליך אימון מיוחד שכלל ביטול חלקי של הזיקוק, de-distillation, כדי לעקוף את המגבלות המוכרות של סדרת Schnell. המטרה של המפתחים הייתה לקבל איכות פרטים, צבעים וטיפוגרפיה שמזכירים את Flux Dev, אבל בלי לשלם בזמני יצירה ארוכים. התוצאה היא כלי שמייצר תמונות שלמות בטווח של ארבעה עד שישה צעדים, תוך שמירה על הבנת הנחיות מורכבות.

בגודל של כמעט 12 מיליארד פרמטרים, המודל מתמקד ביצירת מראה אסתטי ועשיר יותר מהבסיס המזוקק הרגיל. ההבדל המרכזי מול אלטרנטיבות מקבילות הוא היכולת לשלב טקסט ברור בתוך התמונה לצד קומפוזיציות צפופות, בלי להזדקק לעשרות צעדי דגימה שמאטים את כל פס הייצור.

מתאים ל

  • מחולל תמונות בזמן אמת

    הייצור ב־4 עד 6 צעדים מאפשר תגובה כמעט מיידית באפליקציות אינטראקטיביות.

  • עיצוב כרזות עם טקסט

    המודל מותאם לרינדור טיפוגרפיה באנגלית ישירות בתוך הפריים.

  • שילוב בפייפליין מסחרי

    רישיון Apache 2.0 נותן גב משפטי נקי להטמעה במוצרים עסקיים.

איפה זה נופל

המודל תומך כרגע באנגלית בלבד. אם תזינו הנחיות בעברית תקבלו תוצאות עקומות או התעלמות מוחלטת מחלקי משפט. בנוסף, למרות שהמפתחים מדווחים על שיפור בטיפוגרפיה ואיכות דומה למודלים גדולים יותר בארבעה צעדים, קיצור תהליך הדיפוזיה עדיין מועד לפספוסים בהנחיות מורכבות במיוחד עם ריבוי דמויות או פרטים קטנים, וצריך לבדוק טוב את התוצאות מול הצרכים שלכם לפני שסומכים עליו אוטומטית.

שאלות
נפוצות

איזה כרטיס מסך צריך כדי להריץ את המודל מקומית?

המודל שוקל כ־12 מיליארד פרמטרים ומאגר הקבצים עצום, כך שתצטרכו כרטיס עם לפחות 24 גיגה זיכרון עבור גרסת fp8, ועדיף כרטיס מקצועי יותר עבור bfloat16 מלא. אם יש לכם כרטיס ביתי פשוט, הוא לא יחזיק את העומס.

האם אפשר להשתמש בו במוצר מסחרי בלי להסתבך?

כן, רישיון Apache 2.0 מאפשר שימוש מסחרי חופשי לחלוטין. בניגוד למודלים שמוגבלים לשימוש מחקרי בלבד, כאן מותר למכור שירות שמבוסס עליו, בתנאי שמצרפים את הרישיון המקורי.

איך מריצים

אתם מריצים אותו דרך ספריית diffusers בפייתון או כקובץ safetensors בתוך ComfyUI. יש לו שתי גרסאות שונות להורדה, bfloat16 למקסימום דיוק וגרסת fp8 מכווצת שמקלה על צריכת הזיכרון, כשגרסת GGUF עדיין לא זמינה.

המשקל הכולל של הקבצים במאגר מגיע ל־114 גיגה־בייט, כך שתצטרכו כרטיס מסך חזק מאוד עם שפע של VRAM כדי להחזיק אותו מקומית. אם אין לכם חומרה ייעודית כזו בענן או בתחנת עבודה, עדיף פשוט לצרוך אותו דרך ה־API של ShuttleAI או לבדוק אותו בממשק ה־Designer שלהם.

ollama run hf.co/shuttleai/shuttle-3.1-aesthetic:Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

43 קבצים במאגר, 114 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון כאן הוא Apache 2.0 מלא. אתם יכולים להשתמש בו ליישומים מסחריים, לשנות אותו, להריץ אותו בענן שלכם או להפיץ אותו כחלק ממוצר בלי לשלם תמלוגים, כל עוד אתם שומרים על הודעת הרישיון המקורית ומציינים את יוצרי המודל.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗