GPT
F

FLUX.2-small-decoder

קוד פתוח

black-forest-labsapache-2.02026-04-06

  • diffusers
  • safetensors
  • text-to-image
  • image-editing
  • flux

מפענח VAE מזוקק שמחליף ישירות את המפענח המקורי של FLUX.2. הוא חותך בצריכת הזיכרון ומאיץ את שלב הפענוח בלי שתצטרכו לשלם על זה באיכות התמונה.

  • 62Mפרמטרים
  • 591 MBמשקל הקבצים
  • 216,631הורדות בחודש
  • 173לייקים

מה זה

זה לא מחולל תמונות עצמאי, אלא רכיב המפענח בלבד שנועד להחליף את הרכיב המקביל בכל משפחת FLUX.2 הפתוחה, כמו דגמי klein או dev. הרעיון פשוט: שלב הפענוח של המרחב הלטנטי לתמונה סופית הוא לעיתים קרובות צוואר הבקבוק שמפיל שרתים על חוסר זיכרון, במיוחד כשעולים ברזולוציות.

המפתחים צמצמו את רוחב הערוצים של המודל, מה שהוריד את כמות הפרמטרים של המפענח לכ־28 מיליון לעומת כ־50 מיליון במקור. התוצאה בשטח היא פענוח מהיר יותר פי 1.4 וחיסכון של בערך 1.4 בצריכת ה־VRAM ברגע הקריטי של הפקת הפיקסלים, כשהתמונות נשארות כמעט זהות לחלוטין למקור. רכיב הקידוד נשאר בדיוק אותו דבר, כך שאין צורך לגעת בשאר הצינור.

מתאים ל

  • הפקת תמונות ברזולוציה גבוהה

    צריכת זיכרון נמוכה פי 1.4 בשלב ה־decode מאפשרת לחלץ תמונות גדולות בלי לקבל שגיאות Out of Memory.

  • אופטימיזציה לשרתי הסקה

    המפענח מהיר פי 1.4 ומקצר את זמן התגובה הסופי בכל פנייה של משתמש במערכות מבוססות FLUX.2.

  • הרצה מקומית על כרטיסי קצה

    הורדת דרישות ה־VRAM מאפשרת להריץ צינור תמונה מלא גם על כרטיסי מסך צרכניים מוגבלים.

איפה זה נופל

המודל הזה מטפל רק בפיקסלים ולא מבין תוכן. הוא לא יתקן לכם בעיות של המודל הראשי, כמו חוסר דיוק בטקסט שמופיע בתמונה, עיוותים של אותיות, או אי ציות לפרומפט. בנוסף, מדובר במודל שזוקק מהמקורי, כך שלמרות ההבטחה לפגיעה מינימלית באיכות, חובה לבדוק אותו על סגנונות ספציפיים שחשובים לכם לפני שמעבירים אותו לפרודקשן.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה לבד כדי ליצור תמונות מטקסט?

לא. זה רק מפענח VAE, שתפקידו להמיר את המידע הדחוס לתמונה סופית. חייבים להריץ אותו יחד עם מודל בסיס תואם כמו FLUX.2-klein או FLUX.2-dev.

האם צריך לאמן מחדש משהו כדי לשלב אותו?

ממש לא. הוא בנוי כתחליף ישיר. טוענים אותו כרכיב ה־VAE של הצינור ב־diffusers והוא עובד מיד עם המשקלים הקיימים של שאר המערכת.

איך מריצים

המפענח זמין דרך ספריית diffusers בגרסת הפיתוח שלה מגיטהאב, ונטען ישירות לתוך הצינור של FLUX.2 במקום ה־VAE הרגיל. כל הקבצים שלו שוקלים סך הכול 591 מגהבייט, כך שהוא יושב בקלות על כרטיסי מסך מודרניים עם bfloat16 בלי לייצר שום עומס אמיתי באחסון.

אם אתם מריצים שרת משלכם ומייצרים תמונות ברזולוציה גבוהה, החלפת המפענח הזה מאפשרת לכם להימנע מנפילות זיכרון ולשפר זמני תגובה בלי לשנות את החומרה. לעומת זאת, אם אתם עובדים מול ספק API חיצוני ולא מחזיקים תשתית GPU משלכם, אין לכם שליטה על ה־VAE ואין סיבה להתעסק בהורדה שלו.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("black-forest-labs/FLUX.2-small-decoder")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0 מלא. אפשר להשתמש בו לצרכים מסחריים, לשלב אותו במוצרים פנימיים או חיצוניים ולשנות את הקוד והמשקלים בלי לשלם תמלוגים, כל עוד שומרים על הודעת הרישיון המקורית ולא משתמשים בסימנים המסחריים של החברה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗