GPT
F

FLUX.2-klein-4b-fp8

קוד פתוח

black-forest-labsapache-2.02026-01-14

  • diffusion-single-file
  • text-to-image
  • image-editing
  • flux
  • image-to-image

גרסת קוונטיזציה של מודל תמונה מבוסס שנאי של ארבעה מיליארד פרמטרים. הוא מיועד ליצירה ועריכה לפי מספר תמונות מקור, ושוקל פחות מארבעה גיגה־בייט.

  • 3.8 GBמשקל הקבצים
  • 134,194הורדות בחודש
  • 73לייקים

מה זה

מדובר בארכיטקטורת rectified flow transformer שמייצרת תמונות מטקסט ומבצעת עריכות מבוססות מספר תמונות רפרנס במקביל. המאגר הספציפי הזה מכיל משקולות בפורמט FP8 שנשמרות בקובץ safetensors יחיד, חלופה קלה יותר למאגר המקורי שמחזיק משקולות BF16 מלאות.

הייחוד שלו בקטגוריית המשקל הזו הוא היכולת לקבל קלט של כמה תמונות מקור לעריכה ולא רק הנחיית טקסט בודדת. המפתחים לא צירפו ציוני בנצ'מרק מספריים על איכות יצירה, אבל מפרטים בדיקות עמידות מול מודלים פתוחים אחרים בחסימת תוכן אסור כמו ניצול קטינים ופגיעה בפרטיות, שבהן הוא הפגין חוסן גבוה יותר.

מתאים ל

  • עריכת תמונות מרובת מקורות

    התאמת סגנון ומיזוג פרטים מתוך כמה תמונות רפרנס במקביל לתוך יצירה אחת.

  • הפקה על חומרת קצה ומפתחים

    הרצה מקומית על כרטיס בודד מסדרת RTX 4070 בלי צורך בשרתים ייעודיים יקרים.

  • מוצרים מסחריים סגורים

    הטמעה במוצר קנייני של חברה הודות לרישיון Apache 2.0 המתירני.

איפה זה נופל

המודל הזה לא נועד לספק מידע עובדתי. בטקסטים כתובים שמופיעים בתוך התמונה הוא עלול לעוות אותיות או לייצר שגיאות, והוא סובל מהטיות שנלמדו ממאגר האימון שלו. בנוסף, מידת הציות להוראה תלויה מאוד בסגנון הניסוח, ויש מקרים שבהם התוצאה לא תתאים כלל להנחיה שכתבתם. אם המוצר שלכם מסתמך על טיפוגרפיה מדויקת בתמונה, תצטרכו לבדוק את זה ידנית לפני שאתם מתחייבים אליו.

אותה משפחה

FLUX.2-klein יצא ב־8 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב נייד עם כרטיס מסך פשוט?

לא. המודל דורש כ־13 גיגה־בייט של זיכרון וידאו פנוי. תצטרכו לפחות כרטיס מסדרת RTX 3090 או RTX 4070 ומעלה כדי שהוא יטען וירוץ.

מה ההבדל בין המאגר הזה למאגר הראשי של FLUX.2 klein 4B?

כאן המשקולות שמורות בפורמט FP8, שמכווץ את הנפח ל־3.8 גיגה־בייט ומקל על דרישות החומרה. המאגר הראשי מחזיק את המשקולות המלאות בפורמט BF16.

האם המודל יוצר טקסטים ברורים בתוך התמונות?

לפי כרטיס המודל, טקסט שנוצר בתוך התמונה עלול להכיל שגיאות או עיוותים. הוא מסוגל לרנדר כתב, אבל לא הייתי בונה עליו לייצור גרפיקה שתלויה בטקסט קריא.

איך מריצים

הגרסה הזו דורשת כרטיס מסך עם סביבות 13GB של זיכרון וידאו, מה שמאפשר להריץ אותה מקומית על כרטיסי NVIDIA RTX 3090 או RTX 4070 ומעלה. הקבצים יושבים תחת ספריית diffusion-single-file ומסתכמים ב־3.8 גיגה־בייט בלבד בזכות דיוק ה־FP8, לעומת גרסת ה־BF16 שדורשת משאבים כבדים יותר.

אם אין לכם כרטיס עם מספיק זיכרון או שאתם לא רוצים לנהל שרתים שלמים עבור תעבורה משתנה, יש למפתחים שירות ענן שמספק גישה דרך ממשק תכנות. בריצה מקומית תצטרכו לדאוג בעצמכם לסינון קלט ופלט, שהמפתחים ממליצים להוסיף אך לא מחייבים ברישיון של גרסה זו.

pip install -U huggingface_hub
hf download black-forest-labs/FLUX.2-klein-4b-fp8

הקבצים

7 קבצים במאגר, 3.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפצה תחת רישיון Apache 2.0 מלא. זה אומר שמותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהטמיע אותו במוצרים שלכם בלי תמלוגים, כל עוד שומרים על תנאי הרישיון והקרדיט. המגבלות היחידות שמודגשות במסמך נוגעות לשימוש לא חוקי, יצירת תכנים פוגעניים והגנה על סימני המסחר של החברה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗