GPT
F

FLUX.2-klein-4B-GGUF

קוד פתוח

unslothapache-2.02026-01-15

  • ggml
  • gguf
  • text-to-image
  • unsloth
  • image-editing

גרסת קוונטיזציה מכווצת למודל תמונה מהיר של ארבעה מיליארד פרמטרים. היא מייצרת ועורכת תמונות בפחות משנייה ומיועדת לרוץ מקומית על כרטיסי מסך ביתיים.

  • 48.3 GBמשקל הקבצים
  • 250,806הורדות בחודש
  • 212לייקים

מה זה

מדובר במימוש GGUF של המודל מבית Black Forest Labs, שעבר המרה על ידי צוות Unsloth בשיטת Dynamic 2.0. המבנה שלו מבוסס על rectified flow transformer שמחבר יצירת תמונה מעריכת תמונות מרובות מקורות לארכיטקטורה בודדת וקומפקטית, במקום להחזיק מודלים נפרדים לכל משימה.

המודל מתוכנן מראש למהירות גבוהה עם מספר צעדי דגימה נמוך במיוחד, רק ארבעה צעדים בקוד הדוגמה, מה שמאפשר זמן ריצה של פחות משנייה לתמונה. בעוד שמודלים קודמים במשפחה דרשו משאבי מחשוב כבדים, כאן הדגש הוא על עבודה אינטראקטיבית וזמני תגובה מיידיים מבלי להקריב את חדות התוצאה.

מתאים ל

  • עריכת תמונות בזמן אמת

    זמן הפקה של פחות משנייה מאפשר לשלב אותו בכלים אינטראקטיביים שבהם המשתמש משנה פרמטרים ומקבל פידבק מיידי.

  • עריכה מבוססת מספר מקורות

    הארכיטקטורה תומכת בקבלת מספר תמונות רפרנס יחד כדי להפיק גרסה חדשה שמשלבת אלמנטים מכולן.

  • הפקה מקומית על מחשב אישי

    דרישת זיכרון של כ־13GB מאפשרת להריץ יצירת תמונות מלאה על כרטיסי מסך ביתיים בלי תלות בענן.

איפה זה נופל

המודל מתקשה לעיתים קרובות ברינדור טקסט בתוך תמונות, והאותיות עלולות לצאת מעוותות או שגויות. הדיוק בביצוע ההוראות מושפע מאוד מסגנון הכתיבה של הפרומפט, ויש מקרים שבהם התוצאה פשוט מתעלמת מחלקים בתיאור. בנוסף, המודל אינו מיועד לספק מידע עובדתי וכולל הטיות סטטיסטיות שמקורן בנתוני האימון.

אותה משפחה

FLUX.2-klein יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזה כרטיס מסך צריך כדי להריץ את המודל?

המודל דורש כ־13GB זיכרון וידאו. כרטיסים כמו Nvidia RTX 3090 או RTX 4070 ומעלה יריצו אותו באופן מקומי בלי בעיה.

האם מותר להשתמש במודל במוצר מסחרי?

כן. גרסת ה־4B משוחררת תחת רישיון Apache 2.0 הפתוח לשימוש מסחרי, בשונה מגרסת ה־9B שמוגבלת לשימוש לא מסחרי.

באיזה ממשק כדאי להריץ את קבצי ה־GGUF האלה?

הקבצים במאגר הזה נבנו כדי לעבוד ישירות ב־ComfyUI בעזרת ההרחבה ComfyUI-GGUF, או בסקריפט עצמאי דרך ספריית diffusers הרשמית.

איך מריצים

המקור דורש בערך 13GB של זיכרון וידאו, מה שמתאים לכרטיסים נפוצים כמו RTX 3090 או RTX 4070 ומעלה. קבצי ה־GGUF במאגר מותאמים במיוחד להרצה דרך ComfyUI באמצעות תוסף ComfyUI-GGUF, לצד תמיכה רשמית בקוד פייתון דרך ספריית diffusers עם פריקה לזיכרון המרכזי כדי לחסוך מקום בכרטיס המסך.

אם אין לכם חומרה ייעודית עם מספיק זיכרון תצוגה מקומי, או שאתם בונים שירות שצריך סקייל רחב בלי לנהל שרתים פיזיים, אפשר לצרוך את המודל ישירות כ־API דרך bfl.ai במקום להוריד עשרות גיגה-בייט של משקלים.

ollama run hf.co/unsloth/FLUX.2-klein-4B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל משוחרר תחת רישיון Apache 2.0 מלא. אפשר להשתמש בו לצרכים מסחריים, לשלב אותו במוצרים סגורים, לשנות אותו ולהפיץ נגזרות שלו, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי, וללא שימוש מטעה בסימני המסחר של החברה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗