GPT
M

mlx-FLUX.1-schnell-4bit-quantized

קוד פתוח

argmaxincapache-2.02024-08-20

  • diffusionkit
  • text-to-image
  • image-generation
  • flux
  • mlx

גרסה מכווצת של FLUX.1 schnell שמיועדת להרצה ישירה על מחשבי אפל סיליקון. המטרה כאן היא לייצר תמונות מטקסט במהירות מקומית ובלי לחנוק את הזיכרון.

  • 6.5 GBמשקל הקבצים
  • 27,388הורדות בחודש
  • 37לייקים

מה זה

מדובר במודל יצירת תמונות שעבר קוונטיזציה לארבע ביט עבור ספריית DiffusionKit של אפל. המודל המקורי מבית Black Forest Labs נחשב לאחד החזקים שיש, אבל הגודל שלו מקשה על הרצה מקומית. הדחיסה הזו, שבוצעה על מודול ה־mmdit, מכווצת את כל החבילה לכ־6.5 גיגה-בייט שמחולקים לשבעה קבצים.

המשמעות היא שאפשר להריץ אותו על מעבדי אפל דרך תשתית MLX. הוא בנוי לעבודה מהירה מאוד ומפיק תמונה בארבעה צעדים בלבד, בניגוד למודלים שדורשים עשרות צעדים כדי לקבל פלט סביר. אם אתם מחפשים לחולל תמונות ישירות מהטרמינל במק שלכם בלי תלות בשרתים חיצוניים, זה הכיוון.

מתאים ל

  • יצירת תמונות מקומית במק

    מתאים למי שרוצה לייצר תמונות על גבי אפל סיליקון בלי לשלוח מידע לרשת ובלי לשלם לפי קריאה.

  • בדיקות ופיתוח מהירים

    זמן הריצה הקצר בארבעה צעדים מאפשר לבדוק פרומפטים ורעיונות במהירות ישירות משורת הפקודה.

  • שילוב בכלים פנימיים

    רישיון אפאצ'י 2.0 מאפשר להטמיע את המודל בתוך תוכנות ומוצרים מסחריים בלי לחשוש מסיבוכים משפטיים.

איפה זה נופל

המודל תומך באנגלית בלבד לפי המפרט, כך שפרומפטים בעברית כנראה לא יתנו תוצאות טובות ללא תרגום מוקדם. הדחיסה לארבע ביט עלולה להוריד מאיכות הפרטים הקטנים לעומת מודל המשקל המלא. בנוסף, מדובר במודל schnell שנועד למהירות בארבעה צעדים, מה שאומר שהוא פחות סלחני לפרומפטים מורכבים במיוחד לעומת גרסאות איטיות יותר.

שאלות
נפוצות

האם אפשר להריץ את המודל על כרטיסי מסך של Nvidia או במערכות לינוקס?

הגרסה הזו נבנתה באמצעות MLX ומיועדת לספריית DiffusionKit שרצה על מעבדי אפל סיליקון. אם אתם עובדים על חומרה אחרת, תצטרכו לחפש גרסה אחרת של FLUX.1 schnell שמתאימה ל־CUDA ולא את המימוש הספציפי הזה.

כמה צעדים צריך להגדיר בהרצה כדי לקבל תמונה טובה?

הגרסה הזו מבוססת על מודל schnell, ולפי פקודת ההרצה הרשמית של המפתחים מספיקים 4 צעדים כדי לקבל פלט מלא, מה שהופך את תהליך היצירה לקצר במיוחד.

איך מריצים

כדי להריץ אותו מתקינים את ספריית diffusionkit בסביבת פייתון 3.11, ומשם אפשר לקרוא לו ישירות דרך שורת הפקודה עם כלי ה־CLI. בפקודה מגדירים את הפרומפט, הרזולוציה ומספר הצעדים, שבמקרה של schnell עומד על 4 צעדים בלבד.

המודל מיועד ספציפית למכונות מק עם שבבי אפל סיליקון ותמיכה ב־MLX. אם אין לכם חומרה כזו, או שאתם בונים שירות שצריך לעמוד בעומס של אלפי קריאות במקביל, כנראה שעדיף לשלם על API מנוהל של FLUX במקום לתחזק הרצה מקומית כזו.

pip install -U huggingface_hub
hf download argmaxinc/mlx-FLUX.1-schnell-4bit-quantized

הקבצים

7 קבצים במאגר, 6.5 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל מופץ תחת רישיון Apache 2.0. זהו רישיון קוד פתוח מתירני מאוד שמאפשר שימוש מסחרי, שינוי של הקוד והפצה, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗