GPT
F

FLUX.1-dev-gguf

קוד פתוח

city96other2024-08-15

  • gguf
  • text-to-image
  • image-generation
  • flux

גרסת GGUF מכווצת של מודל התמונות FLUX.1-dev, שנועדה לאפשר הרצה מקומית בלי כרטיס מסך מפלצתי. הפתרון מיועד למי שרוצה לייצר תמונות באיכות גבוהה ישירות דרך ComfyUI.

  • 95.3 GBמשקל הקבצים
  • 241,232הורדות בחודש
  • 1,426לייקים

מה זה

הפרויקט הזה לוקח את FLUX.1-dev של Black Forest Labs וממיר אותו לפורמט GGUF, בלי אימון מחדש או שינוי בארכיטקטורה. המטרה כאן היא להוריד את דרישות הזיכרון של מודל הדיפוזיה המקורי באמצעות כימוס, כך שאפשר יהיה לעבוד איתו בסביבות עבודה ביתיות או מוגבלות במשאבים.

במקום להחזיק משקלים מלאים שתופסים עשרות גיגה בייט בזיכרון הווידאו, הקבצים המכומסים חותכים את המשקל במחיר של ירידה מסוימת בדיוק, לפי סוג הקוונטיזציה שתבחרו. ההבדל המרכזי מול המקור הוא ביכולת להריץ תהליך של טקסט לתמונה ישירות בתוך ComfyUI בעזרת תוסף ייעודי, בלי לקרוס מחוסר VRAM.

מתאים ל

  • יצירת תמונות מקומית

    הרצת מודל מתקדם של טקסט לתמונה על מחשב אישי בלי לחרוג ממגבלות הזיכרון.

  • עבודה בתוך ComfyUI

    שילוב ישיר של מודל מכומס בתהליכי עבודה קיימים בעזרת צומת ייעודי.

  • בדיקות פיתוח זולות

    בחינת יכולות המודל בלי לשלם על הרצת שרתי GPU יקרים בענן.

איפה זה נופל

בגלל שמדובר בכימוס בלבד ולא באימון חדש, איכות התמונה הסופית תלויה מאוד ברמת הקוונטיזציה שתורידו, וככל שהקובץ קטן יותר עלולים להופיע עיוותים. בנוסף, המודל דורש התקנה ידנית של תוסף חיצוני לקומפי, כך שהוא לא יעבוד ישר מהקופסה בממשקים שלא תומכים בטעינת GGUF עבור מודלי דיפוזיה.

שאלות
נפוצות

איך מתקינים את המודל הזה בפועל?

מתקינים קודם את התוסף ComfyUI-GGUF בתוך ComfyUI. לאחר מכן מורידים את אחד מקובצי המשקלים ושמים אותו בתיקיית ComfyUI/models/unet.

איזה קובץ כדאי להוריד מתוך ה־14 שקיימים?

זה תלוי בזיכרון של כרטיס המסך שלכם. מומלץ לעיין בטבלת הקוונטיזציות שמקושרת בעמוד המודל ולבחור את האיזון הנכון עבורכם בין איכות תמונה לנפח הזיכרון הפנוי.

איך מריצים

כדי לעבוד איתו בפועל צריך להתקין את התוסף ComfyUI-GGUF, להוריד את קובץ המודל הרצוי ולזרוק אותו לתיקיית ComfyUI/models/unet. יש 14 קבצים שונים במאגר שמייצגים רמות כימוס שונות, כך שאפשר לבחור קובץ קל או כבד בהתאם לכרטיס המסך שיש לכם.

אם אין לכם כרטיס מסך מודרני עם כמות זיכרון מכובדת, או אם המטרה היא להרים שירות מהיר לייצור המוני בלי להתעסק בתחזוקת שרתים כבדים, עדיף להשתמש ב־API מנוהל שמריץ את המודל המקורי.

ollama run hf.co/city96/FLUX.1-dev-gguf:Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר בתור other ומחיל במלואם את תנאי הרישיון וההגבלות של המודל המקורי מבית Black Forest Labs. זה אומר שאתם חייבים לבדוק את התנאים של מודל ה־dev המקורי לפני שאתם משלבים אותו בפרויקט, ולא להניח שמותר להשתמש בו באופן מסחרי חופשי.

הרישיון המלא בעמוד המודל ↗