GPT
C

Chroma-GGUF

קוד פתוח

silveroxidesapache-2.02025-02-24

  • gguf
  • text-to-image

המרה בפורמט GGUF למודל יצירת תמונות מטקסט, שנועדה לאפשר הרצה מקומית בחלוקה לרמות דיוק שונות. פתרון מתאים למי שרוצה לשלוט במשאבי החומרה ולייצר תמונות על המחשב שלו.

  • 2.2 TBמשקל הקבצים
  • 42,142הורדות בחודש
  • 245לייקים

מה זה

הריפוזיטורי הזה כולל המרות שונות של המודל Chroma לקבצי GGUF, המיועדים למשימות text-to-image. המטרה של המרות כאלה היא לקחת מודל כבד ולאפשר פריסה גמישה יותר על חומרה מקומית, תוך בחירה ברמת הדחיסה הרצויה. סך כל הקבצים במאגר מגיע לנפח חריג של 2.2 טרה בייט שמחולק בין 288 קבצים שונים.

היוצר העלה שורה ארוכה של גרסאות, החל מקובץ המקור בפורמט BF16 ועד לרמות כימות שונות כמו Q8_0, דרך משפחת Q5 ועד Q3_K_L. הדף מציג דוגמאות ויזואליות עבור כל רמת דיוק כדי שתוכלו להשוות את הפלט בין הגרסאות השונות, אך אינו מציג ציוני מבחנים כמותיים או נתוני ביצועים רשמיים.

מתאים ל

  • יצירת תמונות במחשב מקומי

    מאפשר הפקת תמונות מטקסט ישירות על החומרה שלכם באמצעות קובצי כימות קלים.

  • בדיקת השפעת כימות על פלט

    מגוון רמות הדחיסה מאפשר להשוות איכות ויזואלית מול שימוש במשאבי זיכרון.

  • שילוב בצינור עיבוד פנימי

    רישיון Apache 2.0 מאפשר להטמיע את הקבצים במערכות מסחריות פרטיות.

איפה זה נופל

הדף לא כולל שום מידע על נתוני האימון, ארכיטקטורת הבסיס או מגבלות התוכן של המודל. אין פירוט לגבי יכולות יצירת טקסט בתוך תמונה, התמודדות עם אנטומיה מורכבת או הבנת פרומפטים מסובכים.

מעבר לכך, רמות הכימות הנמוכות כמו Q3_K_L עלולות לפגוע באיכות התמונה הסופית, וגרסאות מסוימות כמו Q8_M ו־Q4_K_S כלל אינן נמצאות במאגר הזה ומפנות לריפוזיטורי נפרד לחלוטין. חובה לבדוק איכות פלט באופן מעשי לפני שמשלבים את המודל בתהליך עבודה קבוע.

שאלות
נפוצות

האם צריך להוריד את כל 288 הקבצים שנמצאים במאגר?

ממש לא. הנפח הכולל מגיע ליותר מ־2 טרה בייט בגלל ריבוי גרסאות. אתם צריכים לבחור קובץ GGUF יחיד ברמת הכימות שמתאימה לכרטיס המסך שלכם.

איפה נמצאות גרסאות Q8_M ו־Q4_K_S?

הגרסאות הספציפיות האלה אינן מאוחסנות כאן. לפי כרטיס המודל, הן הועלו למאגר מקביל בכתובת של המשתמש Clybius.

איך מריצים

בשביל לעבוד עם המאגר הזה אתם לא מורידים את כל 2.2 הטרה בייט, אלא בוחרים קובץ בודד שמתאים לזיכרון שיש לכם. קבצים כמו BF16 דורשים זיכרון גרפי גבוה מאוד, בעוד גרסאות כמו Q4_0 או Q3_K_L מכווצות את הדרישות ומאפשרות ריצה על כרטיסי מסך ביתיים או שילוב עם זיכרון המערכת.

אם יש לכם כרטיס מסך מודרני ואתם מחפשים שליטה מלאה בפרטיות ובפלט, הרצה מקומית של קובצי ה־GGUF הגיונית מאוד. אם אין לכם כוח עיבוד מקומי מתאים, הניסיון לטעון מודלים כאלה יהיה איטי מאוד ועדיף לפנות לממשקי API מנוהלים.

ollama run hf.co/silveroxides/Chroma-GGUF:BF16

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

288 קבצים במאגר, 2.2 TB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי של הקוד והפצה מחדש בלי תשלום תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗