GPT
C

Chroma1-Base

קוד פתוח

lodestonesapache-2.02025-07-29

  • diffusers
  • safetensors
  • text-to-image

גרסת בסיס של 8.9 מיליארד פרמטרים ליצירת תמונות מטקסט, שמבוססת על FLUX ומיועדת לאימון המשך. היא מציעה רישיון חופשי באמת ומבנה ארכיטקטוני רזה ויציב יותר מהמקור.

  • 8.9Bפרמטרים
  • 42.2 GBמשקל הקבצים
  • 44,168הורדות בחודש
  • 116לייקים

מה זה

מדובר במודל בסיס ליצירת תמונות שפותח מתוך FLUX.1-schnell, אך עבר שינוי מבני מקיף. היוצר חתך את שכבת קידוד הזמן המנופחת וצמצם את המודל ל־8.9 מיליארד פרמטרים, לצד מיסוך של טוקני פדינג בטקסט ושיפור דגימת הזמן בזמן האימון. הוא אומן על מאגר של חמישה מיליון דוגמאות שנבחרו מתוך עשרים מיליון, כדי לספק בסיס ניטרלי ומאוזן.

המטרה העיקרית כאן היא לאו דווקא שימוש ישיר מהקופסה, אלא נקודת מוצא גמישה למי שרוצה לאמן מודלים מתמחים. במקום להיאבק במשקלים מסחריים מוגבלים, מקבלים כאן ארכיטקטורה יציבה שמוכנה לקבל סגנונות ודמויות חדשות.

מתאים ל

  • אימון סגנונות ספציפיים

    בסיס נקי ורזה שתוכנן לקלוט כוונון עדין של סגנונות גרפיים חדשים בלי עומס יתר.

  • פיתוח מודלי דמויות

    נקודת מוצא גמישה להטמעת קונספטים ודמויות עקביות תחת ארכיטקטורת FLUX.

  • מחקר גנרטיבי פתוח

    פלטפורמה נוחה לבדיקת התנהגות מודלים והתאמות אבטחה תחת רישיון פתוח לחלוטין.

איפה זה נופל

המודל שוחרר כפי שהוא ללא פילטר בטיחות, ולכן הוא עלול לייצר תוכן פוגעני, מפורש או בעל הטיות שנשאבו מנתוני האינטרנט. מעבר לכך, מדובר בגרסת בסיס לא מהודקת לייצור סופי, כך שמי שמחפש תוצאה סגורה ומהירה לקצה יצטרך לבנות מעליה שכבות הגנה או לפנות לגרסה המותאמת לכך מראש.

שאלות
נפוצות

האם המודל הזה מתאים לשימוש ישיר באפליקציה למשתמשי קצה?

לא מומלץ לחבר אותו ישירות למשתמשי קצה ללא אימון נוסף או מנגנוני סינון. הוא תוכנן כמודל בסיס ללא שכבות יישור או פילטר בטיחות, ועלול להפיק תוכן לא רצוי. לשימוש ישיר שווה לבדוק את גרסת Flash.

מה נדרש כדי להריץ אותו דרך ComfyUI?

מעבר למשקלי המודל עצמם, חובה להוריד גם את מקודד הטקסט T5 XXL ואת קובץ ה־VAE המתאים של FLUX. לאחר שמניחים כל קובץ בתיקייה הייעודית שלו, טוענים את תבנית העבודה של Chroma ומריצים.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־42.2 גיגה בייט, כך שצריך כרטיס מסך חזק עם זיכרון ייעודי משמעותי כדי להריץ או לאמן אותו מקומית. סביבת העבודה דורשת פייתון עם diffusers, transformers, accelerate ו־sentencepiece, או שילוב שלו בתוך ComfyUI.

אם אתם עובדים ב־ComfyUI, תצטרכו להוריד בנפרד גם את מקודד הטקסט T5 XXL ואת ה־VAE המקורי. למי שרק רוצה לייצר תמונות מהר ולא לאמן מודל משלו, היוצרים מציעים לפנות לגרסת Flash או להשתמש בפלטפורמת ענן כמו Fictional.ai במקום להחזיק שרת כבד.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("lodestones/Chroma1-Base")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0 מלא. אפשר להשתמש במודל לצרכים מסחריים, לשנות אותו, לבצע עליו אימון נוסף ולהפיץ אותו במוצר שלכם, כל עוד שומרים על הודעת הרישיון וזכויות היוצרים המקוריות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗