GPT
F

Flux-Prompt-Enhance

קוד פתוח

gokaygokayapache-2.02024-08-26

  • transformers
  • safetensors
  • t5
  • text2text-generation
  • en

הוא לוקח פרומפט קצר ומרחיב אותו לתיאור מפורט שמתאים למודלי תמונה כמו פלוקס. עם 223 מיליון פרמטרים בלבד, אפשר להריץ אותו מקומית כמעט בכל סביבה בלי להעמיס על השרת.

  • 223Mפרמטרים
  • 512טוקנים בהקשר
  • 853 MBמשקל הקבצים
  • 4,130הורדות בחודש

מה זה

מדובר במודל שמבוסס על ארכיטקטורת T5ForConditionalGeneration, עם משקל כולל של כמאתיים עשרים ושלושה מיליון פרמטרים. המטרה המרכזית שלו היא לקבל טקסט קצר ובסיסי ולהרחיב אותו לתיאור עשיר ומפורט שמכוון ישירות לסגנון היצירה של מחוללי תמונות מודרניים. במקום להשתמש במודלי שפה ענקיים שדורשים משאבים מוגזמים רק כדי לנסח פרומפט, הוא ממוקד במשימה הבודדת הזו ומבצע אותה במינימום משקל.

הקבצים שלו שוקלים בסך הכול 853 מגה בייט, כך שהוא יושב בזיכרון בקלות ולא דורש תשתית מורכבת או מנופחת. העבודה נעשית דרך ספריית transformers הרגילה בפייתון, בדיוק float32. המפתח לא פרסם מבחני ביצועים כמותיים או מדדים השוואתיים בכרטיס המודל, ולכן קשה לדעת מראש איך הוא מתמודד מול מודלים דומים בלי להריץ בפועל כמה עשרות דוגמאות בדיקה. מה שבטוח הוא שהגודל הקומפקטי שלו הופך אותו לפתרון מהיר שלא מעכב את שרשרת יצירת התמונה.

מתאים ל

  • הרחבת פרומפטים אוטומטית

    הפיכת מילים בודדות שהמשתמש מקליד לפרומפט מפורט שמוכן להזנה למחולל התמונות.

  • בוטים ליצירת תמונות

    שילוב בבוטים שבהם צריך לשפר את קלט המשתמש בשבריר שנייה ובלי לחץ על הזיכרון.

  • עיבוד מקומי במחשב אישי

    הרצה מקומית לצד כלי תמונה בלי צורך בחיבור רשת או בתשלום על קריאות API יקרות.

איפה זה נופל

חלון ההקשר מוגבל ל־512 טוקנים בלבד, כך שאי אפשר להזין לו הנחיות מורכבות, סיפורים ארוכים או רשימות דרישות מפותלות. בנוסף, הוא תומך באנגלית בלבד. אם תזינו לו טקסט בעברית, הוא ייכשל או יחזיר פלט משובש לחלוטין. הכרטיס לא מספק פרטים על הנתונים שעליהם אומן, כך שצריך לבדוק טוב אם הוא לא מוטה לסגנונות ויזואליים מסוימים לפני שמחברים אותו למוצר אמיתי.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות בעברית?

לא. המודל מוגדר עבור השפה האנגלית בלבד, ולכן טקסט בעברית לא יעבוד. תצטרכו לתרגם את הקלט לאנגלית לפני שליחתו למודל.

האם חייבים כרטיס מסך כדי להריץ אותו?

ממש לא. עם 223 מיליון פרמטרים בלבד, אפשר להריץ אותו ישירות על גבי מעבד רגיל בביצועים טובים.

איך מריצים

טוענים אותו ישירות דרך ספריית transformers באמצעות T5ForConditionalGeneration. הקבצים שוקלים 853 מגה בייט, כך שכל מעבד גרפי פשוט, מחשב נייד מודרני או אפילו מעבד מרכזי רגיל יריצו אותו בלי למצמץ. אין צורך לחפש חומרה יקרה בענן או להגדיר קלאסטרים מיוחדים.

אם אתם כבר מריצים מודל תמונה כבד כמו פלוקס באותו שרת, הוא כמעט לא ישפיע על צריכת הזיכרון הכללית שלכם. להשתמש ב־API חיצוני בשביל פעולה כזו זה מיותר לגמרי, אלא אם הפרויקט שלכם רץ כולו בסביבה נטולת שרת שבה אין שום גישה למעבד או לדיסק מקומי.

from transformers import pipeline

pipe = pipeline("text-generation", model="gokaygokay/Flux-Prompt-Enhance")
print(pipe("שלום"))

הרישיון

הוא מופץ תחת רישיון apache-2.0, שמאפשר שימוש חופשי, כולל שילוב במוצרים מסחריים ושינוי של הקוד. התנאי היחיד הוא שמירת הודעות זכויות היוצרים והרישיון המקורי, לצד מתן קרדיט כפי שביקש המפתח.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗