GPT
B

bloomz-7b1-mt

קוד פתוח

bigsciencebigscience-bloom-rail-1.02022-09-28

  • transformers
  • pytorch
  • tensorboard
  • safetensors
  • bloom

מודל שפה רב לשוני מכוונן הוראות, שמיועד לקבל פניות בשפות שאינן אנגלית. הוא מתאים למי שחייב מודל מקומי בגודל בינוני למשימות טקסט מגוונות.

  • 7.1Bפרמטרים
  • 26.4 GBמשקל הקבצים
  • 399הורדות בחודש
  • 144לייקים

מה זה

מדובר בגרסת 7.1 מיליארד פרמטרים ממשפחת BLOOM שעברה כוונון על מאגר xP3mt. המאגר הזה מכיל משימות בשפות שונות, כשהמטרה המוצהרת של גרסת ה־mt היא לעבוד טוב יותר עם פרומפטים שלא נכתבו באנגלית. הארכיטקטורה זהה למודל הבסיס, אך תהליך האימון הנוסף כלל 4.19 מיליארד טוקנים לאורך אלף צעדים ברמת דיוק של float16.

הוא מסוגל לבצע משימות אפס צעדים כמו תרגום, סיווג רגש וניתוח טקסט לפי הוראה ישירה. ההבדל המרכזי מול גרסת bloomz-7b1 הרגילה נעוץ במיקוד השפתי. הגרסה הרגילה הומלצה לפניות באנגלית, בעוד הגרסה הזו מיועדת ספציפית לקלטים בשפות אחרות. מבחינת שפות המקור, המודל נשען על המאגרים של BLOOM המקורי וכולל שפות כמו ערבית, אנגלית, קטלאנית ושפות נוספות, לצד קוד.

מתאים ל

  • תרגום טקסט רב לשוני

    תרגום ישיר בין שפות שנתמכות במאגר xP3mt על ידי מתן הוראה ברורה.

  • סיווג טקסטים ללא דוגמאות

    הערכת עמדות, סנטימנט וזיהוי נושאים בשפות שונות ישירות מתוך ההנחיה.

  • מענה להוראות בשפות זרות

    חילוץ מידע ותשובות לשאלות כשהפרומפט הראשוני אינו מנוסח באנגלית.

איפה זה נופל

הבעיה המרכזית כאן היא רגישות קיצונית לניסוח הפרומפט. המפתחים עצמם מציינים שאם לא מבהירים למודל בדיוק איפה נגמר הקלט, למשל באמצעות נקודה בסוף משפט או מילות מבנה כמו Translation, הוא עלול פשוט להמשיך לייצר את הטקסט במקום לענות על ההוראה. בנוסף, עברית לא נכללת ברשימת שפות היעד המרכזיות שצוינו בכרטיס, ולכן היכולת שלו להבין הוראות מורכבות בעברית דורשת בדיקה זהירה לפני כל שילוב במערכת.

שאלות
נפוצות

מה ההבדל בין גרסת mt לגרסת bloomz-7b1 הרגילה?

הגרסה הרגילה אומנה בעיקר להוראות באנגלית. גרסת ה־mt עברה כוונון על מאגר xP3mt, ולכן המפתחים ממליצים עליה באופן מפורש עבור פרומפטים בשפות שאינן אנגלית.

האם אפשר להריץ אותו על מחשב אישי רגיל?

הרצה על כרטיס מסך ביתי אפשרית רק במצב 8 ביט ועם כרטיס של 12 עד 16 ג'יגה בייט זיכרון לפחות. אפשר לטעון אותו גם לזיכרון ה־RAM של המעבד, אך קצב יצירת הטקסט יהיה איטי מאוד.

האם המודל יודע לעבוד בעברית?

העברית אינה מופיעה ברשימת השפות המרכזיות של המודל בכרטיס. הוא עשוי לקלוט מילים בודדות בזכות נתוני הרשת הכלליים, אבל לא מומלץ לבנות עליו לעיבוד שפה טבעית בעברית.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־26.4 ג'יגה בייט, מה שאומר שצריך חומרה מתאימה כדי לטעון אותו לזיכרון. הרצה מלאה ב־FP16 דורשת כרטיס מסך עם לפחות 16 עד 24 ג'יגה בייט זיכרון וידאו. מי שמוגבל בחומרה יכול להשתמש בטעינה ב־8 ביט דרך bitsandbytes וספריית transformers, מה שחותך את דרישות הזיכרון ומאפשר לעבוד על כרטיסים צרכניים חזקים.

קוד ההרצה הסטנדרטי מבוסס על ספריות transformers ו־accelerate של Hugging Face, וניתן להריץ אותו על GPU או CPU, אם כי ב־CPU המהירות תהיה נמוכה משמעותית. אם אין לכם שרת ייעודי עם חומרה מתאימה, תשלום לפי קריאה לשרת חיצוני שמחזיק מודל כזה יהיה פשוט וזול יותר.

from transformers import pipeline

pipe = pipeline("text-generation", model="bigscience/bloomz-7b1-mt")
print(pipe("שלום"))

הרישיון

המודל מופץ תחת רישיון bigscience-bloom-rail-1.0. הרישיון מאפשר שימוש מסחרי, אך כולל הגבלות שימוש אחראי (RAIL) שאוסרות על יישומים פוגעניים מסוימים, הפצת דיסאינפורמציה או שימושים רפואיים ומשפטיים ללא פיקוח. תצטרכו לוודא שהמוצר שלכם עומד בכללי ההתנהגות של הרישיון.

הרישיון המלא בעמוד המודל ↗