GPT
F

flan-t5-base

קוד פתוח

googleapache-2.02022-10-21

  • transformers
  • pytorch
  • tf
  • jax
  • safetensors

גרסת הוראות מכווננת לארכיטקטורת T5 הוותיקה, שמתאימה למשימות עיבוד שפה מוגדרות היטב. מקבלים יכולת מעקב אחרי פקודות בסיסיות באריזה קלה במיוחד.

  • 248Mפרמטרים
  • 512טוקנים בהקשר
  • 3.9 GBמשקל הקבצים
  • 1,535,321הורדות בחודש

מה זה

גוגל לקחו את T5 המקורי והעבירו אותו כוונון על יותר מאלף משימות שונות עם הוראות מפורשות, במטרה לשפר ביצועים ללא דוגמאות מוקדמות או עם דוגמאות בודדות בלבד. התוצאה היא מודל שמבין הנחיות טקסטואליות ישירות כמו תרגום, סיווג או מענה על שאלות, בלי שצריך לאלף אותו מחדש על כל ניואנס קטן.

במבחני ביצועים מול גרסת הבסיס המקורית, המודל מציג זינוק של ממש, עם ממוצע של 77.98 נקודות על פני 36 מאגרי בדיקה לעומת 68.82 בלבד בגרסה הקודמת. הוא מצטיין במיוחד בסיווג רגשות וניתוח טקסט, כמו ציון של 94.38 ב־SST-2 ודיוק של 97.2 בזיהוי ישויות ב־TREC, מה שממחיש את היתרון של אימון מבוסס הוראות לעומת אימון גנרי.

מתאים ל

  • סיווג טקסטים קצרים

    משיג דיוק גבוה בזיהוי רגשות ונושאים בזכות כוונון על אלפי הוראות ומבחן SST-2 שעומד על 94.38.

  • תרגום משפטים פשוטים

    תומך בעשרות שפות ישירות מתוך הפרומפט, אידיאלי למשימות תרגום קצרות ומקומיות בלי תלות ברשת.

  • מענה על שאלות ממוקדות

    עונה על שאלות ישירות מתוך פסקאות קצרות, עם ביצועים טובים במבחני הבנת הנקרא כמו BoolQ.

איפה זה נופל

חלון ההקשר מוגבל ל־512 טוקנים בלבד, כך שטקסטים ארוכים פשוט ייחתכו ולא יכנסו לעיבוד. מעבר לזה, הכרטיס מציין במפורש שהמודל לא נבדק ביישומים בעולם האמיתי, ואומן על מאגרי טקסט שלא עברו סינון לתוכן בוטה או הטיות. הוא עלול לפלוט תוכן פוגעני או לשחזר הטיות קיימות, ולכן גוגל מזהירים לא לשלב אותו ישירות במוצר ללא בדיקות בטיחות מוקדמות.

שאלות
נפוצות

האם הוא מתאים לעיבוד של מסמכים שלמים?

ממש לא. המגבלה של 512 טוקנים מיועדת למשפטים בודדים או לפסקאות קצרות מאוד, וכל טקסט מעבר לזה ייחתך ולא ייקרא.

כמה מסובך להריץ אותו מקומית?

פשוט מאוד. הקבצים שוקלים 3.9 גיגה בייט, והוא נטען ישירות בפייתון עם שורות קוד בודדות, ואפילו רץ על מעבד רגיל בלי כרטיס מסך ייעודי.

איך מריצים

את המשקל הזה, ששוקל 3.9 גיגה בייט בקבצים שלו, מריצים בקלות ישירות דרך ספריית transformers של פייתון. הוא לא דורש שרת מפלצתי ויכול לרוץ בנוחות על מעבד רגיל, או על כרטיס מסך בסיסי עם הגדרת חצי דיוק או כימות לשמונה ביט לחיסכון נוסף בזיכרון.

אם אתם צריכים רק משימות קלות כמו סיווג קצר או תרגום ממוקד, שווה להרים אותו לבד על שרת פנימי קטן ולחסוך זמני השהיה ועלויות. לעומת זאת, אם אתם מחפשים יכולות שיחה מורכבות או ניתוח של מסמכים ארוכים, עדיף לפנות ל־API חיצוני של מודל ענק במקום להסתבך עם התוצאות המוגבלות שלו.

from transformers import pipeline

pipe = pipeline("text-generation", model="google/flan-t5-base")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0, וזה אומר חופש כמעט מוחלט. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד, לאמן אותו הלאה ולשלב אותו במוצרים סגורים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, לצד ציון שינויים אם נעשו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗