GPT
F

flan-t5-large-grammar-synthesis

קוד פתוח

pszemrajcc-by-nc-sa-4.0,apache-2.02022-11-26

  • transformers
  • pytorch
  • onnx
  • safetensors
  • gguf

הכוונון הזה מתמקד בתיקון דקדוק באנגלית בלי לגעת במשמעות המקורית. הוא מתאים למי שחייב לנקות טקסט משובש במיוחד בריצה מקומית וללא תלות ברשת.

  • 783Mפרמטרים
  • 512טוקנים בהקשר
  • 9.4 GBמשקל הקבצים
  • 2,065הורדות בחודש

מה זה

מדובר בגרסה מכווננת של גוגל פלאן טי חמש לארג', שעברה אימון על גרסה מורחבת של מאגר ג'יי פלאג. המטרה המרכזית שלו היא לקבל טקסט באנגלית עמוס בשגיאות קשות, לתקן אותן במעבר אחד, ולא לגעת בחלקים שכבר כתובים נכון. מודלים אחרים נוטים לשכתב משפטים שלמים או להמציא ניסוחים חדשים, אבל כאן המיקוד הוא רק יישור קו דקדוקי.

המודל מיועד לעבוד על מקטעים קצרים יחסית, סביב שניים עד שלושה משפטים בכל פעם. הוא מנסה לתקן שגיאות כבדות בלי לפגוע בהקשר הסמנטי, מה שהופך אותו לשימושי במיוחד כשלב ביניים בצינור עיבוד נתונים שמקבל טקסטים שבורים ממקורות חיצוניים.

מתאים ל

  • תיקון תמלול קולי

    ניקוי שגיאות דקדוק קשות מפלט של מודלי שמע לטקסט, שנוטים לפספס מבנים תחביריים.

  • ליטוש פלט של צ'אטבוטים

    הסרת ניסוחים עילגים ומשפטים שבורים ממודלי שפה אחרים לפני שהטקסט מגיע למשתמש.

  • השלמת פענוח סריקות

    תיקון טעויות תחביר שנוצרות בזיהוי תווים אופטי של כתב יד או מסמכים ישנים.

איפה זה נופל

המודל מוגדר במפורש כעבודה בתהליך, והיוצר מזהיר שחובה לבדוק את הפלטים בעיניים ולא להסתמך עליהם בעיניים עצומות. חלון ההקשר מוגבל לחמש מאות ושנים עשר טוקנים בלבד, כך שהוא לא מסוגל לבלוע פסקאות ארוכות ברצף. בנוסף, הוא מתקשה עם מונחים מקצועיים מעולמות תוכן ספציפיים ועלול לפספס ביטויים טכניים משובשים.

שאלות
נפוצות

האם אפשר לתת למודל מסמך שלם לתיקון בבת אחת?

לא. המודל בנוי למקטעים קצרים של שניים עד שלושה משפטים, סביב שישים עד תשעים טוקנים. אם תזינו טקסט ארוך מעבר לחלון ההקשר, התוצאה תיחתך או תאבד איכות.

אפשר לשלב אותו במוצר מסחרי של החברה?

לא מומלץ בכלל מבחינה משפטית. למרות תגית אפאצ'י על המודל, מערך הנתונים שעליו הוא אומן כולל סעיף מפורש שאוסר שימוש מסחרי.

איך מריצים

טוענים אותו ישירות דרך פייפליין טקסט טו טקסט בספריית טרנספורמרס, או דרך ספריית אופטימום עם אוננקס כדי לחסוך זמן ריצה. עם כמעט שמונה מאות מיליון פרמטרים בדיוק של שלושים ושתיים ביט, המשקל הכולל מגיע לתשעה נקודה ארבע ג'יגה בייט. בשביל להריץ אותו בנוחות תצטרכו כרטיס מסך עם לפחות שנים עשר עד שישה עשר ג'יגה בייט זיכרון, או לחלופין מעבד חזק עם אופטימיזציות של אוננקס.

המפתח ממליץ לחתוך טקסטים ארוכים לקבוצות של שישים וארבע עד תשעים ושש טוקנים. אם יש לכם נפח עצום של בדיקות פשוטות, כדאי לשים לפניו מסווג קל שיבדוק קודם אם המשפט בכלל דורש תיקון, או פשוט לפנות לשירות מנוהל כשאין לכם שרת ייעודי פנוי.

ollama run hf.co/pszemraj/flan-t5-large-grammar-synthesis:Q6_K

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הקוד והמודל עצמו מסומנים תחת אפאצ'י שתיים אפס, אבל הדאטה עליו אומן כפוף לרישיון קריאייטיב קומונס לא מסחרי עם שיתוף זהה. המשמעות ברורה. אסור להשתמש במודל הזה למוצרים מסחריים מניבי רווח, וכל שימוש נגזר מחייב את אותם תנאי רישיון פתוחים.

הרישיון המלא בעמוד המודל ↗