GPT
Y

Yi-1.5-9B

קוד פתוח

01-aiapache-2.02024-05-11

  • transformers
  • safetensors
  • llama
  • text-generation
  • text-generation-inference

גרסת בסיס חזקה בגודל שמונה נקודה שמונה מיליארד פרמטרים. היא עברה אימון המשך מסיבי ומתאימה למי שרוצה בסיס איכותי להתאמה אישית.

  • 8.8Bפרמטרים
  • 4,096טוקנים בהקשר
  • 16.5 GBמשקל הקבצים
  • 13,978הורדות בחודש

מה זה

מדובר במודל שפותח על ידי 01-ai כגרסה משודרגת לסדרת Yi המקורית. כדי להגיע לביצועים האלה, המפתחים לקחו את המודל המקורי והמשיכו לאמן אותו על קורפוס איכותי של חמש מאות מיליארד טוקנים נוספים, מתוך סך כולל של שלושה נקודה שישה טריליון טוקנים ששימשו לפרויקט כולו.

התוצאה של תהליך האימון הנוסף מורגשת בעיקר במשימות תכנות, פתרון בעיות מתמטיות וחשיבה לוגית, בלי לאבד יכולות הבנת שפה וקריאה. המודל מתבסס על ארכיטקטורת Llama For Causal LM עם ארבעים ושמונה שכבות, מה שהופך את השילוב שלו במערכות קיימות לפשוט מאוד דרך ספריות מוכרות.

מתאים ל

  • בסיס לאימון נוסף

    נקודת מוצא מעולה לכוונון עדין על נתונים פנימיים בזכות אימון המשך על חמש מאות מיליארד טוקנים.

  • השלמת קוד מקומית

    המודל חוזק ביכולות תכנות ולוגיקה, ומתאים למשימות השלמת שורות קוד בארכיטקטורה מוכרת.

  • חילוץ מבנה מטקסט קצר

    מתאים להשלמת פורמטים מוגדרים מראש בתוך חלון ההקשר של ארבעת אלפים טוקנים.

איפה זה נופל

זהו מודל בסיס בלבד, ללא התאמת שיחה או הנחיות, ולכן הוא לא יודע לענות לשאלות כעוזר אישי אלא רק להשלים טקסט. אם תתנו לו שאלה ישירה, הוא פשוט ימשיך לכתוב טקסט באותו סגנון. בנוסף, חלון ההקשר שלו מוגבל מאוד ועומד על ארבעת אלפים תשעים ושבעה טוקנים, מה שפוסל אותו לעיבוד מסמכים כבדים בלי מעבר לגרסאות הארוכות יותר של הסדרה.

אותה משפחה

Yi-1.5 יצא ב־7 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מוכן לשיחה עם משתמשים?

לא. זו גרסת בסיס שמיועדת להשלמת טקסט, ולא עברה כוונון עדין למענה על שאלות. לשימושי שיחה יש לפנות לגרסת ה־Chat של הסדרה.

מה נדרש כדי להריץ את המודל הזה?

קבצי המודל תופסים שישה עשר נקודה חמישה גיגה בייט בפורמט bfloat16. להרצה מלאה צריך חומרת שרת או מאיץ גרפי מתאים, או לבצע המרה ודחיסה של המשקלים.

איך מריצים

המשקל הכולל של הקבצים עומד על שישה עשר נקודה חמישה גיגה בייט בפורמט bfloat16, כך שצריך כרטיס מסך עם זיכרון ייעודי מתאים כדי לטעון אותו במלואו, או לבצע קוונטיזציה. המודל נתמך ישירות דרך ספריית transformers ורץ כמו כל מודל מבוסס Llama.

קחו בחשבון שמדובר בגרסת בסיס ולא בגרסת צ'אט, והיא מגיעה עם חלון הקשר של ארבעת אלפים תשעים ושבעה טוקנים בלבד. אם אתם צריכים שיחה מוכנה מראש או עיבוד טקסטים ארוכים במיוחד, עדיף להסתכל על גרסאות ה־Chat או גרסת השלושים ושניים אלף טוקנים במקום לנסות לכוונן את זו לבד.

from transformers import pipeline

pipe = pipeline("text-generation", model="01-ai/Yi-1.5-9B")
print(pipe("שלום"))

הרישיון

המודל משוחרר תחת רישיון apache-2.0. זהו רישיון קוד פתוח מתירני מאוד שמאפשר שימוש מסחרי, שינוי הקוד, הפצה ושילוב בתוך מוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים ומצהירים על שינויים שבוצעו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗