GPT
Y

Yi-6B-200K

קוד פתוח

01-aiapache-2.02023-11-06

  • transformers
  • pytorch
  • safetensors
  • llama
  • text-generation

מודל בסיס של 6 מיליארד פרמטרים שרץ מקומית ובולט בזכות חלון הקשר ענק. הוא מתאים למי שחייב לעבד מסמכים ארוכים באנגלית ובסינית בלי לשלוח מידע לענן.

  • 6.1Bפרמטרים
  • 200,000טוקנים בהקשר
  • 22.6 GBמשקל הקבצים
  • 14,863הורדות בחודש

מה זה

המודל הזה נבנה מאפס על ארכיטקטורת Llama המוכרת, אבל המשקלים שלו עצמאיים לחלוטין ואומנו על שלושה טריליון טוקנים עד יוני 2023. המאפיין העיקרי שלו מול מודלים אחרים בקטגוריית שישה עד שבעה מיליארד פרמטרים הוא חלון ההקשר, שמגיע למאתיים אלף טוקנים. בערכים מעשיים, זה מאפשר לטעון לתוכו ספרים שלמים או מאות עמודי תיעוד בבת אחת.

זהו מודל בסיס ולא גרסת צ'אט, כלומר הוא מאומן להשלים טקסט ולא לענות לשאלות כעוזר אישי. המפתחים הגדירו את סדרת 6B כמתאימה בעיקר לשימוש אישי ואקדמי, כשההתמקדות של היוצרים היא יכולות דו לשוניות באנגלית ובסינית, הבנת הנקרא והסקה בסיסית.

מתאים ל

  • עיבוד מסמכי ענק באנגלית

    חלון של 200 אלף טוקנים מאפשר להזין תיעוד טכני שלם להשלמה וניתוח טקסטואלי.

  • בסיס לאימון והתאמה אישית

    גודל של 6 מיליארד פרמטרים הופך אימון עדין למשימות מוגדרות למהיר וזול יחסית.

  • ניתוח טקסטים ארוכים בסינית

    הוא אומן במיוחד כמודל דו לשוני ומסוגל להכיל מאות אלפי תווים בסינית בהרצה אחת.

איפה זה נופל

זהו מודל בסיס שעבר רק אימון מקדים, ולכן הוא לא מחזיר תשובות מובנות להוראות ישירות אלא ממשיך את הטקסט שהזנתם. בלי כוונון עדין למשימה שלכם, הוא לא יתפקד כבוט שיחה. בנוסף, המודל אומן על אנגלית וסינית בלבד, כך שאי אפשר לבנות עליו לעיבוד עברית, ונתוני האימון שלו נחתכו ביוני 2023.

אותה משפחה

Yi יצא ב־8 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

אפשר לדבר איתו ישר בצ'אט?

לא. מדובר במודל בסיס שמשלים טקסט ולא עבר התאמה לשיחות. בשביל שיחה צריך להשתמש בגרסת הצ'אט של הסדרה או לאמן אותו בעצמכם על נתוני הוראות.

הוא יודע לקרוא ולכתוב בעברית?

הוא אומן באופן ייעודי על אנגלית וסינית בלבד. אין לו תמיכה רשמית בעברית, ולכן לא מומלץ להסתמך עליו לפרויקטים בשפה המקומית.

איך מריצים

כדי להריץ אותו צריך להוריד כעשרים ושלושה גיגה בייט של קבצים ולהשתמש בספריית transformers הרגילה של פייתון. המודל שמור בדיוק bfloat16, כך שהמשקלים לבדם דורשים קצת יותר משנים עשר גיגה בייט זיכרון וידאו, אבל אם מנצלים את מלוא חלון ההקשר, צריכת הזיכרון לניהול הטוקנים תקפוץ ותדרוש כרטיס מקצועי וחזק בהרבה.

אם יש לכם מחשב נייד פשוט או כרטיס מסך ביתי קטן, עדיף להמיר אותו לפורמט מכווץ דרך llama.cpp או להשתמש בנקודות קצה של צד שלישי שמציעות אותו כשירות. הרצה עצמית שווה את הטרחה רק כשאתם צריכים פרטיות מלאה או שליטה מוחלטת בעיבוד הטקסט.

from transformers import pipeline

pipe = pipeline("text-generation", model="01-ai/Yi-6B-200K")
print(pipe("שלום"))

הרישיון

המודל מופץ ברישיון Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של המשקלים והפצה של המודל בתוך מוצרים, כל עוד אתם שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗