GPT
T

TinyLLama-v0

קוד פתוח

Maykeyeapache-2.02023-07-08

  • transformers
  • pytorch
  • onnx
  • safetensors
  • llama

גרסת ניסוי קטנה במיוחד שמנסה לשחזר את TinyStories בארכיטקטורת Llama עם פחות מחמישה מיליון פרמטרים. היא תעניין אתכם אם אתם חוקרים מודלים זעירים או צריכים בדיקות קוד מקומיות בלי משאבים.

  • 5Mפרמטרים
  • 2,048טוקנים בהקשר
  • 46.8 MBמשקל הקבצים
  • 122,878הורדות בחודש

מה זה

מדובר בניסיון ראשוני לשחזר את הרעיון של TinyStories-1M, אבל על בסיס LlamaForCausalLM עם 8 שכבות בלבד. במקום מודל ענק שמנסה לדעת הכל, הוא אומן על סט הנתונים של TinyStoriesV2 שנוצר ברובו על ידי GPT-4, מתוך מטרה לייצר טקסט פשוט וסיפורי באנגלית בסיסית ביותר.

ההבדל העיקרי כאן הוא הארכיטקטורה. בעוד מודלים זעירים אחרים נבנו על בסיס מבנים ישנים יותר, כאן נעשה שימוש בכלים המודרניים של Llama יחד עם הטוקנייזר של open_llama_3b. המפתח עצמו מצהיר שמדובר בבדיקת היתכנות גולמית מאוד, כך שאין כאן יכולות שיחה מורכבות, היגיון מעמיק או ידע עולם כללי, אלא מיקוד בלעדי במבנה משפטים פשוט לפי הנתונים שאומן עליהם.

מתאים ל

  • בדיקות אוטומציה ופיתוח

    הוא שוקל פחות מחמישים מגה בייט ועולה מיד, מה שהופך אותו לבחירה נוחה לטסטים של ספריות וקוד.

  • מחקר על מודלים זעירים

    הקוד כולל מחברת אימון מלאה, כך שאפשר לחקור בקלות איך ארכיטקטורת Llama מתנהגת בסקייל מינימלי.

  • הדגמות ללא כרטיס מסך

    אפשר לטעון אותו ולהפיק טקסט ישירות על גבי מעבד פשוט בסביבות מוגבלות מאוד במשאבים.

איפה זה נופל

המפתח מודה שמדובר בגרסה בוסרית לגמרי עם מנגנון קאש פרימיטיבי ומערך אימון קטן מדי. סיפורים שנחתכו מעבר לגודל ההקשר לא אומנו עם חלון נע, מה שפוגע בעקביות. בנוסף, יש תקלות ידועות בטוקנייזר של open_llama בסביבות מקומיות מסוימות, והמודל פשוט לא מתאים לשום משימה שדורשת דיוק או ידע מעבר לסיפורים פשוטים.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל אומן על קובצי TinyStories באנגלית בלבד ומשתמש בטוקנייזר שלא מותאם לעברית. הוא יפלוט רצף תווים חסר פשר אם תנסו להזין לו קלט בעברית.

איך אפשר לשחזר את האימון שלו?

המאגר כולל מחברת בשם train.ipynb וסקריפטים נלווים. צריך להוריד את קובצי הטקסט של TinyStoriesV2 ולהריץ את התאים, כאשר האימון המקורי לקח כ־9 שעות על כרטיס A100 יחיד.

איך מריצים

המודל שוקל 46.8 מגה בייט בסך הכל ורץ ישירות דרך ספריית transformers עם AutoModelForCausalLM. בגלל הגודל הזעיר, אין צורך בשום חומרה מיוחדת, והוא יעלה תוך שניות על מעבד רגיל בכל מחשב נייד, בלי לחשוב בכלל על כרטיס מסך חיצוני.

אם המטרה שלכם היא לקבל תשובות חכמות למשתמשי קצה, אין שום טעם להריץ אותו ועדיף לפנות לכל שירות API קיים. ההרצה המקומית שלו הגיונית בעיקר כשרוצים לבדוק צנרת נתונים, סקריפטים של אימון, או הדגמות טכניות מהירות בלי לשלם על שרתים.

from transformers import pipeline

pipe = pipeline("text-generation", model="Maykeye/TinyLLama-v0")
print(pipe("שלום"))

הרישיון

הרישיון הוא apache-2.0, מה שמאפשר שימוש חופשי לגמרי, כולל שינוי הקוד, שילוב במוצרים מסחריים והפצה מחדש. הדרישה העיקרית היא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗