GPT
O

OLMo-Bitnet-1B

קוד פתוח

NousResearchapache-2.02024-03-30

  • transformers
  • pytorch
  • olmo
  • text-generation
  • custom_code

זה מודל שפה קטן של מיליארד פרמטרים שנועד לבדוק אימון בשיטת ביט וחצי. הוא מעניין חוקרים שרוצים לבדוק ארכיטקטורות קוונטיזציה קיצוניות בלי לשרוף תקציב ענק.

  • 4.4 GBמשקל הקבצים
  • 266הורדות בחודש
  • 123לייקים

מה זה

מדובר במימוש של ארכיטקטורת OLMo לפי שיטת BitNet 1.58b, שמאפשרת תיאורטית לייצג משקולות בערכים של מינוס אחת, אפס ואחת בלבד. המודל אומן על שישים מיליארד טוקנים בלבד מתוך המאגר Dolma, כמות קטנה מאוד במונחים של מודלים מודרניים. המטרה כאן היא ניסוי ולא תחליף למודל הפקה.

היוצרים ביצעו במקביל אימון זהה לחלוטין עם אותם היפרפרמטרים במשקולות רגילות של fp16, כדי לבודד את ההשפעה של הארכיטקטורה. התוצאה היא כלי להשוואה מחקרית שמראה איך שיטת הקידוד הזו מחזיקה מעמד מול דיוק רגיל כבר בתחילת הריצה.

מתאים ל

  • מחקר קוונטיזציה

    השוואת ביצועים של ארכיטקטורת ביט וחצי מול משקולות רגילות על אותו מאגר מידע בדיוק.

  • בדיקת אינטגרציה עם OLMo

    בחינת צנרת טעינה והרצה של מודלי אולמו בסביבת בדיקות מקומית וקלת משקל.

  • ניתוח התכנסות אימון

    מעקב אחרי גרפי הלמידה מול ריצת הבסיס כדי לבדוק יציבות בשלבים מוקדמים.

איפה זה נופל

המודל הזה לא נועד למוצרים ולא מסוגל להחזיק שיחה. הכרטיס מציין במפורש שמדובר בהוכחת היתכנות מחקרית שראתה שישים מיליארד טוקנים בלבד, מה שאומר שהוא מייצר הזיות בקצב גבוה ואינו יודע עברית כלל. מעבר לזה, המשקולות מסופקות בקוד בפורמט חצי דיוק ולא ממומשות כמנוע מואץ בביט בודד, כך שאין כאן חיסכון אמיתי בחומרה מהקופסה.

שאלות
נפוצות

האם המודל חוסך זיכרון של כרטיס המסך בפועל?

לא באופן אוטומטי. למרות שהוא אומן לפי שיטת ביט וחצי, קוד הדוגמה טוען אותו בפורמט bfloat16 רגיל ושוקל מעל ארבעה גיגה בייט. כדי לראות חיסכון ממשי בברזלים צריך מנוע הרצה ייעודי שתומך בפורמט המקורי.

האם אפשר להשתמש בו ליצירת טקסט באפליקציה?

ממש לא. שישים מיליארד טוקנים זה מעט מדי בשביל מודל שפה שלם, והיוצרים מגדירים אותו כהוכחת היתכנות בלבד. הוא לא עבר התאמה לשיחה וייכשל במשימות פשוטות.

איך מריצים

כדי להריץ אותו צריך להתקין את ספריית ai2-olmo לצד transformers ולהגדיר הרצת קוד מרוחק. למרות הארכיטקטורה של 1.58 ביט, המשקולות שמורות ומורצות בקוד הדוגמה בפורמט bfloat16, כך שנפח הקבצים עומד על 4.4 גיגה בייט והוא דורש כרטיס מסך פשוט או זיכרון עבודה צנוע.

אם אתם מחפשים תשובות איכותיות למשתמשים, אין סיבה להרים אותו. עדיף לקרוא לכל שירות ענן מודרני שיספק טקסט קוהרנטי בעלות זניחה, במקום להיאבק עם מודל קטן שלא סיים אימון.

from transformers import pipeline

pipe = pipeline("text-generation", model="NousResearch/OLMo-Bitnet-1B")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. הוא מתיר שימוש מסחרי חופשי, שינוי של הקוד והפצה מחדש, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי. אין כאן הגבלות מיוחדות על שילוב במוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗