GPT
O

OLMo-2-1124-7B

קוד פתוח

allenaiapache-2.02024-10-29

  • safetensors
  • olmo2
  • en

זה מודל בסיס פתוח לחלוטין עם קוד, נתונים וצ'קפוינטים מלאים. מי שבוחר בו מחפש שקיפות מחקרית מוחלטת ולא עוד קופסה שחורה שרק המשקולות שלה חשופות.

  • 7.3Bפרמטרים
  • 4,096טוקנים בהקשר
  • 27.2 GBמשקל הקבצים
  • 85,723הורדות בחודש

מה זה

מדובר במודל שפה גולמי מסוג אוטורגרסיבי שפותח על ידי מכון אלן לבינה מלאכותית ואומן על ארבעה טריליון טוקנים באנגלית. הוא מציג שיפור משמעותי לעומת הדור הראשון בסדרה, עם קפיצה של 9 נקודות במבחן MMLU, בעיקר בזכות שיטת אימון רב שלבית ושימוש במאגרי המידע OLMo-mix ו־Dolmino-mix.

בטבלת המבחנים הוא מגיע לממוצע של 62.9 ומקבל 67.5 ב־GSM8k ו־60.8 ב־DROP. המספרים האלה מציבים אותו מעל מודלים פתוחים לחלוטין קודמים כמו DCLM ו־MAP-Neo, ואף מעל Llama 2 בגודל 13B. עם זאת, הוא נשאר מאחורי מודלים מובילים באותו סדר גודל כמו Qwen 2.5 שמגיע לממוצע של 67.4 או Llama 3.1 שעומד על 61.8 אבל עוקף אותו במבחני ידע רחבים יותר.

מתאים ל

  • מחקר על תהליכי אימון

    גישה ישירה לצ'קפוינטים לאורך שלבי הלימוד מאפשרת לבדוק בדיוק איך הידע נבנה ברשת.

  • אימון ייעודי מאפס באנגלית

    נקודת מוצא טובה לכוונון על דאטה פרטי בארגון, בלי תלות במודלים מסחריים סגורים.

  • השוואת ביצועים במדע פתוח

    בסיס השוואה נקי מול מודלים אחרים, כיוון שכל נתוני הדאטהסט והארכיטקטורה חשופים.

איפה זה נופל

זהו מודל בסיס בלבד, ללא התאמת הוראות וללא סינון בטיחות. הכרטיס מציין במפורש שהוא נוטה לייצר מידע שגוי, להמציא עובדות ולפלוט תוכן רגיש או מוטה בקלות רבה אם מבקשים זאת. בנוסף, חלון ההקשר מוגבל ל־4,096 טוקנים בלבד, תאריך העדכון שלו נעצר בדצמבר 2023, והוא מאומן על אנגלית בלבד ללא שום תמיכה רשמית בעברית.

אותה משפחה

OLMo-2-1124 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה בעברית?

הוא אומן על נתונים באנגלית בלבד. לא הייתי בונה עליו לשום משימה בעברית, שכן חסר לו אוצר המילים והטוקנייזר המתאים, והתוצאות בשפה זו יהיו משובשות מאוד.

אפשר להשתמש בו ישירות בתור צ'אטבוט?

לא. זה מודל בסיס שמנחש את הטוקן הבא בטקסט ולא הוכשר לענות לשאלות או לעקוב אחרי הוראות. לשיחות צריך להוריד את גרסת Instruct או לבצע כוונון נפרד.

למה הקבצים שוקלים מעל 27 גיגהבייט?

המשקולות נשמרו בדיוק float32 מלא ולא ב־float16 או bfloat16 הנפוצים יותר להפצה. טעינה ראשונית דורשת שטח אחסון גדול, וכדאי להמיר את המשקולות מיד כדי לחסוך מקום וזיכרון עבודה.

איך מריצים

הקבצים שוקלים 27.2 גיגהבייט בגלל ייצוג float32, כך שהרצה ישירה של המקור דורשת זיכרון וידאו של מעל 30 גיגהבייט. בפועל לא מריצים אותו כך. כדי להעלות אותו על חומרה מקומית או שרת זול, עדיף להמיר אותו ל־float16 או לכווץ ל־8 ביט בעזרת bitsandbytes, מה שמוריד את הצריכה לאזור כרטיס בודד של 16 או 24 גיגהבייט זיכרון.

מי שמתכנן לעבוד איתו צריך לזכור שזו גרסת בסיס. אם המטרה היא צ'אט או שימוש מידי בפקודות, עדיף לפנות ישירות לגרסת ה־Instruct או לקרוא למודל שירות מסחרי, כי הרצת גרסת הבסיס הזו מחייבת כוונון מקדים על נתונים שלכם.

pip install -U huggingface_hub
hf download allenai/OLMo-2-1124-7B

הרישיון

הקוד והמשקולות מפורסמים תחת רישיון apache-2.0. הרישיון מתיר שימוש מסחרי מלא, שינוי של הקבצים, הפצה ושילוב במוצרים פרטיים בלי תשלום תמלוגים, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של תנאי הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗