GPT
O

OLMo-2-0425-1B-Instruct

קוד פתוח

allenaiapache-2.02025-04-29

  • transformers
  • safetensors
  • olmo2
  • text-generation
  • conversational

גרסת הוראות קטנה במיוחד עם נתונים ואימונים שקופים לחלוטין. הוא מתאים למי שרוצה מודל של פחות משלושה גיגה־בייט שמצטיין במעקב אחר הנחיות ובפתרון בעיות חשבון בסיסיות.

  • 1.5Bפרמטרים
  • 4,096טוקנים בהקשר
  • 2.8 GBמשקל הקבצים
  • 66,296הורדות בחודש

מה זה

מדובר במודל שפה קומפקטי של כמיליארד וחצי פרמטרים, שעבר שרשרת אימון מלאה הכוללת כוונון מונחה, אופטימיזציית העדפות בשיטת DPO, ואימון חיזוק מבוסס אימות לפתרון בעיות. Allen Institute for AI בנו אותו כדי לאפשר מחקר פתוח, כך שכל הקוד, נתוני האימון ונקודות הביקורת זמינים לציבור.

במבחני הביצועים הוא מציג תוצאות מפתיעות לגודל שלו, במיוחד במשימות של עמידה בהוראות קפדניות עם ציון 70.1 במבחן IFEval, ובחשבון עם 68.3 במבחן GSM8K. הוא גובר שם על מתחרים ישירים כמו Llama 3.1 1B ו־SmolLM2 1.7B. מצד שני, בידע כללי רחב או במתמטיקה מורכבת ברמת תיכון הוא נשאר חלש משמעותית ממודלים כמו Qwen 2.5 1.5B.

מתאים ל

  • מעקב אחר הנחיות פשוטות

    התוצאה הגבוהה במבחן IFEval הופכת אותו למעולה בעיבוד פקודות מוגדרות היטב.

  • חישובים קלים על מכשיר קצה

    הוא מצטיין בבעיות מילוליות בסיסיות ורץ בקלות על חומרה חלשה בלי שרת.

  • מחקר על תהליכי אימון

    משקלי המודל שמורים כל עשרים צעדים, מה שמאפשר לבדוק שינויים בהתנהגות.

איפה זה נופל

היוצרים מבהירים במפורש שלמודל יש אימון בטיחות מוגבל מאוד ואין לו מנגנון סינון תשובות מובנה בזמן אמת, כך שהוא עלול לייצר פלט בעייתי אם דוחקים בו.

בנוסף, הוא מיועד בעיקר לאנגלית. חלון ההקשר מוגבל ל־4,096 טוקנים בלבד, והיכולות שלו במתמטיקה מתקדמת עומדות על 20.7 בלבד במבחן MATH. אל תבנו עליו לעיבוד טקסטים ארוכים או להבנה מעמיקה של הקשרים מסובכים.

אותה משפחה

OLMo-2-0425 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו לשיחות בעברית?

הכרטיס מציין שהמודל אומן בעיקר באנגלית. בלי תמיכה מוצהרת בעברית, הוא צפוי להתקשות מאוד בהבנה ובניסוח, ולא מומלץ להסתמך עליו למשימות בשפה הזו.

מה שונה בתבנית השיחה שלו ממודלים אחרים?

תבנית הצ'אט שלו אינה כוללת טוקן bos בתחילת הקלט, בניגוד לגרסאות קודמות של המשפחה. חשוב להשתמש ישירות בטוקנייזר שלו כדי למנוע ירידה באיכות הפלט.

איך מריצים

במשקל של 2.8 גיגה־בייט בפורמט bfloat16, המודל רץ בלי בעיה על מעבד מקומי חזק או על כל כרטיס מסך פשוט עם ארבעה עד שישה גיגה זיכרון. טוענים אותו ישירות דרך ספריית transformers מגרסה 4.48 ומעלה, או ב־vLLM עם גרסאות עדכניות. המפתחים שחררו גם נקודות שמירה כל עשרים צעדי אימון למי שרוצה לנתח את תהליך הלמידה.

אם אתם צריכים לנתח מסמכים ארוכים או לבצע שיחות מורכבות בעברית, חבל על המאמץ של תחזוקת שרת עצמאי. במקרים כאלה עדיף לפנות ל־API של מודל ענן גדול.

from transformers import pipeline

pipe = pipeline("text-generation", model="allenai/OLMo-2-0425-1B-Instruct")
print(pipe("שלום"))

הרישיון

הוא מופץ תחת רישיון Apache 2.0 מלא. הרישיון מתיר שימוש מסחרי, שינוי קוד, הפצה מחדש והטמעה במוצרים סגורים, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗