GPT
O

Olmo-3-7B-Instruct

קוד פתוח

allenaiapache-2.02025-11-19

  • transformers
  • safetensors
  • olmo3
  • text-generation
  • conversational

שחרור קוד פתוח מלא מאת Ai2 שמביא יכולות שיחה וקוד מפותחות אל תוך משקל קל. שווה לבחון אותו אם שקיפות נתוני האימון היא שיקול מרכזי בפרויקט שלכם.

  • 7.3Bפרמטרים
  • 65,536טוקנים בהקשר
  • 13.6 GBמשקל הקבצים
  • 246,032הורדות בחודש

מה זה

הגרסה הזו מגיעה אחרי תהליך אימון שלם שכלל כוונון מונחה, אופטימיזציית העדפות, ואימון עם תגמולים שניתנים לאימות. המטרה כאן היא לתת מודל שמתמקד במענה להוראות, לצד שקיפות בכל הנוגע לנתונים ולמשקלי הביניים של שלבי הפיתוח.

במבחני ביצועים הוא מציג זינוק חד לעומת הדור הקודם של המשפחה. במתמטיקה במבחן MATH הוא רושם 87.3 לעומת 30.1 בלבד בגרסה 2, ובמבחן מעקב ההוראות IFEval הוא מגיע לציון 85.6. מצד שני, במבחני קידוד מורכבים כמו LiveCodeBench v3 הוא משיג 29.5 בלבד, ציון שנשאר נמוך משמעותית ממתחרים מקבילים כמו קוון 3 שמגיעים ליותר מ־50.

מתאים ל

  • מעקב אחר הוראות באנגלית

    תוצאה של 85.6 במבחן IFEval מראה שהוא מתאים לביצוע משימות ניסוח מובנות שדורשות דיוק בהנחיות.

  • פתרון בעיות מתמטיות

    ציון 87.3 במבחן MATH מאפשר לשלב אותו בבדיקה ותרגול של תרגילים מתמטיים מוגדרים היטב.

  • מחקר על תהליכי אימון

    השחרור המלא של נתוני Dolci ושלבי המשקל השונים מאפשר לחקור את השפעת כל שלב אימון על התוצאה.

איפה זה נופל

הוא מוגדר לשפה האנגלית בלבד, וכל ניסיון להשתמש בו בעברית לא נתמך במפרט וצפוי להיכשל. מעבר לכך, ביצועי קריאת הכלים שלו נמוכים עם 49.8 בלבד במבחן BFCL, וגם ב־PopQA הוא יורד ל־14.1, מה שמעיד על שליפת עובדות חלשה. היוצרים מודים במפורש שהוא נוטה לייצר תוכן לא מדויק ללא בדיקת עובדות חיצונית, ולכן לא הייתי מחבר אותו למערכת אוטומטית בלי בדיקה קפדנית.

שאלות
נפוצות

האם המודל הזה מתאים לפיתוח מוצר בשפה העברית?

לא. המודל מוגדר רשמית לאנגלית בלבד, ולא הוכשר לעבודה תקינה בעברית. לא הייתי בונה עליו שום שירות שפונה לקהל ישראלי בשפת המקור.

מה החומרה המינימלית שנחוצה כדי להריץ אותו אצלי?

קבצי המשקלים דורשים 13.6 גיגה בייט. בפועל תצטרכו כרטיס גרפי עם 16 גיגה בייט זיכרון לפחות כדי להריץ גרסה מכווצת, או כרטיס של 24 גיגה בייט ומעלה לריצה בתצורת המקור.

איך מריצים

המשקל הגולמי תופס 13.6 גיגה בייט, כך שצריך כרטיס מסך יחיד עם לפחות 16 עד 24 גיגה בייט זיכרון כדי לטעון אותו ישירות. אפשר להריץ אותו דרך ספריית transformers החל מגרסה 4.57.0, או דרך vLLM לעבודה עם תעבורה גבוהה יותר. כדי לחסוך מקום, המפתחים מציעים קוונטיזציה ל־8 ביט בעזרת bitsandbytes.

אם אין לכם שרת מקומי עם מאיץ מתאים ואתם צריכים רק שאילתות בודדות באנגלית, פנייה לפתרון אירוח מרוחק תהיה פשוטה וזולה יותר מתחזוקת תשתית עצמאית.

from transformers import pipeline

pipe = pipeline("text-generation", model="allenai/Olmo-3-7B-Instruct")
print(pipe("שלום"))

הרישיון

הרישיון הוא אפאצ'י 2.0 המוכר. מותר להשתמש בו לצרכים פנימיים, לשנות אותו, ולשלב אותו במוצרים מסחריים בלי תשלום תמלוגים, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון. היוצרים מציינים שהשימוש צריך להתאים גם להנחיות השימוש האחראי שלהם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗