GPT
S

SmolLM2-360M-Instruct

קוד פתוח

HuggingFaceTBapache-2.02024-10-31

  • transformers
  • tensorboard
  • onnx
  • safetensors
  • llama

זה מודל שפה זעיר שעבר כוונון להוראות ומיועד לרוץ ישירות על מכשירי קצה. הוא מתאים למי שחייב עיבוד טקסט בסיסי בלי שרת ובלי תלות ברשת.

  • 362Mפרמטרים
  • 8,192טוקנים בהקשר
  • 4.7 GBמשקל הקבצים
  • 298,126הורדות בחודש

מה זה

מדובר במודל של 362 מיליון פרמטרים שאומן על ארבעה טריליון טוקנים, ועבר התאמה להוראות בעזרת מאגרי נתונים ייעודיים ושיטת DPO. המטרה שלו היא לתת מענה למשימות כמו שכתוב טקסט, סיכום ומעקב אחר פקודות פשוטות באנגלית, תוך שמירה על משקל מזערי של פחות מחמישה גיגה בייט בקבצי המקור.

במבחני ביצועים להבנת הוראות כמו IFEval הוא משיג תוצאה של 41 לעומת 31.6 של Qwen2.5 המקביל, וגם מוביל במבחני ידע כללי כמו ARC. עם זאת, במבחני הגיון מתמטי כמו GSM8K הוא מקבל 7.43 בלבד לעומת 26.8 של המתחרה. המספרים האלה מראים שהוא יודע להישמע קוהרנטי ולבצע פקודות ניסוח, אבל לא מחזיק יכולת חישוב או פתרון בעיות מורכבות.

מתאים ל

  • שכתוב טקסט באנגלית

    מתאים לתיקון ניסוח והגהה מקומית באפליקציות צד לקוח בלי לפנות לשרת חיצוני.

  • סיכום פסקאות קצרות

    מייצר תמציות מהירות של טקסטים באנגלית על גבי מכשירים חלשים או בדפדפן.

  • מעקב אחר הוראות פשוטות

    מבצע פקודות פורמט והנחיות ברורות הודות לציון גבוה במבחני מעקב הוראות.

איפה זה נופל

המודל פועל כמעט אך ורק באנגלית ואינו תומך בעברית. יוצרי המודל מבהירים כי התוכן שהוא מייצר עלול לכלול שגיאות עובדתיות, כשלים לוגיים והטיות שהיו במידע המקורי. בנוסף, חלוקת הפונקציות שקיימת בגרסת ה־1.7B לא נתמכת כאן, והוא אינו מתאים בשום אופן לחישובים מתמטיים או להסקת מסקנות מורכבת.

אותה משפחה

SmolLM2 יצא ב־8 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל אומן ונבדק על תוכן באנגלית בלבד. ניסיון להזין לו עברית יניב ככל הנראה טעויות או ג'יבריש, ולכן הוא לא רלוונטי למוצרים בשפה המקומית.

האם הוא תומך בהפעלת פונקציות כמו גרסאות גדולות יותר?

לא, יכולת ה־function calling נשמרה בגרסה זו רק לגודל של 1.7 מיליארד פרמטרים. הגודל הנוכחי מסוגל להתמודד עם שכתוב, סיכום ומענה טקסטואלי ישיר בלבד.

איך מריצים

בגלל הגודל המזערי שלו אפשר להריץ אותו ישירות על מעבד רגיל, בדפדפן דרך transformers.js, או דרך ספריית transformers בפייתון על כרטיס גרפי פשוט. הוא לא דורש שרת ייעודי או זיכרון גרפי יקר, וצורך מעט מאוד משאבים.

אם אתם צריכים רק לסווג או לנסח משפטים מקומית, אין טעם לשלם על API חיצוני. שירות מנוהל של מודל ענק שווה את הכסף רק כשיש צורך בעברית, בהבנה לוגית עמוקה או בחישובים, דברים שהמודל הזה פשוט לא מסוגל לתת.

from transformers import pipeline

pipe = pipeline("text-generation", model="HuggingFaceTB/SmolLM2-360M-Instruct")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי מלא, שינוי של הקוד והפצה פנימית או מסחרית בתוך המוצר שלכם, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗