GPT
P

plamo-2-1b

קוד פתוח

pfnetapache-2.02025-02-05

  • transformers
  • safetensors
  • plamo2
  • text-generation
  • custom_code

מודל קטן של 1.3 מיליארד פרמטרים שמשלב ארכיטקטורת Mamba2 עם מנגנון קשב, ומאומן חזק על אנגלית ויפנית. הוא מתאים למי שרוצה בסיס קל משקל ולא סטנדרטי להמשך אימון.

  • 1.3Bפרמטרים
  • 10,485,760טוקנים בהקשר
  • 4.8 GBמשקל הקבצים
  • 1,898הורדות בחודש

מה זה

במקום עוד ארכיטקטורת שנאי רגילה, המודל הזה בנוי על ארכיטקטורה היברידית בסגנון Samba. הוא מחבר מודל מצב מרחבי סלקטיבי מסוג Mamba2 יחד עם מנגנון קשב בחלון נע, בתוספת שכבות נירמול לייצוב האימון. הרעיון הוא לקבל יעילות חישובית גבוהה לצד זיכרון של קונטקסט ארוך.

הוא אומן על ארבעה טריליון טוקנים בשני שלבים שונים. החלוקה התמקדה בעיקר באנגלית, יפנית וקוד, מה שהופך אותו לרלוונטי במיוחד למי שעובד ישירות עם שוק יפני או שפותח פתרונות שמשלבים את שתי השפות האלו בתוך תשתית מקומית קטנה.

מתאים ל

  • אימון ייעודי ליפנית

    מודל בסיס שראה מעל טריליון טוקנים ביפנית ומתאים לכוונון עדין למשימות שפה מקומיות.

  • מחקר ארכיטקטורות היברידיות

    בדיקת התנהגות ויעילות של שילוב Mamba2 וקשב בחלון נע מול מודלי שנאי רגילים.

  • השלמת קוד וטקסט מקומית

    חומרה פשוטה יכולה להריץ אותו מקומית להשלמת משפטים באנגלית או יפנית.

איפה זה נופל

זה מודל בסיס בלבד. הוא לא עבר התאמה להוראות או לשיחה, ולכן אי אפשר לזרוק אליו שאלה ולצפות לתשובה מנומסת, אלא רק להשלמת טקסט עיוורת. בנוסף, הוא אומן רק על אנגלית, יפנית ומעט קוד, כך שאין מה לצפות ממנו להבנה של עברית. היוצרים שלו מציינים במפורש שהוא מסוגל לייצר פלטים שגויים או מוטים ומחייב בדיקות בטיחות וכיול ייעודי לפני שמשלבים אותו במוצר אמיתי.

שאלות
נפוצות

האם המודל הזה מבין עברית?

הוא אומן על אנגלית, יפנית וקוד בלבד. עברית לא נכללה בנתוני האימון, ולכן הוא לא מתאים לעיבוד שפה מקומית אלא אם תאמנו אותו על קורפוס עברי מאפס.

אפשר להשתמש בו ישירות כבוט לצ׳אט?

לא. המודל לא עבר תהליך של התאמה להנחיות או כוונון שיחה. אם תשאלו אותו שאלה הוא רק ינסה לנחש את המילים הבאות ולא יענה כעוזר.

מה נדרש מבחינת חומרה להרצה שלו?

בגלל שיש לו 1.3 מיליארד פרמטרים ומשקל קבצים של 4.8 גיגה-בייט, כרטיס מסך בסיסי עם 8 גיגה זיכרון יספיק כדי לטעון אותו, אך צריך סביבת לינוקס שמותקנים בה הקרנלים של mamba_ssm.

איך מריצים

כדי להריץ אותו צריך ספריית transformers יחד עם התלויות המיוחדות שלו: mamba_ssm ו־causal_conv1d, לצד numba בשביל הטוקנייזר. הרצת קוד כזה מחייבת שימוש בדגל שמאשר קוד מרוחק מהמאגר. המשקל הכולל של הקבצים עומד על כמעט חמישה גיגה-בייט, כך שהוא נכנס בקלות לכרטיס מסך בודד ופשוט עם שמונה גיגה זיכרון.

אם אתם לא צריכים את הארכיטקטורה הספציפית הזו או שאתם מחפשים מודל מוכן לצ׳אט שמגיב ישר מהקופסה, אין סיבה להסתבך עם התקנת קרנלים של מאמבה. במקרה כזה עדיף לפנות ל־API חיצוני של מודל כללי.

from transformers import pipeline

pipe = pipeline("text-generation", model="pfnet/plamo-2-1b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד והמשקלים, ולשלב אותו במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗