GPT
R

Roleplay-Llama-3-8B

קוד פתוח

vicgalleapache-2.02024-04-19

  • transformers
  • safetensors
  • llama
  • text-generation
  • roleplay

גרסת כוונון עדין של לאמה שמיועדת למשחקי תפקידים ומחזירה דיאלוג משולב עם פעולות. מי שבונה בוטים עלילתיים או שיחות אינטראקטיביות יקבל פה התנהגות מובנית מהקופסה.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 1,407הורדות בחודש

מה זה

מדובר במודל לאמה 3 שעבר כוונון עדין ספציפי על דאטה-סט בשם NSFW_RP_Format_DPO, במטרה לייצר פלט במבנה קבוע של דיבור ופעולות בין כוכביות. הוא דורג שני בדירוג הכללי של Chaiverse לפי מדד ELO, וראשון מבין המודלים בקטגוריית הגודל שלו. זה אומר שבשיחות ומשחקי תפקידים הוא מייצר חוויית שיחה משכנעת יחסית למתחרים באותו משקל.

מצד שני, מבחני הבנצ'מרק של Open LLM מציגים ממוצע כללי נמוך של 24.33. היכולת שלו לעקוב אחרי הוראות פשוטות בסיסית וטובה עם 73.20 ב־IFEval, אבל המבחנים שבודקים ידע והסקה כבדה מראים תוצאות חלשות מאוד. הוא נבנה לסגנון שיחה מסוים ולא כדי לפתור חידות היגיון.

מתאים ל

  • בוטים למשחקי תפקידים

    פולט דיאלוגים לצד פעולות מובנות בין כוכביות, בדיוק בסגנון שדרוש לסיפור אינטראקטיבי.

  • דמויות וירטואליות עלילתיות

    מתברג גבוה במבחני שיחה ואינטראקציה מול משתמשים ביחס לגודל שלו.

  • בדיקת ממשקי שיחה לא מצונזרים

    עבר התאמה על מאגרי שיחה חופשיים ללא מגבלות נוקשות על התוכן.

איפה זה נופל

המודל אומן על דאטה שכולל תכני NSFW ופורמט הדוק מאוד של דיאלוג ופעולות, ולכן הוא לא מתאים בשום אופן לשימושים עסקיים כלליים, תמיכה טכנית או מענה רשמי. המספרים מראים קריסה מוחלטת ביכולות מדעיות ומתמטיות, עם 8.69 בלבד במתמטיקה ו־1.45 ב־GPQA. כל משימה שדורשת דיוק עובדתי, שליפת מידע אמין או קוד פשוט תסתיים בהזיות.

שאלות
נפוצות

האם אפשר להשתמש בו בתור צ'אטבוט רגיל לשירות לקוחות?

לא כדאי. המודל אומן ספציפית על תכנים חופשיים ומחזיר טקסט שמשלב פעולות עלילתיות בסגנון משחקי תפקידים. הוא עלול לפלוט תכנים לא הולמים ולא מתאים לאתר עסקי.

איך המודל מתמודד עם משימות הגיון או עובדות?

התוצאות במבחני ידע נמוכות מאוד, כולל ציונים שקרובים לניחוש אקראי במדעים והסקה. המטרה שלו היא שיחה חופשית וזרימה של דמות, לא דיוק עובדתי או פתרון בעיות.

איך מריצים

המשקל עומד על 15 ג'יגה בייט בפורמט float16, כך שצריך כרטיס מסך עם לפחות 16 עד 24 ג'יגה זיכרון כדי להריץ אותו מקומית בלי קוונטיזציה. אפשר להעלות אותו ישר דרך ספריית transformers בסביבת פייתון רגילה.

אם אין לכם חומרה ייעודית זמינה, להחזיק שרת כזה בענן בשביל כמה בדיקות יהיה יקר מדי. במקרים כאלה עדיף לבדוק אם יש שירותי API שמארחים אותו לפי שעה או לפי טוקנים, לפני שמתחייבים לתשתית עצמאית.

from transformers import pipeline

pipe = pipeline("text-generation", model="vicgalle/Roleplay-Llama-3-8B")
print(pipe("שלום"))

הרישיון

הרישיון הוא apache-2.0, רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי והפצה של המודל. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, בלי להטיל אחריות משפטית על היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗