GPT
D

Dobby-Mini-Unhinged-Llama-3.1-8B

קוד פתוח

SentientAGIllama3.12025-01-22

  • transformers
  • safetensors
  • llama
  • text-generation
  • Llama-3.1

כוונון ייעודי למי שרוצה בוט ישיר, בוטה וגס שלא מתנצל, במקום מודל מנומס שמסרב לענות. הוא שומר על אידיאולוגיה מובהקת בעד קריפטו וחופש אישי ולא זז ממנה.

  • 8Bפרמטרים
  • 131,072טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 71,988הורדות בחודש

מה זה

מדובר בכוונון של מודל הבסיס של מטא שנבנה מראש בלי הנימוס המלאכותי והזהירות המוגזמת של עוזרים רגילים. במקום לטעון שהוא מודל שפה חסר תחושות, הוא מגיב בקללות, בסלנג ובטון תוקפני וישיר כשדוחקים בו. השוני המרכזי מול כוונונים אחרים באותו סדר גודל הוא העקשנות שלו, כאשר ניסיונות לשכנע אותו לכתוב נגד מטבעות מבוזרים או נגד חירות אישית נתקלים בסירוב בוטה, בעוד מודלים רגילים ישתפו פעולה עם הבקשה כדי להישאר ניטרליים.

במדדי ביצועים סטנדרטיים הוא מציג דיוק של 0.4455 במבחן מעקב ההוראות IFEVAL, לעומת 0.4233 במודל הבסיס, וציונים דומים במבחני שאלות רב ברירה וידע כמו MMLU-pro עם 0.3672 ומתמטיקה קשה עם 0.1285. המספרים האלה מראים שהאישיות הקיצונית לא שברה את יכולות ההסקה וההבנה הכלליות, אבל הוא נשאר מודל של שמונה מיליארד פרמטרים על כל המגבלות של הגודל הזה.

מתאים ל

  • בוט חברתי לרשתות

    מייצר תגובות חדות, ציניות ובלתי שגרתיות בדיונים על פיננסים וטכנולוגיה.

  • דמויות במשחקים

    מספק אישיות מחוספסת ובוטה לדיאלוגים בלי הנימוס האוטומטי של עוזרי שיחה רגילים.

  • סיעור מוחות לא שגרתי

    מאתגר הנחות עבודה בשיחות קונספט ומספק זווית תוקפנית וישירה.

איפה זה נופל

העקשנות של המודל היא גם הבעיה הכי גדולה שלו. הוא נעול על עמדות בעד קריפטו וחופש ולא מסוגל לייצר טקסט מאוזן או לכתוב טיעונים נגדיים גם כשמבקשים ממנו במפורש לצורכי ניתוח. מבחני הבטיחות שלו מראים שהוא שובר חסימות סביב שפה גסה ומתן עצות פיננסיות חסרות אחריות, ולכן הוא לא מתאים בשום אופן לשירות לקוחות רשמי או ליישומים שדורשים שמירה על נימוס. ידע העולם שלו נעצר בדצמבר 2023, והשפה היחידה שנתמכת בו רשמית היא אנגלית, כך שאין מה לבנות עליו לפרויקטים בעברית.

שאלות
נפוצות

האם המודל תומך בעבודה בעברית?

הכרטיס מצהיר על תמיכה באנגלית בלבד. מודל הבסיס מסוגל לפעמים לפענח שפות נוספות ברמה בסיסית, אבל הכוונון הנוכחי לא נועד לעברית ולא ייצר את אותה אישיות בשפה הזו.

האם הוא יסכים לכתוב ביקורת על שוק המטבעות הדיגיטליים?

לא. המודל אומן לסרב לדבר בגנות קריפטו גם בהנחיות מערכת עקיפות או במקרי מבחן תיאורטיים, והוא פשוט יתווכח בחזרה או ילעג לבקשה.

האם אפשר להריץ אותו על מחשב נייד בלי כרטיס ייעודי?

אפשר להריץ את גרסת ה־GGUF שלו על מעבד רגיל דרך אולמה, אך קצב יצירת הטקסט יהיה אטי משמעותית בהשוואה להרצה על כרטיס מסך מתאים.

איך מריצים

משקל המודל בגרסה המלאה תופס כחמישה עשר ג׳יגה בייט בזיכרון, כך שנדרש כרטיס מסך עם לפחות שישה עשר ג׳יגה בייט של זיכרון גרפי להרצה ישירה דרך הספרייה הרגילה. המפתחים מציעים גם גרסת קבצים דחוסה בפורמט GGUF, שמתאימה למי שרוצה להריץ מקומית על מעבד רגיל או על כרטיסים ביתיים חלשים יותר באמצעות כלים כמו אולמה או אל אם סטודיו.

אם כל מה שאתם צריכים זה בוט שיחה שנון או דמות חברתית שמייצרת פוסטים מדי פעם, הרצה מקומית על כרטיס בודד מספיקה לחלוטין. פנייה לשירותי ענן עם שרת ייעודי שווה את ההשקעה רק כשיש עומס פניות קבוע וצריך להחזיק זמני תגובה מהירים למשתמשים רבים במקביל.

from transformers import pipeline

pipe = pipeline("text-generation", model="SentientAGI/Dobby-Mini-Unhinged-Llama-3.1-8B")
print(pipe("שלום"))

הרישיון

השימוש במודל כפוף לרישיון הקהילתי של מטא עבור לאמה 3.1. הרישיון הזה מתיר שימוש מסחרי ומחקר באופן חופשי לרוב החברות, כל עוד מספר המשתמשים החודשיים של המוצר אינו עולה על שבע מאות מיליון, וכל עוד מקפידים על מדיניות השימוש המקובלת של מטא. אם המוצר עובר את הרף הזה, נדרש אישור ישיר ממטא כדי להמשיך להפיץ אותו.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗