GPT
M

Meta-Llama-3-8B-Instruct-abliterated-v3

קוד פתוח

failspyllama32024-05-20

  • transformers
  • safetensors
  • llama
  • text-generation
  • conversational

גרסה מיוחדת של מודל שמונה מיליארד פרמטרים, שממנה נוטרל מנגנון הסירוב המובנה. הוא עונה על שאלות שגרסת המקור חוסמת מיד, בלי לעבור אימון מחדש.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 8,872הורדות בחודש

מה זה

הבסיס כאן הוא מודל השיחה המוכר של מטא, אבל המשקולות שלו עברו מניפולציה מתמטית ישירה. במקום לאמן את המודל מחדש על דאטה ייעודי כדי לעקוף את מנגנוני הבטיחות, היוצר זיהה את הכיוונים שמייצגים סירוב בתוך שכבות הרשת וביטל אותם. השיטה הזו שומרת על היכולות הכלליות ועל חלון של 8,192 טוקנים, בלי להרוס את חדות התשובות כמו שקורה לפעמים בכוונון רגיל.

גרסה שלוש מביאה שיפור בשיטה לעומת גרסה שתיים הקודמת של היוצר, ולפי הדיווח שלו היא מייצרת פחות הזיות. המודל מתנהג כמעט בדיוק כמו המקור בכל משימת טקסט, אבל מתעלם מההנחיות הפנימיות שמורות לו לסרב לבקשות שלכם.

מתאים ל

  • מחקר על מנגנוני בטיחות

    בדיקת ההשפעה של נטרול סירובים ברמת המשקולות על איכות הפלט וההזיות של המודל.

  • כתיבה יצירתית ללא חסימות

    יצירת תוכן חופשי ועלילות מורכבות שמודלים רגילים מסרבים לפתח בגלל מדיניות נוקשה.

  • איסוף נתונים לתרחישי קצה

    בניית סימולציות ומענה לשאלות בנושאים רגישים שהמקור סוגר מיד בלי לספק מידע.

איפה זה נופל

ההתערבות במשקולות לא מבטיחה שהמודל לעולם לא יסרב, והיוצר מבהיר שהוא עדיין עלול לסרב לבקשות מסוימות או להתחיל להטיף מוסר בתשובה. מעבר לזה, השיטה הזו חדשה לחלוטין ועלולה להכניס התנהגויות מוזרות ולא צפויות שהיוצר עצמו מבקש מהקהילה לדווח עליהן. אסור להכניס אותו למערכת מבצעית בלי לבדוק איך השינוי במשקלים השפיע על ההזיות במשימה הספציפית שלכם.

אותה משפחה

Meta-Llama-3-8B-Instruct-abliterated יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מבטיח לענות על כל שאלה בלי לסרב אף פעם?

לא. היוצר מציין במפורש שההסרה לא מוחלטת, והמודל עשוי עדיין להביע סירוב או לצרף הרצאה מוסרית בחלק מהמקרים. הוא פשוט נוטה הרבה פחות לחסום בקשות ביחס למקור.

במה הוא שונה מגרסאות לא מצונזרות אחרות?

הוא לא עבר אימון על נתונים חדשים, תהליך שלעיתים פוגע ביכולות הכלליות של המודל. במקום זה, היוצר השתמש בהסרה כירורגית של כיווני הסירוב מתוך המשקולות הקיימות.

איך מריצים

המשקלים תופסים 15 גיגה בייט בפורמט של 16 ביט, כך שצריך כרטיס מסך שמסוגל להחזיק את כל הנפח הזה בזיכרון שלו יחד עם הטוקנים שנוצרים בזמן הריצה. טוענים אותו ישירות דרך ספריית הטרנספורמרס ומריצים מקומית ללא תלות ברשת.

אם אין לכם כרטיס עם מספיק זיכרון ייעודי, תצטרכו להשתמש בגרסה שעברה הפחתת דיוק או לשכור שרת ענן לפי שעה. פנייה לשירות ענן חיצוני עדיפה אם אתם לא רוצים להחזיק חומרה דולקת בשביל כמה שאילתות ביום, אבל כל הרעיון במודל לא מצונזר הוא שליטה מלאה בשרת שלכם.

from transformers import pipeline

pipe = pipeline("text-generation", model="failspy/Meta-Llama-3-8B-Instruct-abliterated-v3")
print(pipe("שלום"))

הרישיון

הרישיון הוא רישיון מטא המקורי לגרסה שלוש. מותר להשתמש בו במוצרים מסחריים כל עוד עומדים בתנאי השימוש וההפצה המקוריים שהחברה הגדירה, למרות השינוי שבוצע במשקולות על ידי צד שלישי.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗