GPT
W

WizardLM-33B-V1.0-Uncensored

קוד פתוח

QuixiAIother2023-06-24

  • transformers
  • pytorch
  • llama
  • text-generation
  • en

גרסה נטולת עכבות ל־WizardLM בגודל 33 מיליארד פרמטרים, שמיועדת למי שרוצה תשובות ישירות בלי סירובים מובנים. הוא יענה על כמעט כל פרומפט שתזרקו עליו בלי להטיף מוסר.

  • 2,048טוקנים בהקשר
  • 60.6 GBמשקל הקבצים
  • 6,312הורדות בחודש
  • 59לייקים

מה זה

מדובר באימון מחדש של WizardLM-30B על דאטה שעבר סינון כדי להסיר מנגנוני סירוב, התחמקות והטיות. המפתח מציין ש־LLaMA המקורי כולל עקרונות מובנים ולכן אין מודל חופשי לחלוטין, אך הגרסה הזו צייתנית בהרבה מגרסאות קודמות כמו 7B, ועובדת עם פורמט הפרומפטים של Vicuna 1.1.

במבחני הביצועים הוא מציג תוצאות מעורבות. ב־HellaSwag הוא מגיע ל־83.84 וב־ARC ל־63.65, מה שמעיד על הבנת הקשר והיגיון בסיסי סביר, אבל במתמטיקה עם GSM8K של 18.65 ו־DROP של 20.89 הוא מתקשה מאוד, כך שחישובים מורכבים הם לא התחום שלו.

מתאים ל

  • מחקר על מודלים פתוחים

    בדיקת התנהגות מודל שפה שאומן במכוון ללא מנגנוני סירוב והטפה.

  • כתיבה חופשית באנגלית

    יצירת טקסטים יצירתיים בנושאים רגישים שמודלים רגילים נוטים לחסום מיד.

  • מענה ישיר ללא צנזורה

    קבלת תשובות ישירות לשאלות מורכבות בלי הרצאות מוסר מצד המודל.

איפה זה נופל

המודל מגיע ללא מעצורים והאחריות על הפלט היא כולה שלכם, בדיוק כמו שימוש בכל כלי מסוכן אחר. אין כאן מנגנוני בטיחות שימנעו פליטת תוכן רעיל או בעייתי, וחלון ההקשר מוגבל ל־2,048 טוקנים בלבד שזה קצר מאוד למשימות מודרניות. בנוסף, השפה הרשמית היא אנגלית בלבד ולפי תוצאות ה־GSM8K הוא חלש מאוד בפתרון בעיות חישוביות.

שאלות
נפוצות

האם המודל יסרב לענות על שאלות מסוימות?

הוא אומן במיוחד כדי לצמצם סירובים והתחמקויות, אך המפתח מציין שבבסיס של LLaMA ישנן הטיות מובנות. עם זאת, הוא צייתן משמעותית מגרסאות 7B הרגילות.

איזה פורמט פרומפט המודל דורש?

הוא מאומן לפי המבנה של Vicuna 1.1, כלומר הגדרת עוזר בהתחלה ואז מעבר בין תגיות USER ו־ASSISTANT בכל פניה.

איך מריצים

המשקל הכולל מגיע ל־60.6 גיגה בייט בפורמט float16, מה שאומר שכדי להריץ אותו כמו שהוא צריך לפחות שני כרטיסי מסך עם 40 גיגה זיכרון וידאו כל אחד, או קוונטיזציה כבדה כדי לדחוס אותו לחומרה ביתית.

אם אין לכם שרת ייעודי חזק או צורך מוחלט במודל מקומי שלא מסרב לפקודות, כנראה שעדיף להשתמש ב־API מסחרי. ההתעסקות עם 16 קבצים במשקל כזה לא שווה את הזמן עבור בדיקות קצרות.

from transformers import pipeline

pipe = pipeline("text-generation", model="QuixiAI/WizardLM-33B-V1.0-Uncensored")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־other ללא פירוט מדויק בכרטיס המודל. היות והוא מתבסס על LLaMA המקורי ועל WizardLM, סביר מאוד להניח שהוא אינו מיועד לשימוש מסחרי חופשי, ובלי תנאי רישוי ברורים מסוכן לשלב אותו במוצר שמייצר הכנסות.

הרישיון המלא בעמוד המודל ↗