GPT
W

Wizard-Vicuna-30B-Uncensored

קוד פתוח

QuixiAIother2023-05-30

  • transformers
  • pytorch
  • llama
  • text-generation
  • uncensored

גרסה נטולת סינון של מודל מבוסס לאמה עם שלושים מיליארד פרמטרים. היא מתאימה למי שרוצה בסיס נקי מהטפות מוסר מובנות כדי להלביש עליו יישור משלו.

  • 2,048טוקנים בהקשר
  • 121 GBמשקל הקבצים
  • 238הורדות בחודש
  • 163לייקים

מה זה

מדובר במודל שנוצר במטרה לספק בסיס אימון שלא כולל מעצורים מובנים או מנגנוני יישור מוסריים. היוצרים סיננו ממערך הנתונים תשובות שכללו הטפות או סירובים, מתוך רעיון לאפשר למפתחים להוסיף התאמות משלהם, למשל באמצעות שכבת לורה ייעודית, במקום להילחם בחסימות קיימות.

במדדי הביצועים הוא מציג תמונה מעורבת שמאפיינת את הדור שלו. במבחני הבנת שפה וידע כללי כמו הלאסוואג עם 83.45 נקודות או ווינוגרנד עם 78.45 הוא מפגין יציבות טובה ביצירת טקסט רציף, אבל בחישובים ובמתמטיקה הוא חלש מאוד, עם 14.25 בלבד במבחן ג'י אס אם שמונה קיי. זה אומר שהוא יודע לנסח דברים בצורה משכנעת, אבל לא כדאי להסתמך עליו לפתרון בעיות חישוביות או לוגיקה מורכבת.

מתאים ל

  • בסיס לאימון שכבות התאמה

    היעדר מנגנוני יישור מובנים מאפשר לאמן עליו שכבת לורה עצמאית בלי התנגשויות.

  • יצירת טקסט יצירתי ללא חסימות

    מתאים לכתיבה חופשית שבה מודלים רגילים מסרבים לפעול בגלל מילות מפתח רגישות.

  • מחקר על התנהגות מודלים

    מאפשר לבחון איך מודל גדול מגיב לשאילתות גולמיות כשהוא נקי ממסנני בטיחות.

איפה זה נופל

המודל מגיע ללא שום מנגנוני הגנה או סינון תוכן, והיוצרים משווים אותו לחפץ מסוכן כמו סכין או נשק. כל טקסט שהוא מייצר נחשב כאילו נכתב על ידכם, והוא עלול לפלוט תכנים פוגעניים בלי להסס. בנוסף, חלון ההקשר עומד על 2,048 טוקנים בלבד, מה שמגביל מאוד ניתוח מסמכים ארוכים, והתמיכה המדווחת היא באנגלית בלבד ללא שום התאמה לעברית.

שאלות
נפוצות

האם המודל יסרב לענות על שאלות מסוכנות או רגישות?

לא, הוא אומן במפורש על נתונים שמהם הוסרו תגובות סירוב והטפות מוסר. המודל יענה על מה שתבקשו ממנו, והאחריות המלאה על השימוש בפלט נופלת עליכם בלבד.

האם אפשר להריץ אותו על מחשב נייד או כרטיס מסך ביתי יחיד?

לא במצבו הנוכחי. הקבצים מגיעים בדיוק מלא ושוקלים 121 גיגה בייט, כך שצריך חומרת שרתים ייעודית עם זיכרון גרפי עצום רק בשביל להעלות אותו לזיכרון.

איך מריצים

כדי להריץ אותו ישירות בקבצי המקור צריך להיערך למשקל חריג. המודל שוקל 121 גיגה בייט בגלל שמירת המשקלים בדיוק של פלוט 32, מה שדורש מערך כרטיסי מסך חזק מאוד עם נפח זיכרון עצום של מעל 130 גיגה בייט רק כדי לטעון אותו.

אם אין לכם שרת ייעודי כזה בבית או בענן, מומלץ לחפש גרסאות מכווצות או קוונטיזציה של המשקלים, או לפנות למודלים שמוגשים דרך ממשק חיצוני. הרצה במצב הנוכחי כבדה מדי לרוב סביבות הפיתוח הרגילות.

from transformers import pipeline

pipe = pipeline("text-generation", model="QuixiAI/Wizard-Vicuna-30B-Uncensored")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כאחר וללא פירוט ברור. המשמעות היא שאין הרשאה מסחרית מפורשת, ואסור לשלב אותו במוצר עסקי בלי לברר קודם את תנאי הבסיס המקוריים של לאמה וויקוניה.

הרישיון המלא בעמוד המודל ↗