GPT
W

Wizard-Vicuna-13B-Uncensored-GPTQ

קוד פתוח

TheBlokeother2023-05-13

  • transformers
  • safetensors
  • llama
  • text-generation
  • uncensored

גרסת קוונטיזציה של מודל שיחה נטול מעצורים פנימיים. מתאים למי שחייב מודל מקומי שלא מסרב לפקודות או מחטיף הטפות מוסר.

  • 13Bפרמטרים
  • 2,048טוקנים בהקשר
  • 7.6 GBמשקל הקבצים
  • 237הורדות בחודש

מה זה

מדובר בהמרה של המודל שיצר אריק הרטפורד לפורמט GPTQ ב־4 ביט, שבוצעה על ידי TheBloke. הבסיס הוא שילוב של WizardLM ו־Vicuna, אך בניגוד למודלים רגילים, הוצאו ממאגר האימון שלו כל התשובות שכללו הטפות, הגבלות בטיחות או יישור קו מוסרי. המטרה היתה ליצור בסיס נקי לגמרי ממגבלות מלאכותיות, שעליו אפשר להלביש התאמות ייעודיות.

בגודל של 13 מיליארד פרמטרים, הוא תופס כ־8 גיגה בזיכרון ומגיב מהר על כרטיסי מסך בודדים. הפורמט הזה מאפשר להריץ אותו מקומית באמצעות AutoGPTQ או ExLlama בלי לאבד הרבה מאיכות התשובות בהשוואה למקור.

מתאים ל

  • מחקר ואימון ייעודי

    משמש כבסיס גולמי ונקי מצנזורה לבדיקת התנהגות מודלים והוספת שכבות יישור עצמאיות.

  • עוזר מקומי לא מסורס

    מענה ישיר לפקודות מורכבות ללא סירובים או הטפות מוסר שמופיעים במודלים מסחריים.

  • כתיבה יצירתית חופשית

    יצירת טקסטים בדיוניים בנושאים רגישים שמודלים רגילים נוטים לחסום מיד.

איפה זה נופל

היוצר מבהיר במפורש שאין פה שום מנגנוני הגנה או מעצורים, ולכן המודל עלול לייצר תוכן פוגעני או מסוכן בלי אזהרה. בנוסף, חלון ההקשר שלו קצר ועומד על 2,048 טוקנים בלבד, מה שמגביל מאוד ניתוח מסמכים ארוכים או שיחות ממושכות. אימון המקור באנגלית בלבד, כך שלא כדאי לבנות עליו לעיבוד שפה בעברית.

אותה משפחה

Wizard-Vicuna-13B-Uncensored יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזה כרטיס מסך צריך כדי להריץ אותו?

מספיק כרטיס מסך בודד עם 12 גיגה זיכרון גרפי, כמו RTX 3060 ומעלה. הקובץ שוקל כ־8.11 גיגה בגרסת 4 ביט ונכנס בקלות לזיכרון תחת ExLlama.

האם המודל יפעל טוב בעברית?

לא. המודל אומן על נתונים באנגלית בלבד. פקודות בעברית יובילו כנראה לג'יבריש או לתשובות שבורות לחלוטין.

איך מריצים

כדי להריץ אותו תצטרכו כרטיס מסך עם לפחות 10 עד 12 גיגה VRAM. ענף latest כולל Act Order שנותן דיוק עדיף באותו גודל קובץ של 8.11 גיגה, והוא נתמך היטב ב־ExLlama וב־Transformers דרך AutoGPTQ.

אם אתם עובדים עם text-generation-webui, ההתקנה דורשת רק הזנת שם המאגר והורדה ישירה. להרצה מקומית בתוך סביבת עבודה פרטית זה פתרון מצוין, אבל אם אתם צריכים רק שאילתות מזדמנות באנגלית כללית בלי בעיית צנזורה, עדיף לפנות ל־API חיצוני זמין ולחסוך תחזוקת שרת.

from transformers import pipeline

pipe = pipeline("text-generation", model="TheBloke/Wizard-Vicuna-13B-Uncensored-GPTQ")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־other ולכן תנאי השימוש המסחריים אינם מפורטים או ברורים. מודל הבסיס נשען על LLaMA ועל נתוני שיחה של Vicuna, מה שיוצר סיכון משפטי עבור מי שמתכנן להטמיע אותו במוצר מסחרי סגור.

הרישיון המלא בעמוד המודל ↗