GPT
D

dolphin-2.2.1-mistral-7b

קוד פתוח

dphnapache-2.02023-10-30

  • transformers
  • pytorch
  • safetensors
  • mistral
  • text-generation

גרסה מכווננת של מיסטרל שמסירה לחלוטין את מגבלות הצנזורה המקוריות. מתאים למי שחייב מודל שיענה על כל בקשה בלי סירובים מובנים, עם דגש על שיחה רב שלבית ואמפתיה.

  • 7.2Bפרמטרים
  • 32,768טוקנים בהקשר
  • 27.0 GBמשקל הקבצים
  • 627הורדות בחודש

מה זה

המודל מבוסס על Mistral 7b ועבר אימון על שילוב של כמה מאגרי מידע, כולל יישום פתוח של Orca, דאטה־סט של Samantha לשיחות אישיות ורגישות, וקטעים מתוך Airoboros ו־WizardLM. המטרה של המהדורה הספציפית הזו, 2.2.1, היא תיקון של אימון יתר מהגרסה הקודמת, שבה המודל נטה לייצר שרשראות חשיבה ארוכות גם כשלא התבקש והסכים לפקודות חסרות היגיון.

בגזרה הטכנית הוא מחזיק חלון הקשר רחב של 32,768 טוקנים ומשתמש בפורמט ChatML. בניגוד לרוב המודלים בגודל 7B שמוגבלים על ידי שכבות יישור נוקשות של החברות הגדולות, המפתח סינן כאן בכוונה את מנגנוני הבטיחות כדי לקבל ציות מקסימלי והתנהגות טבעית יותר בשיחה מתמשכת.

מתאים ל

  • בוט שיחה ואמפתיה

    מאגר Samantha מעניק לו אופי שיחתי קשוב ועמוק בהרבה מרוב המודלים הקטנים.

  • מחקר ללא מסנני בטיחות

    מאפשר לבחון שאילתות וטקסטים שמודלים מסחריים רגילים מסרבים לגעת בהם מראש.

  • ניתוח הקשרים ארוכים

    תמיכה בעד 32 אלף טוקנים מאפשרת לעבד שיחות מתמשכות ומסמכים מרובי עמודים.

איפה זה נופל

החיסרון הגדול ביותר נובע ישירות מהתכונה המרכזית שלו, הוא לא מצונזר כלל. היוצר מבהיר שהמודל ייענה לכל בקשה, כולל בקשות לא מוסריות, ולכן חובה לבנות שכבת בדיקות וסינון עצמאית לפני שפותחים אותו למשתמשי קצה.

בנוסף, האימון נעשה באנגלית בלבד. אל תצפו לביצועים סבירים בעברית, לא ברמת ההבנה הדקה ולא באיכות התחביר. מדובר במודל 7B, כך שגם עם שיפורי האימון יש לו נטייה להזיות תחת לוגיקה מורכבת.

שאלות
נפוצות

האם המודל מתאים ליישום שפונה ישירות ללקוחות?

לא מומלץ לחבר אותו ישירות למשתמשי קצה בלי מנגנון סינון חיצוני. היעדר הצנזורה גורם לו לענות גם על פרומפטים זדוניים או פוגעניים בלי היסוס.

איך הוא מתמודד עם עברית?

הכרטיס מגדיר אנגלית כשפה יחידה. הוא מסוגל לקלוט מילים בודדות בזכות ארכיטקטורת הבסיס של מיסטרל, אבל הפלט בעברית יהיה שבור ולא שמיש למוצר אמיתי.

איך מריצים

המשקל המלא של הקבצים מגיע ל־27 גיגה־בייט בדיוק של bfloat16, כך שתצטרכו כרטיס מסך עם לפחות 16 עד 24 גיגה זיכרון כדי לטעון אותו כמו שהוא דרך transformers. מי שרוצה להריץ אותו מקומית על חומרה צנועה יותר יצטרך לחפש גרסאות מכווצות בקוונטיזציה.

אם אתם לא מחזיקים שרת GPU זמין ורוצים לבדוק אותו מהר, עדיף להרים מופע ענן לפי שעה או להשתמש בנקודת קצה קיימת שמארחת אותו. ההרצה דורשת שימוש קפדני בתבנית ה־ChatML המוגדרת, אחרת התוצאות מאבדות עקביות.

from transformers import pipeline

pipe = pipeline("text-generation", model="dphn/dolphin-2.2.1-mistral-7b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים בלי תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים המקורית ותנאי הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗