GPT
D

dolphin-2.6-mistral-7b-dpo-laser

קוד פתוח

dphnapache-2.02024-01-01

  • transformers
  • safetensors
  • mistral
  • text-generation
  • conversational

גרסה לא מצונזרת של מיסטרל שמשלבת סינון רעשים מתמטי כדי לחזק ביצועים. מתאים למי שחייב מודל שמציית לכל הוראה בלי להטיף מוסר.

  • 7.2Bפרמטרים
  • 32,768טוקנים בהקשר
  • 13.5 GBמשקל הקבצים
  • 483הורדות בחודש

מה זה

מדובר בעיבוד של דולפין שמבוסס על מיסטרל שבעה מיליארד פרמטרים, שעבר אימון DPO ולאחר מכן ניקוי רעשים בשכבות בשיטת LASER ופירוק SVD. המפתחים השתמשו בחישובים מתמטיים של תורת המטריצות האקראיות כדי להוריד רעש מהמשקולות במקום לחפש ידנית, במטרה לשפר את איכות ההסקה.

במבחני הביצועים של הארנס הוא מציג עליות קלות לעומת גרסת הדי פי או הרגילה. הוא רושם שיפור קל במבחני הגיון ומתמטיקה כמו ג'י אס אם שמונה קיי עם 54.97 לעומת 53.83, וציון של 61.06 בטרוטפול קיו איי לעומת 60.8. בבחינת ידע כללי של MMLU יש דווקא ירידה זעירה משישים ואחת נקודה תשע לשישים ואחת נקודה שבעים ושבע, כך שעיקר השינוי מתבטא ביציבות הפלט ולא בקפיצת מדרגה קיצונית בידע.

המאפיין הבולט ביותר כאן הוא היעדר צנזורה. הדאטה סט נוקה מראש מכל שכבת תאימות או הטיה, מה שהופך אותו לצייתן במיוחד לכל פרומפט שתזינו, בלי מנגנוני סירוב מובנים.

מתאים ל

  • עוזר מקומי ללא הגבלות

    מתאים למי שצריך מודל שלא יסרב לפקודות שנויות במחלוקת או לפרומפטים ישירים.

  • אינטגרציה עם KoboldAI

    מבנה הטוקנים תואם למזהה סיום של המערכת ויכול לעבוד מולה ישירות.

  • ניסויי מחקר בשיטת LASER

    בדיקת השפעת הפחתת הרעש המתמטית על דיוק התשובות והיציבות שלהן.

איפה זה נופל

המודל מוגדר כלא מצונזר לחלוטין. הוא יענה על כל בקשה בלי סינון, כולל תוכן לא אתי, כך שאסור לחבר אותו ישירות למשתמשי קצה בלי לבנות שכבת הגנה וסינון משלכם בקוד. בנוסף, הוא אומן באנגלית בלבד. הנתונים מראים גם שההבדלים במבחנים לעומת הגרסה הרגילה קטנים מאוד, ובמבחן MMLU התוצאה שלו אפילו נמוכה יותר.

שאלות
נפוצות

האם המודל תומך בעברית?

המודל מוגדר ומאומן באנגלית בלבד. הוא עשוי לפלוט מילים בעברית עקב בסיס המידע של מיסטרל, אבל הוא לא מיועד לזה ולא נבדק בשפה הזו.

מה שונה בגרסת ה־Laser לעומת הגרסה הרגילה?

הגרסה הזו עברה תהליך מתמטי של ניקוי רעשים בשכבות על בסיס משפט מרצ'נקו פסטור. זה הוביל לעלייה קלה בחלק מהמבחנים כמו מתמטיקה, אבל ההבדלים במספרים יחסית צנועים.

איך מריצים

המשקלים תופסים 13.5 גיגה בייט בדיוק bfloat16 ומחולקים לשלושה עשר קבצים שרצים ישירות דרך ספריית transformers. כדי להריץ אותו בלי שום כימות צריך כרטיס מסך עם לפחות ששה עשר עד עשרים וארבעה גיגה בייט של זיכרון וידאו, בדיוק כמו הריצה של המפתחים שלקחה שלוש שעות על כרטיס אר טי אקס 4090.

אם אין לכם חומרה ייעודית מקומית, עדיף להשתמש בשרת ענן שכור לפי שעה או שירותי הרצה מנוהלים. המודל עובד במבנה שיחה של ChatML, וממפה את סיום ההודעה לטוקן שתיים כך שהוא מתאים ישירות לכלים שתלויים במזהה הזה כמו קובולד איי איי.

from transformers import pipeline

pipe = pipeline("text-generation", model="dphn/dolphin-2.6-mistral-7b-dpo-laser")
print(pipe("שלום"))

הרישיון

הרישיון הוא אפאצ'י שתיים אפס. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לארח אותו במוצר ולסגור את הקוד שלכם, בתנאי ששומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗