GPT
D

dolphin-2_6-phi-2

קוד פתוח

dphnmit2023-12-23

  • transformers
  • pytorch
  • safetensors
  • phi-msft
  • text-generation

גרסה לא מצונזרת של פאי שתיים שמתאימה למי שצריך מודל קטן וצייתן בלי חסימות מובנות. הוא מיועד למפתחים שרוצים שליטה מלאה בתשובות בלי התחסדות של חברות ענק.

  • 2.8Bפרמטרים
  • 2,048טוקנים בהקשר
  • 10.4 GBמשקל הקבצים
  • 556הורדות בחודש

מה זה

הבסיס כאן הוא המודל הקומפקטי של מיקרוסופט, אבל אריק הרטפורד ופרננדו פרננדס אימנו אותו מחדש כדי להעיף החוצה את מנגנוני הסינון וההטיה המקוריים. בגרסה הזו הם הכניסו נתונים מפרויקט קפיברה והחזירו דאטה שמיועד לייצר אמפתיה בשיחה. האימון עצמו לקח יומיים על ארבעה כרטיסי מסך מסוג A100 באמצעות אקסולוטל, תוך שימוש בפורמט צ'אט אמ אל.

במדדי הביצועים הוא מגיע לממוצע של 61.7 בלוח המובילים הפתוח. הוא עומד יפה במשימות היגיון כמו הלאסוואג ווינוגרנדה עם ציון של סביב 75, אבל בבדיקת אמינות מול עובדות הוא משיג רק 47.39. זה אומר שהוא יודע לנתח ולעקוב אחרי הוראות, אבל נוטה להמציא דברים בביטחון מלא כשמאתגרים אותו בעובדות יבשות.

מתאים ל

  • סוכן שיחה אישי באנגלית

    אימון האמפתיה ופורמט השיחה מתאימים לצ'אט ישיר וקולח, כל עוד שומרים על שיחה קצרה שלא עוברת את מגבלת ההקשר.

  • ביצוע משימות ללא מעצורים

    ניתוח טקסטים או כתיבה של חומרים שמערכות סגורות חוסמות מיד, בזכות ביטול מנגנוני הסינון המובנים.

  • ניסויי קוד מקומיים

    מודל בסיסי קל להתקנה ואימון עצמי למפתחים שרוצים לבדוק התנהגות מודלים קטנים על גבי תשתית עצמאית.

איפה זה נופל

היוצרים מבהירים במפורש שהמודל הזה לא מצונזר בכלל. הוא יבצע כל בקשה שתתנו לו, כולל דברים לא אתיים, מסוכנים או שגויים, בלי שום שכבת הגנה פנימית. אסור לשים אותו מול משתמשי קצה בלי לבנות מעטפת סינון ואבטחה חיצונית משלכם. בנוסף, חלון ההקשר שלו נעצר באלפיים וארבעים ושמונה טוקנים בלבד, כך שהוא ייחנק בשיחות ארוכות או בניתוח מסמכים רציניים, והשפה היחידה שנתמכת בו רשמית היא אנגלית.

שאלות
נפוצות

המודל הזה עובד בעברית?

החומר מגדיר אותו באנגלית בלבד. הוא לא אומן על עברית ולא מיועד לייצר או להבין אותה באופן מסחרי.

אפשר להעלות אותו ישר כבוט לשירות לקוחות?

ממש לא. אין לו פילטרים והוא יענה על הכל בלי שיקול דעת, מה שיכול לחשוף אתכם לתשובות פוגעניות או מסוכנות מול לקוחות אמיתיים.

למה חובה לאשר קוד מרוחק בהרצה?

הארכיטקטורה של פאי שתיים דורשת הגדרת הרצת קוד ייעודית בטרנספורמרס, אחרת הספרייה פשוט לא תדע איך לטעון את השכבות של המודל.

איך מריצים

המודל שוקל מעל עשרה גיגהבייט בקבצי המקור שלו בדיוק של 16 ביט, מה שדורש כרטיס מסך עם לפחות 12 גיגהבייט זיכרון כדי לטעון אותו כמו שהוא. בספריית טרנספורמרס צריך להגדיר במפורש אישור להרצת קוד מרוחק בגלל הארכיטקטורה שלו.

בגלל המשקל, הרצה ישירה של הקבצים האלה במחשב רגיל בלי כרטיס מתאים תהיה כבדה ואיטית. אם אתם לא מחזיקים שרת ייעודי או מתכוונים לכווץ אותו בעצמכם לפורמטים קלים יותר, עדיף להשתמש במודל גדול יותר דרך שירות ענן חיצוני.

from transformers import pipeline

pipe = pipeline("text-generation", model="dphn/dolphin-2_6-phi-2")
print(pipe("שלום"))

הרישיון

המודל מופץ תחת רישיון MIT. זה רישיון מתירני שמאפשר לכם להשתמש בו לצרכים מסחריים, לשנות אותו, להטמיע אותו במוצרים שלכם ולעשות איתו כמעט הכל, כל עוד אתם שומרים על הודעת זכויות היוצרים המקורית. האחריות על התכנים שהוא מייצר היא כולה עליכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗