GPT
D

dolphin-2.9.1-llama-3-8b

קוד פתוח

dphnother2024-05-10

  • transformers
  • safetensors
  • llama
  • text-generation
  • generated_from_trainer

גרסה לא מצונזרת של לאמה 3 שמצייתת לכל הוראה בלי מעצורים. מתאימה למי שחייב מודל שלא מטיף מוסר או מסרב לבקשות ישירות.

  • 8Bפרמטרים
  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 9,046הורדות בחודש

מה זה

מדובר בכוונון מלא על כל שמונת מיליארד הפרמטרים של לאמה 3, שנבנה כדי לנקות את מנגנוני הסינון וההטיה של מטא. הגרסה הזו מתקנת בעיות מגרסת 2.9 הקודמת, שבה המודל נטה להישען יותר מדי על הנחיות המערכת ולייצר תשובות קצרות מדי, ולכן הסירו מאימון את הדאטה־סטים של סיסטם־צ'אט ואולטרה־צ'אט.

הוא מאומן בתבנית צ'אט־מל ומציע יכולות שיחה, כתיבת קוד, תמיכה בהפעלת פונקציות וצעדים ראשונים בהפעלת סוכנים עצמאיים. ההבדל המרכזי מול מודלים רגילים בגודל הזה הוא הצייתנות המוחלטת, שנובעת גם מדאטה שנוצר בעזרת מודלים כמו ג'יפיטי 4.

מתאים ל

  • סוכנים ואוטומציות קוד

    תומך בהפעלת פונקציות ולא נחסם כשהקוד נוגע בתחומים רגישים כמו בדיקות חדירות.

  • כתיבה יוצרת ללא מגבלות

    מייצר עלילות ותכנים ישירים בלי לסרב לתרחישי קונפליקט או לנושאים בוגרים.

  • מחקר וניתוח נתונים גולמיים

    מאפשר לעבד ולסווג טקסטים קשים בלי שהמודל יסרב לנתח את המידע.

איפה זה נופל

החיסרון הבולט הוא היעדר כל מנגנון בטיחות. המודל יענה על הכל, כולל בקשות שאינן אתיות או מזיקות, ולכן לא מתאים לפריסה ישירה מול משתמשי קצה בלי שכבת סינון עצמאית שתוסיפו בעצמכם. בנוסף, אף על פי שלמודל הבסיס יש הקשר של שמונת אלפים טוקנים, האימון עצמו הוגבל לארבעת אלפים בלבד, מה שעלול לפגוע באיכות כשהקלט ארוך במיוחד.

אותה משפחה

dolphin-2.9.1-llama-3 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יסרב לפקודות מסוימות?

לא. מפתחיו הסירו את שכבות הסינון במכוון, והוא מתוכנן לציית לכל הוראה. האחריות על אופי התוכן שנוצר מוטלת כולה על מי שמריץ אותו.

איזה פורמט הנחיה צריך להגדיר לו?

הוא אומן על מבנה צ'אט־מל סטנדרטי. כדי לקבל תוצאות טובות צריך לעטוף את השיחה בתגיות של מערכת, משתמש ועוזר בהתאם לפורמט.

איך מריצים

כדי להריץ את קבצי המקור המלאים בפורמט bfloat16 תצטרכו כרטיס מסך עם לפחות עשרים וארבעה גיגה־בייט זיכרון, כמו ארבעים ותשעים או כרטיס שרת מקביל. הקבצים שוקלים חמישה עשר גיגה, כך שעל חומרה צנועה יותר תצטרכו לחפש קוונטיזציה או להריץ על מעבד עם הרבה זיכרון ראם.

אם אתם לא צריכים דווקא את האופי הלא מצונזר שלו, אין סיבה להחזיק שרת ייעודי בשבילו. במקרים של עומס משתנה עדיף להשתמש במודל מגודר דרך ממשק ענן מוכן ולחסוך את עלויות החומרה.

from transformers import pipeline

pipe = pipeline("text-generation", model="dphn/dolphin-2.9.1-llama-3-8b")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כמותאם אישית וכפוף לרישיון הקהילתי של מטא ללאמה 3. היוצרים מאשרים שימוש מסחרי כל עוד הוא עומד בתנאים של מטא, אך צריך לזכור שהמודל אומן בין היתר על נתונים סינתטיים מתוצרי ג'יפיטי 4.

הרישיון המלא בעמוד המודל ↗