GPT
D

deepseek-math-7b-rl

קוד פתוח

deepseek-aiother2024-02-05

  • transformers
  • pytorch
  • safetensors
  • llama
  • text-generation

גרסת חיזוק עם 7 מיליארד פרמטרים שמיועדת כולה לפיצוח בעיות מתמטיות. היא נבנתה במיוחד להסקת מסקנות שלב אחר שלב עם שרשרת חשיבה מובנית.

  • 6.9Bפרמטרים
  • 4,096טוקנים בהקשר
  • 27.6 GBמשקל הקבצים
  • 1,451הורדות בחודש

מה זה

מדובר במודל שפת LlamaForCausalLM עם 6.9 מיליארד פרמטרים, שעבר אימון ייעודי בלמידת חיזוק כדי להתמודד עם אתגרים חישוביים ולוגיים. במקום לנסות לדעת הכל קצת כמו רוב המודלים בגודל הזה, הוא מתרכז כולו במתמטיקה ובהסבר מפורט של הפתרון מההתחלה ועד התוצאה הסופית.

הוא מתוכנן לעבוד עם הנחיות באנגלית ובסינית ומחייב סגנון עבודה של פירוק תהליך המחשבה. כדי להוציא ממנו תשובות נכונות, צריך לדרוש ממנו לפתור בהדרגה ולתחום את התשובה הסופית, מה שהופך אותו לכלי ממוקד מאוד למשימות חישוב ולא לעוזר שיחה כללי.

מתאים ל

  • פתרון תרגילים שלב אחר שלב

    הוא אומן בלמידת חיזוק כדי לפרק בעיות הנדסיות ומדעיות להסבר ברור ומסודר.

  • אימות תשובות חישוביות

    ההנחיה הייעודית לתחימת התוצאה מאפשרת לחלץ ממנו תשובה סופית מדויקת בבדיקות אוטומטיות.

  • מנוע עזר ללמידה עצמית

    יכול לעזור בהסבר של פתרונות מתמטיים באנגלית כשצריך לראות את כל דרך הפתרון.

איפה זה נופל

הוא מוגבל לחלון הקשר קצר של 4,096 טוקנים, מה שלא מאפשר להזין לו מסמכים עמוסים או היסטוריית שיחה ארוכה. מעבר לזה, המודל רגיש מאוד לצורת הפנייה. אם לא תוסיפו את ההנחיה המפורשת לחשוב צעד אחר צעד ולשים את התוצאה בתוך תיבה מוגדרת, הביצועים שלו יורדים משמעותית. הוא גם מוגבל מאוד בתמיכה בשפות מעבר לאנגלית ולסינית.

אותה משפחה

deepseek-math יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

אפשר להשתמש בו לשיחה רגילה ולכתיבת טקסטים כלליים?

לא מומלץ בכלל. הוא אומן באופן ממוקד מאוד על מתמטיקה ופתרון בעיות, ובלי הפורמט הקשיח של שרשרת חשיבה הוא פשוט לא מתפקד טוב כמו מודלים כלליים אחרים.

למה התשובות שלו יוצאות מוזרות כשאני מוסיף system prompt?

היוצרים ציינו מפורשות שהגרסה הזו לא תואמת להוראות מערכת. צריך להעביר רק את שאלת המשתמש יחד עם ההנחיה המובנית לפירוט הפתרון.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־27.6 גיגה-בייט בפורמט bfloat16, כך שתצטרכו כרטיס מסך עם לפחות 16 עד 24 גיגה זיכרון כדי לטעון ולהריץ אותו מקומית בצורה סבירה. הוא עובד ישירות מול ספריית transformers הרגילה בפייתון.

צריך לשים לב לפרומפט כשמריצים אותו. היוצרים מדגישים לא להשתמש ב־system prompt כי הוא לא נתמך טוב בגרסה הזו, ולבנות את הטמפלייט של השיחה באופן ידני בלי להסתמך על הפונקציה המובנית.

from transformers import pipeline

pipe = pipeline("text-generation", model="deepseek-ai/deepseek-math-7b-rl")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר תחת סיווג מותאם אישית של החברה ולא כרישיון קוד פתוח סטנדרטי, אבל הכרטיס מציין במפורש שהשימוש במודל פתוח גם לצרכים מסחריים. הקוד עצמו מופץ תחת רישיון MIT, אך המשקלים כפופים להסכם נפרד. מי שמתכנן להטמיע אותו במוצר מסחרי צריך לקרוא את קובץ התנאים המלא של החברה כדי לוודא שאין שם הגבלות ספציפיות על אופי ההפצה.

הרישיון המלא בעמוד המודל ↗