GPT
N

Nemotron-4-340B-Base

קוד פתוח

nvidiaother2024-06-14

  • nemo
  • nvidia

nvidia עומדים גם מאחורי NVIDIA AI, ויש עליו סקירה כאן.

בסיס ענק שנועד בעיקר לייצור דאטה סינתטי לאימון מודלים אחרים. הוא מכיל 340 מיליארד פרמטרים ואומן על תשעה טריליון טוקנים כדי לספק השלמות טקסט וקוד ברמה גבוהה.

  • 215 GBמשקל הקבצים
  • 510הורדות בחודש
  • 150לייקים

מה זה

מדובר במודל השלמת טקסט עצום ממדים שלא עבר התאמה לשיחה. הוא אומן על טקסטים באנגלית, מעל 50 שפות נוספות ויותר מ־40 שפות תכנות, כשהמטרה המרכזית שלו היא לשמש מנוע שמייצר נתוני אימון איכותיים לחוקרים שרוצים לבנות מודלים משלהם. שלב האימון כלל שמונה טריליון טוקנים ראשוניים ועוד טריליון טוקנים של אימון המשך שבו שינו את הרכב הנתונים כדי לשפר את הביצועים.

במבחני הבנצ'מרק הוא מציג יכולות חזקות מאוד בהבנת שפה וידע כללי עם ציון של 81.1 ב־MMLU ו־94.28 ב־ARC Challenge. יחד עם זאת, ביצועי כתיבת הקוד שלו עומדים על 57.3 בלבד ב־HumanEval באפס דוגמאות, מה שמראה שבלי כוונון ייעודי הוא פחות מתאים כמפתח אוטונומי ויותר כבסיס רחב ללמידה.

מתאים ל

  • ייצור דאטה סינתטי

    יצירת מאגרי נתונים איכותיים ומגוונים לאימון מודלים קטנים יותר בארגון.

  • אימון מודלים ייעודיים

    בסיס לכוונון עדין עם NeMo למשימות שדורשות ידע מתמטי, משפטי ומדעי.

  • השלמת קוד רב-לשונית

    הפקת קטעי קוד בתוך סביבות פיתוח שתומכות ביותר מ־40 שפות תכנות שונות.

איפה זה נופל

זהו מודל בסיס נקי שלא עבר תהליכי יישור בטיחותיים כמו RLHF או הנחיות שיחה, ולכן הוא נוטה לפלוט הטיות, תוכן פוגעני או תשובות רעילות שנאספו מהרשת. הכרטיס מזהיר במפורש מפני חוסר דיוקים, השמטת עובדות מהותיות ופליטת טקסט מיותר, גם אם הפרומפט לא כלל שום דבר בעייתי. בנוסף, חלון ההקשר שלו מוגבל ל־4,096 טוקנים בלבד ונתוני האימון שלו נעצרו ביוני 2023.

אותה משפחה

Nemotron-4 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

אפשר להשתמש בו ישירות כצ'אטבוט לשירות לקוחות?

לא. זהו מודל בסיס להשלמת טקסט שלא עבר כוונון לשיחה או סינון בטיחותי, ולכן הוא לא מתאים לאינטראקציה ישירה עם משתמשי קצה בלי תהליך התאמה והגנה מקדים.

האם כרטיס RTX 4090 יחיד יכול להריץ אותו?

ממש לא. המודל דורש מינימום של 16 כרטיסי A100 או שמונה כרטיסי H200 רק כדי לבצע הסקה בסיסית, כך שחומרה ביתית כלל אינה רלוונטית כאן.

איך מריצים

הסיוט האמיתי כאן הוא הברזלים. להסקה בסיסית בפורמט BF16 תצטרכו שרת שלם עם שמונה כרטיסי H200, או שני שרתים שמכילים יחד 16 כרטיסי H100 או 16 כרטיסי A100 של 80 גיגה. המודל שוקל 215 גיגה ומגיע ב־983 קבצים נפרדים, כשהתקשורת וההרצה נשענות על כלי NeMo ודורשות פריסה מבוזרת עם Slurm על גבי קונטיינר ייעודי.

אם אין לכם קלאסטר ארגוני זמין ותקציב חומרה כבד, אין שום היגיון לנסות להריץ אותו עצמאית. כל עוד המטרה שלכם היא רק להתנסות או לייצר דאטה בהיקף נקודתי, קריאה לשירות מנוהל או API חיצוני תחסוך לכם כאב ראש תשתיתי עצום.

pip install -U huggingface_hub
hf download nvidia/Nemotron-4-340B-Base

הקבצים

983 קבצים במאגר, 215 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הוא מופץ תחת רישיון NVIDIA Open Model שמתיר שימוש מסחרי מלא. אתם רשאים ליצור מודלים נגזרים ולהפיץ אותם, ואנבידיה אינה דורשת בעלות על הפלטים שהמודל מייצר. עם זאת, השימוש כפוף לקריאת תנאי ההסכם הייעודיים של החברה.

הרישיון המלא בעמוד המודל ↗