GPT
C

CodeLlama-7b-Instruct-hf

קוד פתוח

codellamallama22023-08-24

  • transformers
  • pytorch
  • safetensors
  • llama
  • text-generation

גרסת שיחות והנחיות לכתיבת קוד עם 6.7 מיליארד פרמטרים. היא מתאימה למי שרוצה עוזר פיתוח מקומי שמבין הוראות ישירות בלי להחזיק שרתים ענקיים.

  • 6.7Bפרמטרים
  • 16,384טוקנים בהקשר
  • 25.1 GBמשקל הקבצים
  • 49,177הורדות בחודש

מה זה

המודל פותח על ידי מטא ואומן בין ינואר ליולי 2023 על בסיס נתוני Llama 2. מדובר בגרסת ה־Instruct, כלומר כזו שעברה התאמה מיוחדת להבנת הנחיות טקסטואליות, מענה בשיחה והשלמת קוד בטוחה יחסית, להבדיל מגרסת הבסיס שרק מנחשת את הרצף הבא. הוא מתמודד עם סינתזת קוד, הבנה ומילוי מקטעים חסרים.

עם חלון הקשר של 16,384 טוקנים, אפשר להזין לו קבצי קוד שלמים, ספריות קטנות או תיעוד רחב בלי לחתוך אותם לחתיכות קטנות. זה יתרון מורגש מול מודלים ישנים יותר שנחנקו אחרי אלפיים טוקנים. הגרסה הזו היא מודל כללי לשפות תכנות שונות, בשונה מגרסת הפייתון הייעודית מאותה משפחה.

מתאים ל

  • השלמת קוד והוראות

    כתיבת פונקציות וקוד מאפס לפי הנחיות באנגלית, בזכות כוונון ה־Instruct.

  • השלמת מקטעים פנימיים

    השלמת קוד חסר באמצע קובץ קיים באמצעות יכולת ה־Infilling של המודל.

  • עוזר שיחה למפתחים

    מענה על שאלות טכניות ופתרון בעיות בארכיטקטורה לפי הקשר של עד 16,384 טוקנים.

איפה זה נופל

הכרטיס מציין במפורש שהבדיקות נעשו באנגלית בלבד, ושימוש בשפות אחרות מוגדר מחוץ לטווח השימוש המיועד. מפתחים בעברית יגלו מהר מאוד שהמודל לא מיועד להוראות בשפה הזו. בנוסף, זהו מודל סטטי שאומן על מידע עד יולי 2023, ולכן הוא לא מכיר עדכוני ספריות מהזמן האחרון ומסוגל לייצר פלט שגוי או לא מדויק שדורש בדיקה קפדנית.

אותה משפחה

CodeLlama יצא ב־8 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המאגר הזה הוא המאגר הרשמי של מטא?

לא. כרטיס המודל מבהיר שמדובר במאגר לא רשמי, והגרסה הרשמית של מטא יושבת בארגון שלהם ב־Hugging Face.

האם המודל מתמחה בפייתון?

לא, הגרסה הזו מיועדת לקוד כללי ולהבנת הוראות. למטא יש גרסה נפרדת בשם Code Llama Python שמיועדת ספציפית לשפה הזו.

איך מריצים

כדי להריץ אותו צריך להתקין את ספריות transformers ו־accelerate של פייתון. קבצי המשקלים תופסים 25.1 גיגה בייט בפורמט bfloat16 על פני 17 קבצים, כך שצריך כרטיס גרפי עם זיכרון ייעודי שמסוגל לטעון את כל המשקל הזה לפני שמחשבים את הקשר השיחה.

אם אין לכם כרטיס מסך מתאים עם מספיק זיכרון וידאו, המודל פשוט יזחל על המעבד או יקרוס מחוסר זיכרון. במצב כזה עדיף לצרוך אותו דרך שירות ענן או API מוכן במקום להסתבך עם התשתית המקומית.

from transformers import pipeline

pipe = pipeline("text-generation", model="codellama/CodeLlama-7b-Instruct-hf")
print(pipe("שלום"))

הרישיון

השימוש כפוף לרישיון המסחרי המותאם של llama2 מבית מטא. הרישיון מאפשר שימוש מסחרי ומחקרי, אבל מחייב עמידה במדיניות השימוש המקובל שלהם ומגדיר תנאים להפצה במוצרים.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗