GPT
C

CodeLlama-7b-Python-hf

קוד פתוח

codellamallama22023-08-24

  • transformers
  • pytorch
  • safetensors
  • llama
  • text-generation

גרסה ייעודית לכתיבת פייתון בגודל 6.7 מיליארד פרמטרים. היא מתאימה למי שרוצה השלמת קוד מקומית ויציבה בלי לשלוח סקריפטים לשרתים חיצוניים.

  • 6.7Bפרמטרים
  • 16,384טוקנים בהקשר
  • 25.1 GBמשקל הקבצים
  • 1,758הורדות בחודש

מה זה

מדובר במודל שפותח על בסיס לאמה 2 ועבר אימון ייעודי על קוד פייתון. הוא מיועד בעיקר למשימה אחת ברורה, השלמת קוד. בניגוד לגרסת הבסיס הכללית של המשפחה, כאן הדגש הוא על תחביר, ספריות ומבנים של פייתון בלבד, כך שהוא לא מתפזר על שפות תכנות אחרות.

המודל הזה אינו גרסת שיחה. אין כאן מנגנון של מענה להוראות טקסטואליות כמו בצ'אט, ואין יכולת מובנית להשלמת קוד באמצע קובץ, מה שמוכר כאינפילינג. הוא מקבל קוד קיים וממשיך אותו הלאה, נקודה. חלון ההקשר עומד על 16,384 טוקנים, מה שמאפשר לו לקרוא קבצים ארוכים למדי ולהבין את התלויות לפני שהוא מייצר את השורה הבאה.

מתאים ל

  • השלמת קוד פייתון בעורך

    הוא מיועד להמשך טבעי של פונקציות וסקריפטים שנכתבים בפייתון ישירות בסביבת הפיתוח.

  • פיתוח בסביבה מבודדת

    מתאים לשרתים פנימיים בארגונים שאוסרים על הוצאת קוד מקור לשירותי ענן חיצוניים.

  • ייצור אוטומטי של בדיקות

    יכול לייצר בלוקים של קוד המשך לבדיקות יחידה מתוך הגדרות קיימות בקובץ.

איפה זה נופל

הכרטיס מדגיש בפירוש שהמודל לא תומך בהוראות שיחה ולא יודע לבצע השלמה באמצע טקסט, אלא רק להמשיך קוד קדימה. בנוסף, הוא אומן רק על אנגלית וקוד, כך שכל ניסיון לעבוד איתו בעברית או לבקש הסברים בשפה טבעית ייכשל לחלוטין. הוא סטטי לחלוטין, אומן בין ינואר ליולי 2023, ולא מכיר חבילות חדשות או עדכוני גרסאות שיצאו מאז.

שאלות
נפוצות

האם אפשר לבקש ממנו בעברית לכתוב לי פונקציה?

לא. המודל הזה אומן על אנגלית בלבד ואין לו מנגנון של הבנת הוראות. הוא לא יודע לענות לשאלות, אלא רק להמשיך קוד קיים שתזינו לו ישירות.

האם הוא יודע להשלים קטע חסר באמצע פונקציה?

לא, הכרטיס מציין במפורש שיכולת אינפילינג כבויה בגרסה הזו. המודל מייצר טקסט רק קדימה, מסוף הקלט שסיפקתם ועד לסיום הבלוק.

מה ההבדל בינו לבין גרסת האינסטראקט?

גרסת האינסטראקט עברה כיוונון עדין למענה להוראות ושיחה עם מפתח. הגרסה הזו מיועדת רק להשלמת סינטקס רציפה של שפת פייתון מתוך טקסט קיים.

איך מריצים

כדי להריץ אותו צריך כרטיס מסך עם זיכרון שמחזיק קבצים במשקל כולל של כעשרים וחמישה גיגה בייט בדיוק המקורי, כלומר לפחות עשרים וארבעה גיגה בייט של זיכרון גרפי, או שימוש בקוונטיזציה לחומרה ביתית. מריצים אותו ישירות דרך ספריית טרנספורמרס ואקסלרייט עם פייתון.

אם אתם לא צריכים פרטיות מלאה או שאין לכם שרת ייעודי, עדיף להשתמש בפתרון ענן מרוחק. החזקת שרת מקומי בשביל השלמת שורות קוד בודדות דורשת משאבים שלא תמיד מצדיקים את עצמם לעומת קריאה מהירה לרשת.

from transformers import pipeline

pipe = pipeline("text-generation", model="codellama/CodeLlama-7b-Python-hf")
print(pipe("שלום"))

הרישיון

הרישיון הוא רישיון לאמה 2 של מטא, שמאפשר שימוש מסחרי ומחקרי בכפוף למדיניות השימוש שלהם. אפשר לשלב אותו במוצרים, אך יש לעמוד במגבלות הרישיון הרשמי של מטא, כולל תנאי השימוש ההוגן והמגבלות על כמות המשתמשים החודשית שהחברה מגדירה.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗