GPT
R

replit-code-v1_5-3b

קוד פתוח

replitapache-2.02023-10-09

  • transformers
  • pytorch
  • mpt
  • text-generation
  • code

יש כאן גם סקירה על Replit עצמו.

מודל השלמת קוד קומפקטי של 3.3 מיליארד פרמטרים שרץ בקלות מקומית. הוא אומן על 30 שפות תכנות ומיועד למי שרוצה בסיס קל משקל להתאמה אישית.

  • 4,096טוקנים בהקשר
  • 6.2 GBמשקל הקבצים
  • 172הורדות בחודש
  • 316לייקים

מה זה

מדובר במודל שפותח בידי Replit ומכוון למטרה אחת בלבד, השלמת קוד. הוא אומן בדיוק bfloat16 על טריליון טוקנים שחולקו מתוך מאגר של כמאתיים מיליארד טוקנים לאורך חמישה מחזורים. המאגר כלל קוד ברישיונות מתירניים מתוך Stack Dedup לצד תיעוד ושאלות מ־StackExchange, ומכסה 30 שפות, החל מפייתון, ג'אווה ו־C ועד שפות פחות שכיחות כמו זיג, ראסט וסולידיטי.

הוא בנוי על ארכיטקטורת MPT עם חלון הקשר של 4,096 טוקנים, ומשתמש במילון מותאם של כ־32 אלף טוקנים שנועד לדחוס קוד ביעילות. המודל שוקל כ־6.2 גיגה בייט בלבד, מה שהופך אותו לאופציה מהירה לפיתוח מקומי או להטמעה בענן זול בלי לדרוש מפלצות חומרה.

מתאים ל

  • השלמת שורות קוד מקומית

    אידיאלי להרצה על כרטיס מסך פשוט בתוך עורך קוד, בזכות המיקוד בהשלמה ומשקל של 6.2 גיגה.

  • בסיס לאימון ייעודי בחברה

    נועד לשמש כמודל בסיס שניתן לאמן הלאה על מאגר הקוד הפנימי של הארגון בלי מגבלות מסחריות.

  • סריקה ויצירת תבניות קוד

    יעיל להפקת פונקציות קצרות בשפות מגוונות מתוך 30 השפות שנתמכות במאגר האימון שלו.

איפה זה נופל

זה אינו מודל שיחה ואי אפשר לנהל איתו דיאלוג בסגנון צ'אט, הוא יודע רק להמשיך רצף של טקסט וקוד. Replit מצהירים מפורשות שמאגר האימון עשוי להכיל תוכן פוגעני או לא הולם למרות הסינון, ודברים כאלה עלולים לצוץ בפלט. בנוסף, חלון של 4,096 טוקנים מציב גבול ברור, כך שאי אפשר להזין לו קבצים ענקיים או הקשר רחב של פרויקט שלם.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה כעוזר צ'אט לתכנות?

לא, הוא לא אומן למעקב אחרי הוראות או לשיחה. הוא מקבל קוד ומנחש את ההמשך שלו, כך שאם תשאלו אותו שאלות תקבלו המשך טקסטואלי של השאלה ולא מענה מובנה.

איזה כרטיס מסך מינימלי צריך כדי להריץ אותו?

המודל שוקל כ־6.2 גיגה בייט בפורמט bfloat16, ולכן כרטיס עם 8 גיגה זיכרון וידאו יספיק בקושי, אך כרטיס עם 12 גיגה ומעלה יאפשר עבודה חלקה יחד עם הקשר של אלפי טוקנים.

איך מריצים

כדי להריץ אותו צריך התקנה עדכנית של transformers, torch ו־einops, יחד עם הפעלת trust_remote_code בזמן הטעינה של המודל והטוקנייזר. בגלל שמדובר ב־6.2 גיגה בייט בדיוק המקורי, כרטיס מסך בודד עם 8 עד 12 גיגה זיכרון יספיק כדי להריץ היקשים בצורה סבירה.

אם אתם צריכים רק השלמות קוד פשוטות מקומית או כחלק מתוסף לפיתוח פנימי, ההרצה העצמית הגיונית וזולה. מנגד, אם המטרה היא להבין פרויקטים שלמים או לקבל מענה לצ'אט מורכב, עדיף להשתמש במודלים גדולים יותר דרך API ולא לבזבז זמן על תחזוקת תשתית עבור מודל ממוקד כל כך.

from transformers import pipeline

pipe = pipeline("text-generation", model="replit/replit-code-v1_5-3b")
print(pipe("שלום"))

הרישיון

הרישיון הוא apache-2.0, מה שאומר שמותר להשתמש בו לצרכים מסחריים בלי תשלום תמלוגים. אתם יכולים לשנות אותו, לאמן אותו מחדש, ולשלב אותו במוצרים פנימיים או חיצוניים, כל עוד שומרים על הודעת הרישיון וזכויות היוצרים המקוריות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗