GPT
Z

zeta-2.1

קוד פתוח

zed-industriesapache-2.02026-05-07

  • transformers
  • safetensors
  • llama
  • text-generation
  • text-generation-inference

מודל עריכת קוד ממוקד שמנחש את השינוי הבא לפי היסטוריית העריכות ומיקום הסמן. מתאים למי שבונה השלמות קוד חכמות ישירות לתוך העורך במקום צ'אט גנרי.

  • 8.3Bפרמטרים
  • 32,768טוקנים בהקשר
  • 15.4 GBמשקל הקבצים
  • 18,565הורדות בחודש

מה זה

מדובר במודל שנועד למשימה אחת ברורה, חיזוי השינוי הבא בקוד סביב הסמן של המפתח. הוא אומן על בסיס Seed Coder 8B ועבר התאמה על ידי הצוות של עורך הקוד Zed כדי לשכתב מקטעים שלמים, כשהוא מסתמך על מבנה פרומפט שמחלק את הקלט לסיומת, קידומת, תוכן אמצעי והיסטוריית עריכות בפורמט diff.

רוב מודלי השלמת הקוד פשוט מנחשים את הטקסט שממשיך את הסמן קדימה. המודל הזה מתבסס על תחביר שמסמן אזורי עריכה ממוספרים, קורא קבצים קשורים והיסטוריה, ומחזיר שכתוב של המקטע הרלוונטי בלבד. אין כאן נתוני מדידה או בנצ'מרקים בכרטיס, כך שאי אפשר לדעת בדיוק כמה הוא מדויק ביחס לאחרים בלי לבדוק אותו על הפרויקט שלכם.

מתאים ל

  • השלמת עריכות בעורך קוד

    חיזוי ושכתוב של מקטע הקוד הנוכחי לפי השינויים האחרונים שביצעתם בקובץ.

  • שילוב שינויים מקבצים קשורים

    התאמת פונקציה בקובץ אחד בעקבות שינוי בממשק שמופיע בהיסטוריית הגיט של קובץ אחר.

  • כלי עזר להשלמת שינויים

    עדכון שמות משתנים וקריאות לפונקציות מסביב לסמן בלי להמתין לכתיבת הקובץ מחדש.

איפה זה נופל

הוא לא מתאים לשיחה, לשאלות כלליות על ארכיטקטורה או להסבר באגים, כי הוא מאומן כמעט לחלוטין על פורמט ספציפי של תגיות עריכה. בנוסף, הוא תומך רשמית באנגלית בלבד ואין עליו שום נתוני בדיקה או מדדי איכות פומביים. אם תשלחו לו פרומפט רגיל בלי התבנית המדויקת של סמנים, הוא פשוט ייכשל.

שאלות
נפוצות

אפשר להשתמש במודל בתור בוט צ'אט שמסביר קוד?

לא. המודל אומן למשימת שכתוב של מקטעים סביב הסמן לפי פורמט עריכה ייחודי. הוא מצפה לתגיות פנימיות ולא מיועד לנהל שיחה חופשית עם מפתחים.

מה נדרש כדי שהוא יחזיר תוצאה תקינה?

חייבים לעטוף את הקלט במבנה הפרומפט המדויק שלו, כולל תגיות FIM, היסטוריית שינויים וסימון אזור העריכה באמצעות מרקרים ומיקום הסמן. בלי התבנית הזו המודל לא ידע מה לשכתב.

איך מריצים

כדי להריץ אותו מקומית במשקל המלא של 15.4 גיגה בייט בפורמט bfloat16, תצטרכו כרטיס מסך עם לפחות 24 גיגה בייט של זיכרון וידאו, במיוחד אם תרצו לנצל את חלון ההקשר המלא של 32 אלף טוקנים. הוא משתמש בארכיטקטורת Llama סטנדרטית דרך ספריית transformers, כך שקל לשלב אותו בסביבות הרצה קיימות.

אם אין לכם חומרה ייעודית שתספק זמני תגובה מהירים של עשיריות שנייה, חוויית העריכה הרציפה תהיה איטית מדי. במצב כזה עדיף להרים שרת מרוחק או להשתמש בשרת שמריץ vLLM כדי לקבל מענה מהיר בכל לחיצה במקלדת.

from transformers import pipeline

pipe = pipeline("text-generation", model="zed-industries/zeta-2.1")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולהטמיע אותו במוצרים פנימיים או חיצוניים בלי לשלם תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים המקורית והטקסט של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗