GPT
D

DeciCoder-1b

קוד פתוח

Deciapache-2.02023-08-16

  • transformers
  • safetensors
  • text-generation
  • text generation
  • Deci AI

מודל השלמת קוד קומפקטי שמכוון ספציפית לפייתון, ג'אווה וג'אווהסקריפט. הוא מתאים למי שחייב השהיה אפסית בריצה מקומית ולא יכול להחזיק כרטיסי מסך יקרים.

  • 1.1Bפרמטרים
  • 2,048טוקנים בהקשר
  • 2.1 GBמשקל הקבצים
  • 238הורדות בחודש

מה זה

המודל הזה נבנה כדי להשלים שורות קוד ופונקציות, תוך שימוש בארכיטקטורת Grouped Query Attention שמאיצה את ההסקה וחוסכת בזיכרון. הוא אומן על 446 מיליארד טוקנים שסוננו ממאגר StarCoder בשלוש שפות בלבד, ותומך במילוי קוד באמצע קובץ, מה שהופך אותו לטבעי בתוך עורכי קוד.

במבחני MultiPL HumanEval התוצאות מראות pass@1 של 19.1% בפייתון, 18.4% בג'אווהסקריפט ו־16.6% בג'אווה. המשמעות בפועל ברורה: הוא מייצר קוד ראשוני סביר אבל נכשל ברוב המוחלט של המקרים המורכבים, כך שאי אפשר להסתמך עליו לכתיבה אוטונומית אלא רק כהשלמה חכמה שמפתח בודק במקום.

מתאים ל

  • השלמת קוד בעורך מקומי

    משתלב בתוך IDE כתוסף קל משקל להשלמת שורות בזמן אמת, בלי לשלוח שום קוד לשרת חיצוני.

  • השלמת פונקציות פייתון

    מקבל חתימת פונקציה והערת תיעוד, ומייצר את גוף הפונקציה הבסיסי ישירות על מעבד מקומי.

  • הסקה מהירה בחומרה זולה

    מתאים לשרתים חלשים עם זיכרון וידאו זעיר שחייבים אלפי טוקנים בשנייה בלי תקציב ל־A100.

איפה זה נופל

זה לא מודל הוראות. אם תכתבו לו בעברית או באנגלית בקשה כמו תכתוב לי פונקציה, תקבלו ג'יבריש או המשך לא קשור. הוא מגיב רק להערות קוד, חתימות של פונקציות ודוקסטרינג.

בנוסף, הכרטיס מבהיר שהקוד שהוא מייצר עלול להכיל באגים קשים או חולשות אבטחה, וחלון ההקשר מוגבל ל־2,048 טוקנים בלבד. לוגיקה שדורשת קבצים מרובים או פרויקטים גדולים פשוט תיחתך.

שאלות
נפוצות

האם המודל יודע לענות לשאלות ולכתוב קוד לפי פקודה בצ'אט?

לא. המודל אינו מודל שיחה ולא אומן על הוראות. הדרך היחידה להפעיל אותו היא להתחיל לכתוב קוד או הערת קוד, ולתת לו להשלים את התווים הבאים.

האם המודל תומך בשפות כמו סי שארפ, סי פלוס פלוס או גו?

הוא אומן אך ורק על תת־קבוצה של פייתון, ג'אווה וג'אווהסקריפט ממאגר StarCoder. הוא לא מיועד לשפות תכנות אחרות והתוצאות בהן יהיו גרועות במיוחד.

איך מריצים

טוענים אותו דרך transformers ישירות עם AutoModelForCausalLM בדיוק bfloat16, כשהמשקל הכולל של הקבצים הוא 2.1 גיגה בייט בלבד. בגלל הגודל הזה הוא רץ בקלות על מעבד רגיל או כרטיס מסך פשוט, ובכרטיס A10 הוא חוצה בקלות אלף טוקנים לשנייה אפילו ב־PyTorch רגיל.

צריך להגדיר trust_remote_code כיוון שמדובר בארכיטקטורה מותאמת. אם אתם מחפשים סוכן שמבין משימות שלמות וכותב קבצים מאפס, עדיף לפנות ל־API של מודל ענק במקום להתאמץ לתחזק אותו.

from transformers import pipeline

pipe = pipeline("text-generation", model="Deci/DeciCoder-1b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא, מה שאומר שמותר להשתמש בו לצרכים מסחריים, לשנות אותו ולהטמיע אותו במוצרים פנימיים או חיצוניים בלי לשלם תמלוגים, כל עוד שומרים על הודעת הרישיון והקרדיט המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗