GPT
S

stable-code-3b

קוד פתוח

stabilityaiother2024-01-09

  • transformers
  • safetensors
  • gguf
  • stablelm
  • text-generation

מודל קוד קומפקטי שמציע השלמת מקטעים ותמיכה בהקשר ארוך יחסית לגודלו. הוא נבנה במיוחד למפתחים שמחפשים ביצועי קוד סבירים בלי להחזיק שרת יקר.

  • 2.8Bפרמטרים
  • 16,384טוקנים בהקשר
  • 14.4 GBמשקל הקבצים
  • 7,541הורדות בחודש

מה זה

מדובר במודל שפת בסיס של 2.8 מיליארד פרמטרים שאומן על טקסט וקוד ב־18 שפות תכנות שונות, מתוך מטרה לתת מענה מקומי למשימות פיתוח.

הייחוד שלו בקטגוריית המשקל הזו הוא תמיכה מובנית במנגנון השלמת אמצע (FIM), שמאפשר לו להבין מה כתוב לפני ואחרי הסמן ולהשלים את החסר ביניהם, לצד חלון הקשר של 16,384 טוקנים. במבחני MultiPL-E הוא עוקף מודלים כמו CodeLlama 7B בפייתון עם 32.4% מול 30.0%, ובג'אווה עם 32.1% מול 31.1%, אם כי בשפות כמו Rust הוא נשאר מאחור עם 23.0% בלבד.

מתאים ל

  • השלמת קוד בזמן אמת ב־IDE

    תמיכה במנגנון השלמת אמצע שמתאימה לקריאת הקוד שמעל ומתחת לסמן ועבודה מקומית מהירה.

  • בסיס לאימון המשך פנימי

    גודל נוח של 2.8B שמאפשר לבצע fine-tuning על מאגר קוד ארגוני בלי להוציא הון על חומרה.

  • ניתוח קבצי קוד ארוכים

    חלון הקשר של 16,384 טוקנים מאפשר להזין מודולים שלמים יחד במקום לחתוך פונקציות בודדות.

איפה זה נופל

זהו מודל בסיס ולא מודל שעבר התאמה לשיחה (instruction tuned), כך שהוא לא יודע לפטפט או להסביר קוד אלא פשוט ממשיך טקסט קיים. הכרטיס מזהיר במפורש שהנתונים כללו תוכן גולמי מהרשת שעלול לייצר קוד לא בטוח, שגוי או פוגעני, ולכן הוא לא מתאים לפרודקשן ישיר ללא בדיקות קפדניות או אימון המשך.

אותה משפחה

stable-code יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לענות בעברית?

לא. המודל אומן על אנגלית ושפות תכנות בלבד. הוא לא מיועד לשאלות בעברית ולא ייצר קוד על בסיס הוראות בשפה זו.

האם אפשר להשתמש בו ישירות כצ'אט בוט לפיתוח?

לא. זהו מודל השלמה גולמי (base model). אם תשאלו אותו שאלה, הוא ינסה להשלים אותה כטקסט במקום לתת תשובה מסודרת של עוזר פיתוח.

איך מריצים

המודל רץ דרך ספריית transformers בפורמט bfloat16 ותומך בהאצה עם Flash Attention 2. בגלל גודלו, שדורש טעינה של כ־14.4 גיגה־בייט קבצים, אפשר להריץ אותו על כרטיס מסך ביתי בודד בעל זיכרון של 8 עד 16 גיגה־בייט תלוי בקוונטיזציה.

אם אתם צריכים רק שאילתות בודדות או עבודה מול קבצי ענק שחורגים מזיכרון ה־GPU שלכם, פנייה ל־API חיצוני תהיה זולה ופשוטה יותר מלתחזק שרת ייעודי.

ollama run hf.co/stabilityai/stable-code-3b:Q5_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other ומבוסס על Community License של Stability AI. שימוש מסחרי דורש פנייה לעמוד הרישיונות של החברה כדי להסדיר תשלום או הרשאה, כך שאי אפשר פשוט להטמיע אותו במוצר מסחרי סגור בלי לבדוק מולם את התנאים.

הרישיון המלא בעמוד המודל ↗