GPT
Q

Qwen2.5-Coder-3B-Instruct

קוד פתוח

Qwenother2024-11-06

  • transformers
  • safetensors
  • qwen2
  • text-generation
  • code

יש כאן גם סקירה על Qwen עצמו.

מודל קוד קומפקטי שמכוון להוראות, שמתאים למפתחים שרוצים סיוע בתכנות מקומית בלי לתפוס את כל הזיכרון במחשב. הוא מתמודד עם השלמות קוד, תיקונים והיגיון מתמטי בסיסי.

  • 3.1Bפרמטרים
  • 32,768טוקנים בהקשר
  • 5.8 GBמשקל הקבצים
  • 474,586הורדות בחודש

מה זה

מדובר בגרסה מוקטנת מתוך משפחת מודלי הקוד של Qwen, שאומנה על 5.5 טריליון טוקנים שכוללים קוד מקור ונתונים סינתטיים. הוא תוכנן במיוחד למשימות של יצירת קוד, תיקון באגים והבנת הוראות טכניות, תוך שמירה על יכולות במתמטיקה כללית כדי לתמוך בסוכני קוד פשוטים.

בגודל הזה של 3.1 מיליארד פרמטרים, הוא מנסה לתת מענה פרקטי שבין מודלים זעירים של מיליארד פרמטרים לבין מודלי ענק. חלון ההקשר המלא של 32,768 טוקנים נותן לו מספיק מרחב לקרוא קבצים שלמים או היסטוריית שיחה ממושכת בלי לאבד את הקשר הדיון באמצע תהליך הפיתוח.

מתאים ל

  • השלמת קוד מקומית

    רץ ישירות על לפטופ פיתוח בלי לשלוח שורות קוד רגישות החוצה לרשת.

  • תיקון שגיאות וסקריפטים

    מטפל בבדיקת תחביר, פתרון באגים קצרים ותרגום קטעי פונקציות במהירות.

  • סוכן בדיקות פנימי

    חלון הקשר רחב מאפשר להזין קובץ שלם ולייצר עבורו בדיקות יחידה ממוקדות.

איפה זה נופל

השפה המוצהרת שלו היא אנגלית בלבד, כך שלא כדאי לבנות עליו לפענוח דרישות בעברית או לתיעוד מקומי. מעבר לזה, עם שלושה מיליארד פרמטרים בלבד, הוא לא מתחרה במודלי 32B או במודלים מסחריים גדולים בארכיטקטורות מורכבות, ונוטה לפספס בבעיות אלגוריתמיות סבוכות שדורשות עומק חשיבה רחב.

אותה משפחה

Qwen2.5-Coder יצא ב־18 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם המודל תומך בהוראות בעברית?

המודל מוגדר רשמית לאנגלית בלבד. הוא עשוי לפענח מילים בודדות בעברית, אבל אי אפשר לסמוך עליו במשימות פיתוח שכוללות הנחיות או הערות בשפה זו.

למה מופיעה לי שגיאת KeyError בעת הטעינה?

השגיאה מתרחשת אם גרסת ספריית transformers שלכם ישנה מגרסה 4.37.0. עדכון מהיר של החבילה פותר את הבעיה ומאפשר זיהוי נכון של הארכיטקטורה.

איך מריצים

בגלל משקל קבצים של כמעט 6 גיגה בייט בדיוק המקורי, אתם צריכים כרטיס מסך צנוע או מעבד סביר עם מספיק זיכרון עבודה כדי לטעון אותו ישירות דרך ספריית transformers. צריך לוודא שגרסת הספרייה מעל 4.37.0, אחרת מקבלים שגיאת טעינה על סוג הארכיטקטורה.

אם אתם צריכים שירות יציב לעשרות משתמשים במקביל או שאין לכם חומרה ייעודית, עדיף לפנות לנקודת קצה מנוהלת בענן במקום לנהל את הזיכרון בעצמכם.

from transformers import pipeline

pipe = pipeline("text-generation", model="Qwen/Qwen2.5-Coder-3B-Instruct")
print(pipe("שלום"))

הרישיון

הרישיון הרשמי מוגדר כסוג מותאם אישית ולא כרישיון קוד פתוח סטנדרטי ומוכר. אם אתם מתכננים להטמיע אותו במוצר מסחרי או להפיץ אותו הלאה, תצטרכו לבדוק את תנאי השימוש המלאים בעמוד הפרויקט כדי לוודא שאין שם הגבלות שימוש או חובת דיווח.

הרישיון המלא בעמוד המודל ↗