GPT
E

Everyone-Coder-4x7b-Base

קוד פתוח

rombodawgcc-by-4.02024-01-14

  • transformers
  • safetensors
  • mixtral
  • text-generation
  • merge

זה חיבור מומחים של ארבעה מודלים קיימים שנועד לכתיבת קוד. מי שיבחר בו מחפש חלופה פתוחה למיקסטרל הרגיל, כזו שמרכזת יכולות מתמטיקה, קריאות לפונקציות וקוד במקום אחד.

  • 24Bפרמטרים
  • 32,768טוקנים בהקשר
  • 45.0 GBמשקל הקבצים
  • 8,387הורדות בחודש

מה זה

הבסיס כאן הוא מיזוג של ארבעה מודלים שונים בגודל שבעה מיליארד פרמטרים לרשת מומחים אחת. במקום לאמן מודל מאפס בעלויות עתק, היוצר לקח גרסאות קהילתיות של מיסטרל וחיבר אותן לארכיטקטורה של מיקסטרל. בין המרכיבים תמצאו את דולפין, וויזארד מאת', אופן צ'אט עם תמיכה בקריאות לפונקציות, ומודל ביגל.

המטרה המוצהרת של המהלך הזה היא להתחרות ישירות במודלים הסגורים יותר של מיסטרל עצמה, ולתת פתרון ממוקד קוד שקל יותר להמשיך ולאמן לבד. במקום שמונה מומחים, יש כאן ארבעה, מה שמקטין את הגודל הכללי אבל שומר על הרעיון של ניתוב משימות למומחה המתאים. כרטיס המודל לא מציג ציוני מבחנים רשמיים, כך שחובת ההוכחה על איכות הקוד שהוא פולט נשארת אצל מי שמוריד אותו.

מתאים ל

  • השלמת קוד מקומית

    טוב למי שרוצה השלמות קוד על שרת פנימי של החברה, בזכות שילוב מומחי קוד.

  • בסיס לאימון נוסף

    מתאים כנקודת פתיחה לכוונון עדין של מודל תכנות פנים ארגוני.

  • עבודה עם פונקציות

    נשען על מודל מקור שתומך בהפעלת פונקציות לתהליכי פיתוח אוטומטיים.

איפה זה נופל

זה מודל בסיס, כלומר הוא לא עבר אימון שיחה סופי או התאמה להוראות מובנות. הוא עלול לפלוט השלמות טקסט עיוורות במקום לענות לשאלה טכנית ישירה, ואתם תצטרכו להנדס פרומפטים בזהירות או לאמן אותו בעצמכם. מעבר לזה, חיבור של כמה מודלים מאומנים מראש בטכניקת מיזוג מומחים לפעמים יוצר חוסר יציבות בתשובות או התנגשויות בין הסגנונות של המודלים המקוריים.

שאלות
נפוצות

האם המודל מוכן לשימוש בצ'אט פיתוח?

לא ישר מהקופסה. מדובר בגרסת בסיס שמיועדת להשלמת טקסט וקוד או להמשך אימון, ולא במודל שיחה שמגיב להוראות בצורה טבעית.

מה היתרון בארבעה מומחים במקום שמונה?

המשקל הכולל של הקבצים קטן משמעותית לעומת המודל המלא של מיקסטרל, מה שחוסך זיכרון ומקל על הרצה או אימון בתשתיות קטנות יותר.

האם יש תמיכה טובה בעברית?

החומר לא מציין אימון מכוון בעברית והוא מבוסס על מודלים שנועדו לקוד ומתמטיקה, אז עדיף להשתמש בו רק באנגלית ולקוד.

איך מריצים

המשקל הגולמי מגיע לארבעים וחמישה גיגה בייט בדיוק כפול, מה שאומר שצריך לפחות כרטיס מקצועי אחד או שני כרטיסים ביתיים חזקים כדי להעלות אותו לזיכרון בלי קוונטיזציה. מי שמחזיק תחנת עבודה רגילה יצטרך גרסה מכווצת כדי לנשום, או שיעבוד דרך סביבת ענן שמאפשרת לחלק את העומס.

אם אין לכם תשתית מוכנה ואתם רק צריכים השלמות קוד פשוטות פה ושם, כנראה שעדיף לשלם לפי קריאה למודל מסחרי קיים. הרצה עצמית של המבנה הזה משתלמת בעיקר אם יש לכם צורך מובהק בקוד מקומי שלא יוצא החוצה, או אם אתם מתכננים לאמן אותו הלאה על הדאטה שלכם.

from transformers import pipeline

pipe = pipeline("text-generation", model="rombodawg/Everyone-Coder-4x7b-Base")
print(pipe("שלום"))

הרישיון

הרישיון הוא קריאייטיב קומונס ייחוס 4.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו מחדש ולבנות עליו מוצרים. התנאי היחיד הוא מתן קרדיט ברור ליוצר המקורי וציון השינויים שביצעתם.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗