GPT
P

unsloth/Phi-3-mini-4k-instruct

קוד פתוח

unslothmit2024-04-29

  • transformers
  • safetensors
  • mistral
  • text-generation
  • unsloth

גרסה מותאמת של מודל ההוראות הקטן, שהוסבה לארכיטקטורת מיסטרל כדי לפעול ביותר סביבות. היא מיועדת למי שרוצה לאמן או להריץ מודל של 3.8 מיליארד פרמטרים על חומרה צנועה.

  • 3.8Bפרמטרים
  • 4,096טוקנים בהקשר
  • 7.1 GBמשקל הקבצים
  • 3,478הורדות בחודש

מה זה

מדובר בהתאמה של המודל הקטן למבנה של MistralForCausalLM. המטרה של ההמרה הזו היא לאפשר הרצה ואימון מהירים בכלים סטנדרטיים בלי להיתקל בבעיות תאימות שאפיינו את המבנה המקורי. המודל מחזיק 3.8 מיליארד פרמטרים, גודל שמציע פשרה הגיונית בין ביצועי שפה ובין דרישות זיכרון נמוכות.

לפי הנתונים של אנסלות', תהליך האימון של הדגם הזה מהיר פי שניים וחוסך חמישים אחוז מצריכת הזיכרון בהשוואה להרצה רגילה. המשמעות בפועל היא יכולת לבצע כוונון עדין על גבי כרטיסי מסך בסיסיים, במקום להזדקק לשרתים יקרים. המודל מכוון למשימות שיחה ומענה להוראות, ומגיע עם חלון הקשר של 4,096 טוקנים שמתאים לרוב משימות הטקסט הקצרות והבינוניות.

מתאים ל

  • אימון מקומי חסכוני

    מתאים לכוונון על נתונים פרטיים בתוך סביבות מוגבלות זיכרון כמו כרטיס T4 יחיד.

  • עוזר שיחה ומענה להוראות

    מבנה ההוראות והגודל הקומפקטי מאפשרים מענה מהיר באנגלית למשימות טקסט מוגדרות.

  • עיבוד טקסטים קצרים

    טוב למיצוי מידע וסיווג של פסקאות בודדות שנכנסות בתוך מגבלת ארבעת אלפים הטוקנים.

איפה זה נופל

ההקשר מוגבל ל־4,096 טוקנים בלבד. מסמכים ארוכים, קבצי קוד כבדים או שיחות מתמשכות פשוט ייחתכו ולא ייכנסו פה. מעבר לזה, המודל אומן והוגדר עבור השפה האנגלית בלבד, כך שלא כדאי לבנות עליו לפרויקטים בעברית או תרגום מקומי בלי לבדוק קודם איך הוא מתמודד עם השפה.

בנוסף, הכרטיס מציג בעיקר כוונון של תהליך האימון ומחייב התקנה של גרסת פיתוח מגיטהאב, מה שעלול לייצר תקלות יציבות במערכות ייצור. אין בכרטיס מבחני ביצועים שמראים דיוק מול מודלים אחרים, ולכן תצטרכו לבדוק בעצמכם את איכות התשובות וההזיות לפני הטמעה.

אותה משפחה

Phi-3-mini יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה בעברית?

הכרטיס מגדיר את השפה שלו כאנגלית בלבד. הוא עשוי לפלוט מילים בעברית אם יקבל קלט כזה, אבל רמת ההבנה, הדקדוק והידע הכללי יהיו נמוכים מאוד. לשימוש בעברית תצטרכו לאמן אותו מחדש על מאגר מתאים או לבחור מודל רב לשוני.

למה להשתמש בגרסה הזו ולא במקורית?

ההמרה לארכיטקטורת מיסטרל פותרת בעיות תאימות עם כלים קיימים ומאפשרת אימון מהיר וחסכוני בזיכרון דרך אנסלות'. אם אתם רוצים לאמן את המודל על חומרה חלשה, הגרסה הזו תעבוד בקלות רבה יותר.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־7.1 גיגה בייט בדיוק bfloat16, כך שכרטיס מסך בודד עם 8 עד 16 גיגה זיכרון יספיק לחלוטין לצורך הסקת מסקנות. הדף כולל מחברת עבודה ייעודית שרצה על גבי מעבד גרפי מסוג Tesla T4, ולכן אפשר לבצע כוונון עדין ישירות בסביבות חינמיות בלי להקים תשתית עצמאית.

כדי לעבוד איתו צריך להתקין את גרסת הפיתוח של ספריית transformers ישירות מגיטהאב. אם אתם צריכים רק מענה מהיר לבקשות בודדות ולא מתכוונים לאמן אותו על דאטה פנימי, עדיף להשתמש בשרותי ענן קיימים ולא להחזיק שרת דלוק.

from transformers import pipeline

pipe = pipeline("text-generation", model="unsloth/Phi-3-mini-4k-instruct")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון mit. זהו רישיון פתוח ומתירני שמאפשר שימוש מסחרי, שינוי של הקוד והמשקולות, הפצה ושילוב בתוך מוצרים סגורים, בלי דרישה לפתוח את הקוד שלכם. התנאי היחיד הוא שמירת הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗