GPT
B

Baichuan2-13B-Chat

קוד פתוח

baichuan-incother2023-08-29

  • transformers
  • pytorch
  • baichuan
  • text-generation
  • custom_code

מודל שיחה של 13 מיליארד פרמטרים שאומן על 2.6 טריליון טוקנים, מתוכם נתח ענק בסינית. מתאים למי שצריך צ'אט דו-לשוני באנגלית וסינית בלי להתפשר על ביצועים בגודל בינוני.

  • 25.9 GBמשקל הקבצים
  • 6,279הורדות בחודש
  • 434לייקים
  • 40שכבות

מה זה

הגרסה הזו עברה כוונון ייעודי לשיחה, ומבוססת על אימון רחב היקף בסינית ובאנגלית. מבחינת יכולות, הוא מיועד למענה לשאלות, ניהול דיאלוג, ותרגום, כשגרסת v2 שלו קיבלה חיזוק ספציפי להבנת הוראות מורכבות, מתמטיקה והיגיון. בהשוואה למודלים מערביים בגודל 13B כמו LLaMA2, הדגש כאן שונה לגמרי. במבחנים בסינית כמו C-Eval הוא מגיע לציון 58.10 לעומת 35.80 בלבד של LLaMA2, מה שממחיש את הפער התהומי לטובתו בכל מה שקשור לשפה הסינית ולתרבות המקומית.

גם במבחנים באנגלית הוא לא נשאר מאחור ומציג עליונות קלה על פני משפחת LLaMA2 המקבילה, עם 59.17 במבחן MMLU מול 55.09 של המתחרה. המשמעות היא שאתם מקבלים כלי שלא מקריב את האנגלית לטובת הסינית, אלא שומר על רמה תחרותית בשתיהן. יחד עם זאת, הציונים עדיין נמוכים בהשוואה למודלי ענן מסחריים כמו GPT-3.5 ו־GPT-4, כך שגבולות הגזרה ברורים.

מתאים ל

  • שירות לקוחות בסינית

    אימון ייעודי על טקסטים בסינית הופך אותו לפתרון מקומי מעולה לשיחה שוטפת ומענה לשאלות.

  • תרגום מסמכים אנגלית סינית

    ציונים גבוהים בשתי השפות מאפשרים תרגום והתאמת תוכן דו כיוונית בלי לאבד הקשר.

  • הרצה מקומית מאובטחת

    גודל 13B מאפשר אירוח על חומרת שרת בודדת בארגון, ללא תלות בשרתי צד שלישי.

איפה זה נופל

השפות הנתמכות הן אנגלית וסינית בלבד, כך שעבור טקסט בעברית אין מה לחפש כאן והוא יפלוט ג'יבריש או יסרב לתפקד. הקוד שלו דורש הרצת קבצים מרוחקים של צד שלישי בטעינה, עניין שיוצר חשיפה אבטחתית בפרודקשן. בנוסף, אף על פי שגרסת v2 משפרת יכולות היגיון, ציוני הבנצ'מרק של דגם הבסיס במתמטיקה ובקוד נמוכים ממודלים שמתמחים בתכנות, והחברה מציינת במפורש שהיא מתנערת מכל אחריות לטעויות, הטיה בתוכן או בעיות אבטחה במידע.

אותה משפחה

Baichuan2 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל אומן ותומך רשמית באנגלית ובסינית בלבד. אין לו יכולת מעשית לייצר או לעבד טקסט בעברית בצורה תקינה.

איך מבטיחים שמריצים את הגרסה המעודכנת ביותר?

בזמן הטעינה בספריית transformers יש להגדיר revision='v2.0' בטוקנייזר ובמודל. גרסה זו כוללת שיפורים משמעותיים בהבנת הוראות ומתמטיקה לעומת v1.0 המקורית.

מה נדרש כדי להשתמש במודל באפליקציה מסחרית?

עליכם לוודא שהמוצר שלכם משרת פחות ממיליון משתמשים פעילים ביום, שאינכם ספקי ענן, ולשלוח בקשה רשמית לכתובת המייל של Baichuan כדי לקבל רישיון מסחרי מאושר.

איך מריצים

המשקלים תופסים 25.9 ג'יגה בייט בפורמט bfloat16 ומחולקים ל־19 קבצים, כך שצריך כרטיס מסך עם לפחות 32 ג'יגה זיכרון כדי להריץ אותו בלי שייחנק, או לפצל לשני כרטיסי 16 ג'יגה. המודל דורש PyTorch 2.0 בגלל שימוש בפונקציית הקשב F.scaled_dot_product_attention להאצה, וצריך לאפשר trust_remote_code בזמן הטעינה עם transformers. למי שמוגבל בחומרה, קיימת גרסה רשמית מכווצת ל־4 ביט שמורידה משמעותית את דרישות ה־VRAM.

אפשר להריץ אותו גם על מעבדי אינטל דרך ספריית BigDL-LLM. אם אתם צריכים רק מענה מזדמן לשאילתות בסינית ולא רוצים להחזיק שרת יקר באוויר, שימוש ב־API המקוון של Baichuan פשוט וזול יותר.

from transformers import pipeline

pipe = pipeline("text-generation", model="baichuan-inc/Baichuan2-13B-Chat")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־other ומשלב תנאי קהילה עם Apache 2.0. מותר להשתמש בו בחינם למחקר אקדמי. שימוש מסחרי מותר ללא תשלום רק לעסקים עם פחות ממיליון משתמשים פעילים ביום, בתנאי שאינכם ספקי שירותי ענן או תוכנה. לפני שמשלבים אותו במוצר מסחרי, חובה לשלוח בקשה רשמית במייל לחברה ולקבל מהם אישור בכתב.

הרישיון המלא בעמוד המודל ↗