GPT
U

Unichat-llama3-Chinese-8B

קוד פתוח

UnicomLLMapache-2.02024-04-19

  • transformers
  • pytorch
  • llama
  • text-generation
  • conversational

גרסה מכווננת של לאמה 3 שמיועדת ספציפית לשיחה ומענה לשאלות בסינית. היא נותנת מענה מלא למי שצריך תמיכה טובה בשפה הסינית על בסיס מודל שמונה מיליארד פרמטרים.

  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 8,398הורדות בחודש
  • 73לייקים

מה זה

מדובר בהתאמה ממוקדת של המודל הבסיסי מבית מטא שנעשתה באמצעות כוונון עדין מלא של כל הפרמטרים, ולא דרך מתאמים קלים כמו לורה. צוות הפיתוח הוסיף נתוני שיחה והוראות בסינית שעברו סינון אנושי, כשהמטרה היא לחפות על הפערים של המודל המקורי בשפה הזו.

הוא שומר על מבנה שלושים ושתיים השכבות המוכר ועל אורך הקשר מקורי של שמונת אלפים טוקנים. מעבר לשיחות שוטפות בסינית, הדוגמאות שהיצרן הציג מראות יכולת פתרון בעיות מתמטיות פשוטות בשלבים, מענה על היסטוריה סינית וסירוב מובנה לבקשות מסוכנות כמו ייצור חומרי נפץ.

מתאים ל

  • עוזר שיחה בסינית

    מענה טבעי לשאלות משתמשים בשפה הסינית על בסיס מודל קומפקטי שמבין את השפה טוב יותר ממודל הבסיס.

  • פתרון בעיות והסברים

    פירוק שאלות מילוליות ומתמטיות לשלבים ברורים עם ניסוח מונחים מקומיים ומדויקים בסינית.

  • שירות פנימי מאובטח

    הרצה מקומית בתוך הארגון ללא תלות ברשת חיצונית, עבור ארגונים שמעבדים תוכן רגיש בסינית.

איפה זה נופל

היוצרים מדברים על איכות גבוהה, אבל אין בדף שום מבחני ביצועים רשמיים, השוואה כמותית למודלים אחרים או מדידות קונקרטיות שמוכיחות את זה. בנוסף, הוא מתמקד רק באנגלית ובסינית, כך שאינו מתאים לעבודה בעברית. חלון ההקשר מוגבל לשמונת אלפים טוקנים בלבד, כך שלא תצליחו להזין לתוכו מסמכי ענק או שיחות מתמשכות ארוכות במיוחד.

שאלות
נפוצות

האם המודל הזה תומך בעברית?

המודל אומן והותאם ספציפית לסינית ולאנגלית. הוא אינו מיועד לעברית, ולכן לא מומלץ להשתמש בו ליישומים הדורשים עיבוד שפה מקומית.

איזה כרטיס מסך נדרש כדי להריץ אותו בלי קוונטיזציה?

הקבצים שוקלים חמישה עשר גיגהבייט, ולכן תזדקקו לכרטיס מסך בעל עשרים וארבעה גיגהבייט זיכרון כדי להריץ את המודל בדיוק מלא יחד עם זיכרון העבודה של ההקשר.

איך מריצים

המשקלים תופסים כחמישה עשר גיגהבייט בדיוק המקורי. כדי להריץ אותו כמו שהוא צריך כרטיס מסך עם לפחות שישה עשר עד עשרים וארבעה גיגהבייט זיכרון גרפי, למשל כרטיס בודד מהסדרות המקצועיות או כרטיס צרכני חזק.

אם שטח הזיכרון לחוץ לכם אפשר לכמת אותו למבנה של ארבעה או שמונה ביט כדי לדחוס אותו לחומרה צנועה יותר. מי שלא מחזיק שרת ייעודי או לא מעוניין לתחזק מכונה עם כרטיס מסך דולק ברציפות, יעדיף לצרוך מודל מקביל דרך שירות ענן מסחרי לפי קריאה.

from transformers import pipeline

pipe = pipeline("text-generation", model="UnicomLLM/Unichat-llama3-Chinese-8B")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י שתיים אפס, שמתיר שימוש מסחרי, שינוי והפצה חופשית ללא תמלוגים, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗