GPT
C

chatglm3-6b-32k

קוד פתוח

zai-orgרישיון לא דווח2023-10-26

  • transformers
  • pytorch
  • chatglm
  • glm
  • thudm

גרסה מורחבת לשיחות ארוכות שתומכת בהקשר של עד שלושים ושניים אלף טוקנים. היא מיועדת למי שצריך הרצה מקומית של קוד, קריאות לפונקציות וניתוח מסמכים באנגלית ובסינית.

  • 11.6 GBמשקל הקבצים
  • 533הורדות בחודש
  • 246לייקים

מה זה

הגרסה הזו מתבססת על ChatGLM3-6B, אבל כוללת שינוי בקידוד המיקום ואימון ייעודי על טקסטים ארוכים כדי להחזיק שיחות ומסמכים של עד שלושים ושניים אלף טוקנים. מעבר לשיחה חופשית, המודל תוכנן מראש להפעלת כלים, הרצת קוד ומשימות של סוכנים אוטונומיים באמצעות מבנה פרומפט ייעודי.

המפתחים ממליצים עליו רק אם אתם באמת חוצים את רף שמונת אלפים הטוקנים. אם רוב העבודה שלכם נשארת בטווח הקצר, המודל הרגיל מספיק ועדיף עליו מבחינת יעילות, כך שאין סיבה לקחת את גרסת השלושים ושניים אלף סתם.

מתאים ל

  • ניתוח מסמכים ארוכים

    קריאה ותשאול של קבצים טקסטואליים ארוכים באנגלית ובסינית שעוברים את רף שמונת אלפים הטוקנים.

  • הפעלת פונקציות וכלים

    שילוב בסוכנים שצריכים לנתח הקשר ארוך ולקרוא לפונקציות חיצוניות בעזרת התמיכה הטבעית של המודל.

  • הרצת קוד במסגרת שיחה

    סביבות פיתוח מקומיות שמסתמכות על תמיכת המודל במתורגמן קוד ושיחות מרובות שלבים.

איפה זה נופל

היוצרים מציינים בעצמם שאם המשימות שלכם לא חוצות שמונת אלפים טוקנים, אין שום סיבה להשתמש בגרסה הזו. הרחבת חלון ההקשר דורשת משאבי זיכרון כבדים מאוד שמכבידים על המערכת בזמן ריצה. בנוסף, המודל אומן רק על אנגלית וסינית, כך שאין שום תמיכה מובנית בעברית, והוא עלול לפלוט ג'יבריש או תשובות שבורות. מעבר לכך, מדובר במודל של שישה מיליארד פרמטרים בלבד, ולכן במשימות ניתוח מורכבות, הרצת קוד או הפעלת פונקציות מרובות לאורך טקסטים ארוכים, הוא עלול לאבד פרטים, לטעות בלוגיקה או להמציא עובדות.

אותה משפחה

chatglm3 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים לטקסטים בעברית?

לא. המודל הוגדר ואומן עבור סינית ואנגלית בלבד. כל ניסיון להזין לו מסמכים בעברית עלול להסתיים בפלטים חלקיים, תרגום משובש או כשלים בהבנה.

האם כדאי להשתמש בו לשיחות רגילות וקצרות?

המפתחים ממליצים בפירוש לבחור בגרסת הבסיס הרגילה לכל שימוש שלא עובר שמונת אלפים טוקנים. גרסת השלושים ושניים אלף נועדה ספציפית לטקסטים חריגים באורכם.

האם מותר להשתמש בו באפליקציה מסחרית?

הרישיון בעמוד לא דווח בצורה מסודרת, אך התיעוד מציין שמשקלי המודל דורשים מילוי טופס רישום כדי לקבל הרשאה לשימוש מסחרי ללא תשלום.

איך מריצים

המשקל הכולל של הקבצים עומד על 11.6 גיגה בייט בפורמט float16. כדי לטעון אותו ולהריץ הסקת מסקנות עם חלון הקשר מלא של שלושים ושניים אלף טוקנים, תצטרכו כרטיס מסך עם לפחות שישה עשר עד עשרים וארבעה גיגה בייט של זיכרון גרפי, אחרת תישארו בלי מקום לזיכרון המצב של שכבות התשומת לב.

ההרצה מתבצעת ישירות דרך ספריית transformers של פייתון, יחד עם תלויות נוספות כמו cpm_kernels, torch מגרסה שתיים ומעלה, וספריות תשתית כמו sentencepiece ופרוטובאף. אם אין לכם חומרה ייעודית עם זיכרון גרפי מתאים, פנייה לשרת מרוחק עדיפה על ניסיון להריץ אותו מקומית.

from transformers import pipeline

pipe = pipeline("text-generation", model="zai-org/chatglm3-6b-32k")
print(pipe("שלום"))

הרישיון

בעמוד המודל הנוכחי לא דווח רישיון רשמי, מה שיוצר סיכון משפטי למי ששוקל להפיץ אותו. לפי התיאור, הקוד משוחרר תחת אפאצ'י שתיים, ומשקלי המודל פתוחים למחקר אקדמי. שימוש מסחרי מותנה במילוי טופס שאלון ייעודי מול החברה כדי לקבל אישור חינמי, ולכן אסור להכניס אותו ישירות למוצר מסחרי בלי להסדיר את הרישום מראש.

הרישיון המלא בעמוד המודל ↗