GPT
I

internlm2_5-7b-chat

קוד פתוח

internlmother2024-06-27

  • transformers
  • safetensors
  • internlm2
  • text-generation
  • conversational

גרסת צ'אט של שבעה מיליארד פרמטרים שמתמקדת במתמטיקה, הפעלת כלים והקשר ארוך. בחירה טובה למי שרוצה ביצועים אנליטיים גבוהים במודל קומפקטי.

  • 7.7Bפרמטרים
  • 32,768טוקנים בהקשר
  • 14.4 GBמשקל הקבצים
  • 28,924הורדות בחודש

מה זה

המודל מגיע עם שבעה נקודה שבעה מיליארד פרמטרים ומכוון למשימות שיחה, חשיבה מורכבת ושימוש בכלים חיצוניים. המפתחים שלו מדגישים תמיכה בחלון הקשר של עד מיליון טוקנים באמצעות LMDeploy, לצד יכולת חיפוש ואיסוף מידע מתוך יותר ממאה דפי רשת במקביל דרך ספריות כמו MindSearch.

במדדי הביצועים של OpenCompass הוא מציג יתרון בולט בהסקה כמותית על פני מודלים מקבילים. במבחן MATH ללא דוגמאות הוא מגיע לציון שישים נקודה אחת, לעומת עשרים ושבע נקודה תשע של Llama3 המקביל וארבעים ושמונה נקודה שש של Qwen2. גם בבחינות ידע כללי כמו MMLU הוא עומד בראש הטבלה מולם עם שבעים ושתיים נקודה שמונה נקודות.

מתאים ל

  • פתרון בעיות מתמטיקה

    משיג ציון שישים נקודה אחת במבחן MATH, תוצאה גבוהה בהרבה מכל מודל מקביל בגודל שבעה מיליארד פרמטרים.

  • סוכני ניתוח דפי רשת

    נבנה לעבודה מול ספריות סוכנים ויודע לסרוק ולהצליב מידע מיותר ממאה מקורות במקביל.

  • ניתוח מסמכים ארוכים

    מאפשר תשאול טקסטים ענקיים כמעט בלי לאבד פרטים כשמריצים אותו עם תשתית LMDeploy.

איפה זה נופל

המפתחים מציינים במפורש שהמודל עלול לפלוט הטיות, אפליה ותכנים מזיקים בגלל האופי ההסתברותי שלו ומגבלות הגודל. מעבר לזה, הכרטיס לא מציג שום נתונים על תמיכה בעברית, כך שלא הייתי בונה עליו למשימות שפה מקומיות בלי בדיקה מקיפה מראש. חובה גם לשים לב שהקוד דורש הרצת קוד מרוחק כדי להיטען, מה שמוסיף סיכון אבטחה בסביבות ייצור סגורות.

אותה משפחה

internlm2-5 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש במודל בחינם במוצר מסחרי?

השימוש המסחרי אמנם לא עולה כסף, אבל הוא מותנה באישור. הרישיון דורש מכם למלא טופס בקשה רשמי למפתחים כדי לקבל היתר מסחרי לפני הפריסה.

איך אפשר לקבל הקשר של מיליון טוקנים אם המודל מוגדר ל־32K?

ברירת המחדל של המודל היא שלושים ושניים אלף טוקנים. כדי להגיע למיליון טוקנים צריך להריץ אותו דרך מנוע ההרצה הייעודי LMDeploy שמטפל בחלון המורחב.

האם המודל מתאים לעבודה בעברית?

החומר הרשמי לא מציין ביצועים או אימון ייעודי בעברית, אלא מתמקד באנגלית ובסינית. מומלץ לבדוק את איכות הפלט באופן עצמאי לפני שמתכננים עליו שימוש מקומי.

איך מריצים

כדי להריץ אותו במשקל המקורי של ארבעה עשר נקודה ארבעה גיגהבייט בפורמט bfloat16, תצטרכו כרטיס מסך עם לפחות שישה עשר עד עשרים וארבעה גיגהבייט זיכרון וידאו. ההרצה דורשת שימוש בפרמטר trust_remote_code מול ספריית transformers, או שרתים כמו vLLM ו־LMDeploy שפותח במיוחד עבורו ומאפשר למתוח את ההקשר מעבר לברירת המחדל.

אם אין לכם כרטיס גרפי מתאים, יש למודל גרסאות מכווצות בפורמט GGUF להרצה על מעבד רגיל עם llama.cpp, בדיוקים שנעים בין חמישה לשמונה ביט. הרצה מקומית עצמאית עדיפה רק אם הפרטיות קריטית לכם, כי הקמת שרת ייעודי למודל כזה תעלה יותר מקריאות API פשוטות לספקי צד שלישי.

from transformers import pipeline

pipe = pipeline("text-generation", model="internlm/internlm2_5-7b-chat")
print(pipe("שלום"))

הרישיון

קוד הפרויקט מופץ תחת רישיון Apache 2.0, אבל משקלי המודל מוגדרים תחת other. השימוש בהם חופשי למחקר אקדמי, אך שימוש מסחרי מחייב מילוי טופס בקשה רשמי מול המפתחים לקבלת אישור חינמי לפני שמשלבים אותו במוצר מסחרי פעיל.

הרישיון המלא בעמוד המודל ↗