GPT
I

internlm3-8b-instruct

קוד פתוח

internlmapache-2.02025-01-13

  • safetensors
  • internlm3
  • text-generation
  • conversational
  • custom_code

מודל שיחה פתוח שמביא יכולות חשיבה ומתמטיקה חזקות לגודל קומפקטי. הוא אומן על 4 טריליון טוקנים ומציע מצב חשיבה מעמיק למשימות מורכבות.

  • 8.8Bפרמטרים
  • 32,768טוקנים בהקשר
  • 16.4 GBמשקל הקבצים
  • 81,020הורדות בחודש

מה זה

המודל מיועד לייצור טקסט ולהוראות שיחה, עם דגש מפורש על פתרון בעיות לוגיות מורכבות. המפתחים בנו בו שני מצבי עבודה שונים: מצב שיחה רגיל לתגובות שוטפות, ומצב חשיבה עמוקה שמשתמש בשרשרת מחשבה ארוכה כדי לפתור אתגרים מתמטיים ומדעיים.

במבחנים כמו MATH-500 ו־AIME2024 המודל עוקף מתחרים ישירים כמו Llama3.1-8B ו־Qwen2.5-7B כשמפעילים את מצב החשיבה, עם ציון 83.0 לעומת 72.4 של המתחרה הסיני. במבחני שיחה כלליים הוא מציג יתרון מסוים במעקב אחר הנחיות קשיחות עם 79.3 ב־IFEval, אך בכתיבת קוד בסיסית ב־HumanEval הוא מעט נמוך מ־Qwen.

מתאים ל

  • פתרון בעיות מתמטיקה

    מצב החשיבה מספק ציונים גבוהים במיוחד ב־MATH-500 ופותר משוואות מורכבות.

  • עוזר שיחה מקומי

    רץ ישירות ב־Ollama ומאפשר צ'אט שוטף על חומרה מקומית ללא תלות ברשת.

  • מעקב אחר הוראות מדויקות

    משיג תוצאה טובה במבחן IFEval ומתאים לייצור פלט מובנה לפי כללים קפדניים.

איפה זה נופל

היוצרים מזהירים מראש שהמודל עלול לייצר פלט מוטה, פוגעני או בלתי צפוי עקב אופיו ההסתברותי והגודל המוגבל שלו. בנוסף, המבחנים מראים ביצועי קוד צנועים יחסית של 17.8 ב־LiveCodeBench, וההישגים הגבוהים במתמטיקה מותנים בהפעלת שרשרת חשיבה ארוכה שמאטה את קצב התשובה ומנפחת את כמות הטוקנים שנוצרים. בעברית אין לגביו נתונים רשמיים, מה שמחייב בדיקה מקדימה לפני שמשלבים אותו במוצר.

שאלות
נפוצות

איך מפעילים את מצב החשיבה העמוקה?

מעבירים פרומפט מערכת ייעודי יחד עם השאלה של המשתמש בעת הקריאה לשרת. במצב הזה המודל מייצר שרשרת מחשבה ארוכה לפני התשובה הסופית, ולכן מומלץ להגדיל את מגבלת הטוקנים המקסימלית ל־8192 לפחות.

האם המודל תומך בטקסטים ארוכים?

כן, חלון ההקשר עומד על 32,768 טוקנים. במבחן RULER למסמכים ארוכים הוא קיבל ציון ממוצע של 87.9, מה שמאפשר לסכם ולנתח קבצים ארוכים בלי לאבד את ההקשר.

איך מריצים

כדי להריץ אותו מקומית צריך מאיץ גרפי עם לפחות 24GB זיכרון וידאו עבור משקלי bfloat16 מלאים, או פחות מזה אם מפעילים דחיסה. המודל נתמך ישירות בכלים פופולריים כמו vLLM, LMDeploy ו־Ollama, ודורש גרסת transformers מודרנית מ־4.48 ומעלה כדי להיטען כראוי דרך הקוד.

אם אין לכם שרת ייעודי או כרטיס מתאים, שווה לפנות לממשקי API מוכנים ברשת. הרצה עצמית משתלמת כשיש חומרה מקומית קיימת ורוצים פרטיות מלאה או שליטה ידנית בהגדרות הדגימה ופרומפט המערכת של מצב החשיבה.

pip install -U huggingface_hub
hf download internlm/internlm3-8b-instruct

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי לחלוטין, כולל שימוש מסחרי, שינוי הקוד והפצה של המשקלים. מותר לשלב אותו במוצרים סגורים ולמכור גישה אליהם, בתנאי ששומרים על הודעת הרישיון המקורית ומציינים את זכויות היוצרים של המפתחים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗