GPT
I

INTELLECT-2

קוד פתוח

PrimeIntellectapache-2.02025-05-11

  • safetensors
  • qwen2

מודל פתוח של 33 מיליארד פרמטרים שמתמחה בחשיבה עמוקה, מתמטיקה ותכנות. הוא אומן בחיזוקים על גבי תשתית מבוזרת כדי להציג ביצועי קצה בלי תלות בענקיות הטכנולוגיה.

  • 33Bפרמטרים
  • 40,960טוקנים בהקשר
  • 122 GBמשקל הקבצים
  • 440הורדות בחודש

מה זה

מדובר בפיתוח של PrimeIntellect שמבוסס על QwQ-32B ועבר אימון חיזוקים מבוזר באמצעות סביבת prime-rl. המטרה היתה לחדד יכולות חשיבה לוגית בעזרת תגמולים שניתנים לאימות, במיוחד סביב פתרון בעיות כתיבת קוד וחישובים מורכבים. הארכיטקטורה היא Qwen2 סטנדרטית, כך שקל לשלב אותו במנועי הסקה פופולריים כמו vLLM או SGLang.

במבחני ביצועים הוא עוקף את מודל הבסיס שלו וגם את המתחרים הישירים בגודל הזה. בפתרון בעיות קוד ב־LiveCodeBench הוא רושם ציון של 67.8, ובמבחני AIME24 במתמטיקה הוא מגיע ל־78.8, תוצאה שמקבילה ואף עוקפת מודלים גדולים בהרבה. הוא לא מיועד לשיחה קלילה, אלא לפיצוח משימות שדורשות שרשרת חשיבה ארוכה מאוד לפני שליפת התשובה הסופית.

מתאים ל

  • פתרון בעיות אלגוריתמיות

    מצטיין במבחני תכנות מורכבים כמו LiveCodeBench בזכות אימון ייעודי על משימות מאומתות.

  • הוכחות וחישובים מתמטיים

    מציג דיוק של 78.8 במבחני AIME24 ומסוגל להחזיק תהליכי חשיבה ארוכים מאוד.

  • בדיקת באגים וניתוח קוד

    חלון הקשר של מעל 40 אלף טוקנים מאפשר להזין ספריות שלמות ולחפש כשלים לוגיים עמוקים.

איפה זה נופל

ההתמקדות הכמעט בלעדית בקוד ומתמטיקה פגעה ביכולות אחרות. המפתחים מציינים ירידה בביצועים במבחן IFEval, שבודק עמידה בהוראות מורכבות, עקב היעדר גיוון בדאטה. הוא גם מתקשה לשלוט באורך הפלט לפי דרישה, מאחר שהאימון לא נמשך מספיק זמן כדי להטמיע את המנגנון הזה במלואו. אל תבנו עליו לעריכת טקסט כללי או לציות קפדני לפורמטים שאינם לוגיים.

שאלות
נפוצות

איך גורמים למודל לעבוד בצורה הכי טובה?

המפתחים ממליצים להוסיף להוראה שלכם את המשפט שדורש ממנו לחשוב במשך 10,000 טוקנים לפני מתן התשובה. המודל אומן על יעדי אורך שונים, ולכן שימוש במספרים כמו 2000, 4000, 6000 או 8000 ייתן תוצאות עקביות יותר מאשר אורכים אקראיים.

האם הוא מתאים לשימוש כעוזר כללי או בוט שירות?

לא מומלץ להשתמש בו למטרות כאלה. המודל אומן באופן צר מאוד על מתמטיקה וקוד, והיכולת שלו לעקוב אחרי הוראות שיחה כלליות נמוכה יותר מזו של מודל הבסיס שממנו הוא נוצר.

איך מריצים

כדי להריץ אותו ישירות מקבצי המשקלים המקוריים תצטרכו שרת עם זיכרון וידאו עצום, כיוון שהקבצים שמורים בדיוק מלא של float32 ושוקלים 122 גיגהבייט. בפועל, כמעט אף אחד לא מריץ אותו ככה. מורידים גרסאות מכווצות או טוענים אותו בדיוק 16 ביט ומטה על שני כרטיסי A100 או כרטיסי שרת דומים דרך מנוע כמו vLLM.

אם אין לכם חומרה ייעודית מקומית שזמינה לעבודה רציפה, עדיף להמתין לממשקי ענן שמגישים אותו או לפנות ל־API חיצוני. מעבר לדרישות החומרה, כדי להוציא ממנו תוצאות טובות צריך להנחות אותו במפורש להקדיש אלפי טוקנים למחשבה לפני שהוא עונה.

pip install -U huggingface_hub
hf download PrimeIntellect/INTELLECT-2

הרישיון

הפרויקט משוחרר תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את המשקלים, להפיץ אותם מחדש ולשלב אותם בתוך מוצרים. התנאי המרכזי הוא שמירה על הודעות זכויות היוצרים והרישיון המקורי בקבצים שתפיצו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗