GPT
R

rnj-1

קוד פתוח

EssentialAIapache-2.02025-11-13

  • transformers
  • safetensors
  • gemma3_text
  • text-generation
  • conversational

מודל בסיס פתוח שמתמקד כולו בקוד ובמדעים מדויקים. הוא נבנה מאפס כדי להוות בסיס לאימון נוסף או להרצה של סוכני פיתוח עצמאיים.

  • 8.3Bפרמטרים
  • 32,768טוקנים בהקשר
  • 31.0 GBמשקל הקבצים
  • 4,857הורדות בחודש

מה זה

מדובר במודל בסיס במשקל שמונה מיליארד פרמטרים שפותח על ידי חברת Essential AI, ומבוסס על ארכיטקטורת Gemma 3 עם מנגנון קשב גלובלי. המודל אומן מראש על 8.4 טריליון טוקנים בהקשר קצר, ולאחר מכן הורחב לחלון של 32 אלף טוקנים. הוא תוכנן מראש עבור משימות הנדסת תוכנה ומדע, וכולל יכולות מובנות להשלמת קוד באמצע קובץ הודות לאימון בשיטת Fill in the Middle.

במבחני ביצועים, דגם ההוראות שמבוסס עליו מציג תוצאות חריגות לגודלו, עם ציון של 20.8 אחוזים בבנצ'מרק SWE-bench במצב פקודות מערכת בלבד. הנתון הזה מציב אותו מעל מודלים פתוחים כבדים בהרבה כמו Qwen 2.5 Coder של שלושים ושניים מיליארד פרמטרים. החוזק העיקרי כאן אינו שיחה כללית, אלא פתרון תקלות בקוד וקריאה לכלים חיצוניים.

מתאים ל

  • בסיס לאימון מודל קוד פנימי

    הוא נבנה במכוון עם אימון המשך מינימלי, ומספק שלד חזק שמתמחה בקוד ובמדע וממתין לכוונון על הדאטה שלכם.

  • סוכן בדיקות והשלמת קוד

    התמיכה בטכניקת השלמת קוד באמצע קובץ והשליטה בכלים מאפשרות לו להשתלב ישירות כעוזר פיתוח בסביבות עבודה.

  • אופטימיזציה של אלגוריתמים

    הוא מציג ביצועים גבוהים בהרצת פרופיילר ושיפור יעילות של קוד קיים במספר שפות תכנות שונות.

איפה זה נופל

זהו מודל בסיס שאינו כולל אימון שיחה או התאמה להוראות, אלא דורש כוונון המשך. הכרטיס מזהיר במפורש שהמודל נוטה לפלוט קוד גם כשלא מבקשים ממנו, במיוחד אם לא מגדירים הנחיית מערכת ברורה. הוא לא נבנה לשליפת עובדות כלליות, ויש בו הזיות של מידע וידע היסטורי. בנוסף, הוא מבלבל את הזהות שלו עם חברות ומודלים אחרים בגלל המידע ברשת, ואין לו תאריך סף מוגדר לעדכניות המידע, כך שלא כדאי להסתמך עליו בשאלות ידע.

אותה משפחה

rnj-1 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה מתאים לעבודה בעברית?

לא מומלץ לבנות עליו לטקסט בעברית. המודל אומן על נתוני רשת עולמיים עם מיקוד אגרסיבי בקוד, מתמטיקה ומדעים באנגלית, כך שביצועי השפה המקומית צפויים להיות מוגבלים ומלווים בשגיאות ניסוח.

מה ההבדל בין הקובץ הזה לגרסת ה־instruct?

הקובץ הזה הוא מודל הבסיס הנקי, שמיועד בעיקר למפתחים שרוצים לבצע אימון נוסף בעצמם. אם המטרה היא לקבל תשובות לשאלות, לבצע שיחה או להפעיל סוכן בתוך סביבת הפיתוח, הגרסה המותאמת להוראות תעשה עבודה טובה יותר.

איך מריצים

המשקלים הנוכחיים שמורים בדיוק מלא של float32 ושוקלים 31 גיגהבייט. כדי לטעון אותם כמו שהם בשרת פרטי, תצטרכו כרטיס מקצועי עם לפחות 40 עד 48 גיגהבייט של זיכרון גרפי, למשל A6000 או A100. אם תמירו את המודל לדיוק של 16 ביט או לגרסאות מכווצות של llama.cpp, אפשר להריץ אותו בקלות גם על כרטיסים ביתיים עם 16 גיגהבייט זיכרון או במחשב נייד.

המודל נתמך בספריות שרתים כמו vLLM ו־SGLang, וגם ב־transformers מגרסה 4.51.2 ואילך. למי שאין לו כרטיס גרפי מתאים ורוצה רק לבדוק ביצועים, המפרסמים הפנו לשירותי ענן כמו Together AI ו־OpenRouter שמספקים אליו גישה בתשלום לפי קריאה.

from transformers import pipeline

pipe = pipeline("text-generation", model="EssentialAI/rnj-1")
print(pipe("שלום"))

הרישיון

הקוד והמשקלים זמינים תחת רישיון Apache 2.0 המלא. מותר להשתמש בהם לצרכים מסחריים, לשנות את הארכיטקטורה, לאמן מודלים נגזרים ולשלב אותם בתוך תוכנות סגורות. התנאי המרכזי הוא שמירה על זכויות היוצרים המקוריות והצהרת השינויים שביצעתם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗