GPT
R

rnj-1-instruct

קוד פתוח

EssentialAIapache-2.02025-12-04

  • transformers
  • safetensors
  • gemma3_text
  • text-generation
  • conversational

מודל קוד וחישוב צפוף בגודל 8.3B פרמטרים, שבנוי על ארכיטקטורת Gemma 3. הוא מיועד למי שמחפש יכולות תכנות, פתרון בעיות במתמטיקה והפעלת כלים בסביבות סוכנים עצמאיות.

  • 8.3Bפרמטרים
  • 32,768טוקנים בהקשר
  • 31.0 GBמשקל הקבצים
  • 2,418הורדות בחודש

מה זה

המודל אומן מאפס על 8.4 טריליון טוקנים עם מיקוד אגרסיבי במיוחד במדעים, מתמטיקה וקוד. במקום לנסות להיות צ'אטבוט כללי לשיחות חולין, הוא מכוון ישירות למשימות של מהנדסי תוכנה, כולל תמיכה בהשלמת קוד באמצע קובץ והרצת פקודות מערכת בסביבות פיתוח.

התוצאות שלו מציבות אותו כמתחרה ישיר למודלים פתוחים מקבילים ואף לגדולים ממנו בהנדסת תוכנה. במבחן SWE-bench Verified בסביבת bash בלבד הוא קיבל ציון של 20.8%, שגובר על מודלים כמו Qwen2.5-Coder 32B Instruct. הוא מציג יכולת חזקה גם בקריאה לכלים דרך תקן Hermes ובאופטימיזציה של ביצועי קוד מול פרופיילר.

מתאים ל

  • סוכן תיקון קוד במאגרים

    הוא משיג 20.8% ב־SWE-bench בתוך סביבות bash ומתמחה בפתרון בעיות אמיתיות מתוך Pull Requests.

  • השלמת קוד ועריכה באמצע קובץ

    אימון ייעודי על FIM מביא אותו לתוצאה של מעל 86% בדיוק השלמות בתוך עורכי קוד.

  • סוכן להרצת כלים ואוטומציה

    תומך בפורמט קריאות Hermes ומצטיין בהפעלת פונקציות ופקודות מעטפת ברצף לוגי.

איפה זה נופל

זה לא מודל לשליפת עובדות כלליות. המפתחים מציינים במפורש שהוא נוטה להזיות כבדות בידע כללי, לא מכיר את תאריך סגירת המידע שלו, ולפעמים אפילו מתבלבל בזהות שלו וחושב שהוא מודל של חברה אחרת. בנוסף, למודל יש דחף כפייתי לפלוט קוד גם כששואלים אותו שאלות פרוזה רגילות, ואם תשכחו להגדיר לו פרומפט מערכת או שתריצו אותו בטמפרטורה שמעל 0.2, אתם תיתקלו בתשובות קטועות ובשורות קוד לא קשורות. אם תרחיבו אותו מ־32 אלף ל־128 אלף טוקנים בעזרת YaRN, הביצועים שלו במבחני מדע וביצועי קוד כמו Enamel יחטפו פגיעה ישירה.

אותה משפחה

rnj-1 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

למה המודל עונה לי בקוד כשרציתי תשובה טקסטואלית רגילה?

הוא אומן באופן מובהק על קוד ומפתח נטייה לכתוב פונקציות כמעט לכל בעיה. כדי למנוע את זה, חובה לשלוח תמיד System Prompt שמגדיר לו תפקיד כללי ולהחזיק את הטמפרטורה בטווח שבין 0 ל־0.2.

איך מרחיבים את חלון ההקשר מעבר ל־32 אלף טוקנים?

הכרטיס מאפשר לשנות בהגדרות ה־RoPE של קובץ התצורה לשיטת YaRN עם פקטור 16 כדי להגיע ל־128 אלף טוקנים. הביצועים במתמטיקה וקוד בסיסי נשמרים, אבל קחו בחשבון נפילה מסוימת במבחני ביצועי תוכנה ומדע.

איך מריצים

המשקל המקורי מגיע בפורמט float32 ותופס 31 גיגה-בייט, שזה נפח כבד להרצה מקומית בלי כרטיס מקצועי של 40 או 80 גיגה זיכרון. בפועל, מריצים אותו דרך vLLM או SGLang על שרת, או מורידים את גרסת ה־GGUF המכווצת שלו דרך llama.cpp למחשב נייד.

אם אין לכם כרטיס מתאים לפרוס עליו את המשקלים או שאתם רק בודקים את ההתנהגות שלו בסביבת Cline או סוכנים, אפשר לגשת אליו ישירות דרך נקודות הקצה של Together.AI או OpenRouter בלי לתחזק שרת.

from transformers import pipeline

pipe = pipeline("text-generation", model="EssentialAI/rnj-1-instruct")
print(pipe("שלום"))

הרישיון

הקוד והמשקלים שוחררו ברישיון Apache 2.0 מלא. אפשר להשתמש בו לצרכים מסחריים, להטמיע אותו בתוך מוצרים, לשנות אותו, לבצע לו אימון המשך ולהפיץ אותו חופשי, בלי תמלוגים או דרישות לפתוח את הקוד שלכם, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗