GPT
N

NeoHorse-1-9B

קוד פתוח

TokenRhythmapache-2.02026-09-05

  • transformers
  • safetensors
  • qwen3_5_text
  • text-generation
  • agentic

גרסה ממוקדת סוכנים וקריאות לכלים שנבנתה על בסיס קוון, ומיועדת למי שמחפש מודל קומפקטי שמסוגל לרוץ מקומית עם חלון הקשר עצום.

  • 9Bפרמטרים
  • 262,144טוקנים בהקשר
  • 16.7 GBמשקל הקבצים
  • 1,250הורדות בחודש

מה זה

מדובר בכוונון ייעודי של Qwen3.5-9B שביצעו TokenRhythm, במטרה לשפר יכולות עבודה כסוכן אוטונומי, קריאה לכלים וכתיבת קוד. המפתחים ארזו את המשקלים מחדש עבור טקסט בלבד וללא רכיבי הראייה שהיו במודל המקור, כך שהוא מיועד אך ורק לעיבוד והפקת טקסט.

במדדים המוצגים, המודל עוקף את מודל הבסיס ורושם ממוצע של 69.04 מול 65.60 בעשרה מבחנים. השיפור הבולט מגיע בעיקר ממשימות סוכנים ושימוש בכלים, כמו קפיצה של 11 נקודות ב־VitaBench ועלייה של כמעט 8 נקודות ב־PinchBench, מה שמעיד על עבודה מדויקת יותר מול ממשקים חיצוניים ופונקציות. לעומת זאת, במבחני מעקב אחרי הוראות דוגמת IFBench ו־IFEval הוא שומר על אותה רמה של מודל הבסיס ואף רושם ירידה שולית.

מתאים ל

  • סוכני אוטומציה מבוססי כלים

    מציג שיפור עקבי במבחני PinchBench ו־BFCL v4 לעבודה מול ממשקים חיצוניים.

  • עיבוד מסמכים באורך קיצוני

    תומך בחלון בסיס של 262,144 טוקנים ומאפשר לנתח קבצים שלמים מקומית.

  • מערכות תסריט עצמאיות בקוד

    משיג ציון 98.17 ב־HumanEval ומציע יכולת יצירת פונקציות ברמה טובה למודל 9B.

איפה זה נופל

המודל מוגבל לטקסט בלבד, כי משקלי הראייה של מודל הבסיס הוסרו לחלוטין. בנוסף, למרות המאמץ סביב אימון סוכנים, במבחן LiveCodeBench v6 הוא קיבל 65.14 בדיוק כמו מודל המקור, כך שאין כאן שיפור ביכולות תכנות מורכבות בעולם האמיתי. תחום ההוראות המורכבות אפילו נחלש מעט, עם ציון 89.09 ב־IFEval מול 89.46 בבסיס.

אותה משפחה

NeoHorse-1 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להעביר למודל הזה תמונות כמו בקוון המקורי?

לא. משקלי הראייה הוסרו לגמרי במהלך האריזה מחדש, והוא מוגדר לקבל ולהחזיר טקסט בלבד.

איך הכי מומלץ להרים אותו מקומית לקריאות פונקציות?

הכרטיס מדגים הרצה עם vLLM או SGLang באמצעות פרסר qwen3_coder לכלי עבודה, מה שמייצר ממשק תואם OpenAI ישירות מהקופסה.

איך מריצים

כדי להריץ אותו ישירות מתוך קבצי ה־Safetensors בנפח 16.7 גיגה בייט, תצטרכו כרטיס מסך עם לפחות 24 גיגה בייט זיכרון כדי לטעון אותו בפורמט BF16 המקורי. מי שמכוון לנצל את מלוא חלון ההקשר המובנה של 262,144 טוקנים יצטרך הרבה יותר זיכרון עבור ה־KV Cache, או לחלופין לקצץ את אורך ההקשר בהגדרות ההרצה.

ההפעלה המקומית נתמכת ישירות דרך מנועים כמו SGLang או vLLM עם פרסרים ייעודיים לחשיבה ולקריאות כלים של qwen3. אם אין לכם חומרה ייעודית שתחזיק את ההקשרים הארוכים האלה בזמן אמת, עדיף להמתין לשירותי ענן שיציעו גישה מנוהלת במקום להשקיע בשרת מקומי כבד.

from transformers import pipeline

pipe = pipeline("text-generation", model="TokenRhythm/NeoHorse-1-9B")
print(pipe("שלום"))

הרישיון

הפרויקט מופץ ברישיון Apache-2.0. זהו רישיון פתוח ומתירני שמאפשר שימוש מסחרי, שינוי הקוד והמשקלים והפצה במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗