GPT
C

context-1

קוד פתוח

chromadbapache-2.02026-03-12

  • transformers
  • safetensors
  • gpt_oss
  • text-generation
  • conversational

מודל חיפוש של 21 מיליארד פרמטרים שמפרק שאלות מורכבות ומנקה לבד מסמכים מיותרים תוך כדי ריצה. הוא נועד לעבוד לצד מודל חשיבה מוביל כדי לחתוך עלויות וזמני שליפה.

  • 21Bפרמטרים
  • 131,072טוקנים בהקשר
  • 39.0 GBמשקל הקבצים
  • 698הורדות בחודש

מה זה

במקום לתת למודל ענק ויקר לסרוק מאגרי מידע, מריצים מודל ייעודי קטן יותר שמתמקד רק באיתור החומר. הוא מפרק שאלות עם כמה תנאים לתתי-שאילתות, מריץ בממוצע 2.56 קריאות לכלים בכל סיבוב וחוסך סבבי שיחה מיותרים. המבנה שלו מבוסס תערובת מומחים מעל gpt-oss-20b, עם אימון שכלל חיזוקים בשלבים.

החידוש המרכזי כאן הוא היכולת לחתוך מסמכים לא רלוונטיים מתוך ההקשר תוך כדי עבודה, בדיוק של 0.94. זה מונע סתימה של הזיכרון ומאפשר לו להמשיך לחקור שאלות עמוקות בלי לאבד את הידיים והרגליים. הוא אומן על משימות רשת, משפט וכספים, ונבדק על מבחנים כמו BrowseComp-Plus, SealQA, FRAMES ו־HLE.

מתאים ל

  • תת סוכן לשליפת מידע

    הוא מריץ חיפושים מקבילים עבור מודל חשיבה ראשי וחוסך זמן יקר.

  • מחקר משפטי ופיננסי

    אומן במיוחד על נתונים מורכבים עם שאלות שמחייבות כמה שלבי בדיקה.

  • חיפוש רב שלבי ברשת

    יודע לפרק שאילתה מסובכת לכמה חיפושים קטנים ולנפות תוצאות זבל.

איפה זה נופל

הבעיה המרכזית כרגע היא שלבד הוא חצי כוח. המפתחים מודים בפירוש שהמודל אומן לעבוד בתוך מעטפת סוכן שמנהלת את הכלים, תקציב הטוקנים, הניקוי והסרת הכפילויות, והמעטפת הזו עדיין לא פתוחה לציבור. בלי המערכת הזו, לא תקבלו את הביצועים שמופיעים בדוח הטכני. מי שמתכנן לשלב אותו עכשיו יצטרך לבנות את כל לוגיקת הניהול בעצמו לפי הדוח, או לחכות שהם ישחררו את הקוד.

שאלות
נפוצות

אפשר להוריד אותו ולהשתמש בו ישר כמו שהוא?

טכנית כן, אבל לא תקבלו את התוצאות מהניירות שלהם. המודל דורש מעטפת ניהול חיצונית לתפעול הכלים ולניקוי ההקשר, והקוד שלה עדיין לא פורסם.

במה הוא שונה מסתם מודל חיפוש רגיל?

הוא מנקה מתוך ההקשר שלו מסמכים שלא הועילו בדיוק של 0.94 ומבצע מעל שתי קריאות במקביל בכל סיבוב כדי לסיים את העבודה מהר יותר.

איך מריצים

המשקל עומד על 39.0 גיגה-בייט בפורמט BF16, כך שצריך כרטיס גרפי עם מספיק זיכרון כדי לטעון אותו דרך transformers. המפתחים הבטיחו גרסה מכווצת בפורמט MXFP4, אבל כרגע זו הגרסה היחידה שיש.

אם אין לכם תשתית חומרה מתאימה להחזיק מודל כזה מקומית, עדיף להמתין לשירות ענן שמנגיש אותו. להריץ אותו סתם כך על שרת בלי כרטיס מתאים יעלה לכם בביצועים איטיים מאוד.

from transformers import pipeline

pipe = pipeline("text-generation", model="chromadb/context-1")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 מלא. אפשר להשתמש בו לצרכים מסחריים, לשנות אותו, להטמיע במוצרים סגורים ולהפיץ הלאה. התנאי היחיד הוא שמירה על זכויות היוצרים והודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗