GPT
G

gpt-oss-120b-Fable-5-Distilled

קוד פתוח

cloudyuרישיון לא דווח2026-06-14

  • mlx
  • safetensors
  • gpt_oss
  • lora
  • muon

המודל מביא התנהגות של סוכן פיתוח ישירות למחשבי מק חזקים. הוא מבוסס על סשנים של קלוד קוד ומספק קריאות כלים וחשיבה מובנית בלי תלות בענן.

  • 117Bפרמטרים
  • 131,072טוקנים בהקשר
  • 59.1 GBמשקל הקבצים
  • 2,326הורדות בחודש

מה זה

מדובר במודל מומחים של מאה ועשרים מיליארד פרמטרים שרץ על ספריית MLX במחשבי אפל, אחרי כוונון עדין על שלוש מאות חמישים ושתיים דוגמאות מתוך קלוד קוד. הוא מאומן לעבוד בפרוטוקול ערוצים מוגדר, שבו הוא קודם מנתח את הבעיה בערוץ פנימי ורק אז פולט פקודות גיט, קריאת קבצים, עריכות קוד או פקודות באש בערוץ הסופי.

בבדיקות של יוצרי המודל הוא הגיע לציון של 99.39 אחוזים בבנצ'מרק של היומן אוואל בגרסת חמישה ביט, לעומת 83.54 אחוזים בלבד של מודל הבסיס. הוא עבר שלוש עשרה מתוך שלוש עשרה משימות קשות במבחן מותאם אישית שכלל אלגוריתמים, מתמטיקה וסימולציות מדעיות, בקצב ריצה מקומי של 12 עד 16 טוקנים לשנייה.

מתאים ל

  • סוכן בדיקות ועריכת קוד מקומי

    מאומן על רצפי פקודות של באש, גיט ועריכה ישירה על קבצים מקומיים.

  • פתרון בעיות אלגוריתמיות

    עבר בהצלחה מלאה משימות חישוב מדעי, מבני נתונים מתקדמים וחידות לוגיקה.

  • עבודה מנותקת מרשת

    רץ ישירות על מעבדי אפל בלי לשלוח שורות קוד קנייניות לשרתים חיצוניים.

איפה זה נופל

המודל אומן במשך ארבעים צעדים בלבד ועל מאגר קטן של 352 תורות שיחה. זה מעט מאוד חומר, והוא לא עבר שום תהליך של התאמת בטיחות או למידה ממשוב אנושי. בנוסף, הוא מוגבל לאנגלית, וחובה להשתמש במבנה הפרומפט הספציפי שלו שכולל ערוצי ניתוח ותוצאה. אם תשלחו לו פרומפט רגיל בפורמט צ'אט מקובל, התוצאות ייפגעו קשות.

שאלות
נפוצות

האם אפשר להריץ אותו על כרטיס של אנבידיה עם לינוקס?

הקבצים כאן בנויים רק לספריית MLX של אפל ולא יעבדו עם קודה. מי שרוצה להריץ על חומרה אחרת יצטרך לפנות לגרסת ה־GGUF שהומרה בנפרד.

למה חייבים להשתמש בטמפרטורה גבוהה של 0.95?

היוצרים מסבירים שהאימון כלל מעברים חדים בין חשיבה פנימית, קריאה לכלים ויצירת קוד. ערך נמוך מדי פוגע במעברים האלה ומשבש את פעולת הסוכן.

איך מריצים

כדי להריץ אותו צריך מחשב מק עם מעבד מסדרת אם ולפחות שישים וארבעה או מאה עשרים ושמונה גיגה זיכרון מאוחד. המודל שוקל 59.1 גיגה בקבצי MLX ודורש כשישים ותשעה גיגה זיכרון בזמן ריצה, כך שמחשבים סטנדרטיים של שישה עשר או שלושים ושניים גיגה פשוט לא יעלו אותו. הרצה מתבצעת ישירות דרך חבילת mlx_lm בשורת הפקודה או בסקריפט פייתון עם טמפרטורה מומלצת של 0.95.

אם אין לכם חומרת מק ייעודית כזו, תצטרכו להשתמש בגרסת ה־GGUF שנוצרה בנפרד למערכות אחרות. אם המטרה היא להריץ סוכן קוד בעומס גבוה בלי להחזיק תחנת עבודה יקרה וייעודית שפועלת ברציפות, קריאה ישירה לענן עדיפה על הרצה עצמית.

pip install -U huggingface_hub
hf download cloudyu/gpt-oss-120b-Fable-5-Distilled

הרישיון

ליוצר אין דיווח על רישיון שימוש בעמוד המודל. במצב כזה אין אישור מפורש להפיץ את המשקלים, להטמיע אותם במוצר מסחרי או להשתמש בהם מעבר לניסויים ומחקר פרטי. אם אתם בונים שירות ללקוחות, שימוש במודל ללא רישיון מוגדר יוצר סיכון משפטי ברור.

הרישיון המלא בעמוד המודל ↗