GPT
G

lmstudio-community/gpt-oss-20b-GGUF

קוד פתוח

lmstudio-communityapache-2.02025-08-05

  • gguf
  • endpoints_compatible
  • conversational

גרסת קוונטיזציה של מודל קוד פתוח עם עשרים מיליארד פרמטרים שמתאימה להרצה מקומית. היא שוקלת קצת מעל 11 גיגה בייט ומיועדת למי שרוצה ביצועים בלי להרים שרת ענק.

  • 11.3 GBמשקל הקבצים
  • 134,839הורדות בחודש
  • 86לייקים

מה זה

מדובר בהמרה לפורמט GGUF של מודל עשרים מיליארד פרמטרים מבית OpenAI, שבוצעה באמצעות llama.cpp עבור קהילת LM Studio. המטרה כאן היא לקחת משקלים כבדים ולדחוס אותם לקבצים בגודל כולל של 11.3 גיגה בייט, כך שיהיה אפשר לטעון אותם במחשב מקומי בלי להסתמך על שירותי ענן חיצוניים.

בכרטיס המודל אין פירוט של מבחני ביצועים, בנצ'מרקים או נתונים על יכולות שפה ספציפיות, כך שאי אפשר להסיק ממנו איך הוא מתמודד עם משימות מורכבות או מה רמת התמיכה שלו בעברית. מה שברור הוא שהגודל הזה יושב בנקודת אמצע, הוא כבד משמעותית ממודלים קטנים של שבעה או שמונה מיליארד פרמטרים, אבל עדיין נכנס בחומרה ביתית סבירה.

מתאים ל

  • פיתוח ובדיקות מקומיות

    מאפשר לעבוד על סביבת פיתוח מקומית בלי לחבר שרתים חיצוניים לרשת ובלי לשלם לפי קריאות.

  • עבודה ללא חיבור רשת

    מתאים למערכות פנימיות שחייבות להישאר סגורות לחלוטין משיקולי אבטחת מידע ופרטיות.

  • ניסויי קוד בתוך LM Studio

    נטען ישירות בתוכנה ומאפשר לבדוק פרומפטים והתנהגות של מודל בינוני בצורה מהירה.

איפה זה נופל

יוצרי ההמרה לא פרסמו שום מידע על נתוני האימון, המגבלות הטכניות או גודל חלון ההקשר. בנוסף, יש פה כתב ויתור מפורש שמזהיר מפני תוכן מטעה, שגוי או פוגעני, בלי שום התחייבות לדיוק התוצאות. לפני שמשלבים אותו במערכת פעילה, חובה לבדוק אותו עצמאית מול מקרי הקצה שלכם, במיוחד אם אתם בונים על דיוק בעברית או על הבנת פקודות מורכבות.

אותה משפחה

gpt-oss יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזה מחשב צריך בשביל להריץ אותו בלי להיתקע?

הקבצים שוקלים 11.3 גיגה בייט, לכן צריך כרטיס מסך עם 16 גיגה זיכרון לפחות כדי להריץ אותו חלק. אפשר להריץ אותו גם על זיכרון ראשי של מחשב חזק עם מעבד רגיל, אבל קצב ייצור המילים יהיה אטי משמעותית.

האם המודל הזה מתאים לשימוש מסחרי בתוך מוצר?

כן, הרישיון שלו הוא אפאצ'י שתיים, שמתיר שימוש מסחרי, שינויים והפצה חופשית. עם זאת, אין עליו שום אחריות לדיוק התוצאות, ולכן תצטרכו לוודא בעצמכם שהפלט עומד בדרישות המוצר שלכם.

איך מריצים

בשביל להריץ אותו בצורה מקומית צריך סביבה שתומכת בפורמט GGUF כמו LM Studio או llama.cpp ישירות. המשקל הכולל עומד על 11.3 גיגה בייט המחולקים לשלושה קבצים, מה שאומר שתצטרכו כרטיס מסך עם לפחות 16 גיגה זיכרון כדי להריץ הכל על המעבד הגרפי, או לחלופין שילוב של זיכרון מערכת ומעבד רגיל שיעבוד לאט יותר.

אם אין לכם חומרה ייעודית עם מספיק זיכרון וידאו פנוי, זמן התגובה עלול לזחול. במקרים שבהם אתם בונים שירות שדורש מהירות גבוהה להרבה משתמשים במקביל ולא רוצים לנהל שרתים פיזיים, עדיף להשתמש בנקודות קצה מנוהלות של ספקים חיצוניים.

ollama run hf.co/lmstudio-community/gpt-oss-20b-GGUF:gpt-oss-20b-MXFP4

הקבצים

3 קבצים במאגר, 11.3 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא apache-2.0, וזה אומר חופש פעולה כמעט מלא. אתם יכולים להשתמש בו במוצרים מסחריים, לשנות אותו, לשלב אותו בקוד שלכם ולהפיץ אותו הלאה, כל עוד אתם שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗