GPT
G

ggml-org/gpt-oss-20b-GGUF

קוד פתוח

ggml-orgapache-2.02025-08-02

  • gguf
  • quantized
  • text-generation
  • endpoints_compatible
  • conversational

גרסת GGUF מוכנה לשימוש מקומי שמבוססת על מודל פתוח של עשרים מיליארד פרמטרים. היא מתאימה למי שרוצה להריץ מודל סביר בלי להסתבך עם המרות ידניות.

  • 13.7 GBמשקל הקבצים
  • 162,640הורדות בחודש
  • 177לייקים

מה זה

מדובר בהמרה אוטומטית שביצעו בצוות של ggml לקבצי GGUF, כשהמקור נשען על המודל הפתוח של עשרים מיליארד פרמטרים ועל מודל ספקולציה של רד האט להאצת ביצועים. המטרה כאן היא לייצר מודל שרץ ישירות דרך llama.cpp או כלים תואמים, בלי צורך להתעסק בהמרות של משקלים מקוריים.

דף המודל דל מאוד ולא כולל מבחני ביצועים, מדדים או פירוט על יכולות ספציפיות כמו תכנות או תמיכה בשפות. כל מה שיש הוא מיפוי למודל המקור והכנה לעבודה מקומית, כך שצריך לבדוק בפועל איך הוא מתמודד עם המשימות שלכם מול מודלים אחרים במשקל הזה.

מתאים ל

  • עבודה מקומית ואופליין

    הרצה מקומית מלאה במחשב או בשרת פנימי בלי להוציא שום נתון לרשת חיצונית.

  • שילוב בכלי llama.cpp

    שימוש ישיר בכלים תומכי GGUF בלי צורך לבצע המרות קבצים בעצמכם.

  • ניסויי שילוב ספקולציה

    בדיקת המודל יחד עם מודל הספקולציה של רד האט לשיפור מהירות התגובה.

איפה זה נופל

הכרטיס מודה במפורש שאין בו מידע, עם סימון להוסיף פרטים בעתיד. אין שום תיעוד על נתוני אימון, תמיכה בעברית, מגבלות בטיחות או שגיאות נפוצות. מעבר לכך שמדובר בהמרה אוטומטית שעלולה לגרור בעיות דיוק, תצטרכו לבדוק בעצמכם כל פלט לפני שתחשבו לשלב אותו במערכת אמיתית.

אותה משפחה

gpt-oss יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית ברמה טובה?

אין בתיעוד שום התייחסות לתמיכה בשפות מלבד אנגלית. תצטרכו להוריד את המשקלים ולבדוק ישירות את איכות הפלט בעברית לפני שתבנו עליו.

איך מריצים את הקבצים בפועל?

מריצים את הפקודה llama serve ישירות מול שם המאגר דרך כלי llama.app או התקנה מקומית תואמת של llama.cpp.

איך מריצים

המשקל הכולל של הקבצים עומד על 13.7 גיגה בייט, מה שאומר שתצטרכו כרטיס מסך עם לפחות שישה עשר גיגה זיכרון כדי לטעון אותו במלואו, או מעבד חזק ומספיק זיכרון ראם אם אתם מתכוונים לרוץ על המעבד בלבד. פקודת ההרצה שהם מספקים פשוטה ומשתמשת ב־llama serve ישירות מול המאגר.

אם אין לכם חומרה מקומית מתאימה או שאתם מחפשים מענה מהיר בלי לנהל שרתים וזיכרון, פנייה ל־API חיצוני של מודל קיים תהיה זולה ופשוטה יותר מלהחזיק מכונה ייעודית בשביל עשרים מיליארד פרמטרים.

ollama run hf.co/ggml-org/gpt-oss-20b-GGUF:Q8_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

7 קבצים במאגר, 13.7 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא אפאצ'י שתיים אפס. הוא מתיר שימוש מסחרי, שינוי והפצה של הקבצים כמעט בלי מגבלות, בתנאי ששומרים על הודעת הרישיון המקורית ומציינים שינויים אם נעשו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗