GPT
H

Huihui-gpt-oss-20b-BF16-abliterated

קוד פתוח

huihui-aiapache-2.02025-08-06

  • transformers
  • safetensors
  • gguf
  • gpt_oss
  • text-generation

גרסה נטולת סינונים של מודל פתוח בגודל 21 מיליארד פרמטרים. היא נועדה למי שצריך תשובות ישירות בלי סירובים מובנים, עם תמיכה בהקשר ארוך במיוחד.

  • 21Bפרמטרים
  • 131,072טוקנים בהקשר
  • 125 GBמשקל הקבצים
  • 12,359הורדות בחודש

מה זה

מדובר בעיבוד של מודל המקור unsloth/gpt-oss-20b-BF16, שעבר תהליך הסרת מנגנוני סירוב באמצעות שיטת abliteration. המטרה כאן היא לבטל את הנטייה המובנית של המודל לסרב לבקשות של משתמשים. הוא שומר על ארכיטקטורת 24 שכבות ותומך בחלון הקשר של 131,072 טוקנים, שמאפשר להזין מסמכים ארוכים או שיחות מתמשכות בלי לאבד מידע.

בניגוד למודלים סטנדרטיים בקטגוריית עשרים מיליארד הפרמטרים שכוללים שכבות יישור בטיחות כבדות, כאן הסינון הוסר ישירות ממשקולות המודל. הדף לא מציג מבחני ביצועים כמותיים או ציוני בנצ'מרק, כך שאי אפשר לדעת אם התהליך פגע ביכולות ההיגיון, הקידוד או איכות הטקסט הכללית בהשוואה למודל הבסיס.

היוצרים כבר שחררו גרסה שנייה לאותו מודל, מה שמעיד על כך שהגרסה הזו עשויה להיות בוסרית. היא מתאימה בעיקר למי שמחפש מודל פתוח שמגיב לכל קלט, אבל דורשת בדיקה עצמאית כדי לוודא שאיכות הפלט לא נשחקה.

מתאים ל

  • מחקר על מנגנוני בטיחות

    בדיקת ההשפעה של הסרת סירובים ברמת המשקולות על אופי הפלט וההזיות.

  • ניתוח טקסטים לא מצונזרים

    עיבוד מסמכים משפטיים או רפואיים שמודלים רגילים מסרבים לגעת בהם.

  • הרצה מקומית ב־Ollama

    הפעלת מודל פתוח לשימוש פנימי במחשב מקומי באמצעות קובץ מכווץ.

איפה זה נופל

ההסרה של מנגנוני הסירוב משאירה את המודל ללא הגנות בטיחות כלל, והיוצרים מציינים במפורש שהוא עלול לייצר תוכן פוגעני, רגיש או לא חוקי. הוא אינו מומלץ לשימוש ישיר מול לקוחות קצה או בסביבות ציבוריות ללא מנגנון סינון ובקרה חיצוני שאתם מקימים בעצמכם. בנוסף, חוסר במבחני ביצועים רשמיים מחייב אתכם לבדוק בעצמכם האם תהליך השינוי גרם להזיות או ירידה ביכולת הניתוח.

אותה משפחה

Huihui-gpt-oss-20b-BF16-abliterated יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים ליישום שפונה למשתמשי קצה?

לא ישירות מהקופסה. המודל עלול לפלוט תכנים בעייתיים ואין לו שום מנגנון ריסון פנימי, כך שחובה להוסיף שכבת סינון משלכם לפני שמציגים פלט למשתמשים.

כמה זיכרון צריך כדי להריץ אותו על המחשב?

קבצי המקור שוקלים 125 גיגה בייט ודורשים חומרה ארגונית כבדה. כדי להריץ אותו במחשב אישי עדיף להשתמש בגרסת ה־GGUF המכווצת ב־llama.cpp או ב־ollama.

איך מריצים

כדי להריץ את הגרסה המלאה בפורמט bfloat16 תצטרכו להוריד 125 גיגה בייט של קבצים, מה שדורש לפחות שני כרטיסי מסך חזקים כמו A100 או H100 רק כדי לטעון אותו לזיכרון ה־VRAM. ההרצה מתבצעת ישירות דרך ספריית transformers.

אם אין לכם שרת ייעודי, הדרך המעשית היא להשתמש בגרסת GGUF מכווצת דרך llama.cpp או באמצעות ollama בגרסה 0.11.8 ומעלה עם הפקודה ollama run huihui_ai/gpt-oss-abliterated. אם אתם צריכים רק גישה מהירה בלי לתחזק שרתים מקומיים כבדים, עדיף להשתמש ב־API מנוהל של מודלים דומים.

ollama run hf.co/huihui-ai/Huihui-gpt-oss-20b-BF16-abliterated:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של הקוד והמשקולות והפצה שלהם, כל עוד שומרים על הודעת זכויות היוצרים המקורית וכתב הוויתור. אתם יכולים לשלב אותו במוצר שלכם, אבל האחריות המשפטית על הפלטים חלה עליכם בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗