GPT
O

OpenAI-gpt-oss-20B-Claude-4.5-Opus-Heretic-Uncensored-i1-GGUF

קוד פתוח

mradermacherapache-2.02026-02-12

  • transformers
  • gguf
  • finetune
  • unsloth
  • instruct

גרסת כימות מקומית למודל שמתיימר להסיר חסימות תוכן לחלוטין. הוא פונה למי שמחפש הרצה פרטית בלי מסנני בטיחות תאגידיים ובלי תלות ברשת.

  • 285 GBמשקל הקבצים
  • 8,742הורדות בחודש
  • 47לייקים

מה זה

מדובר במארז קובצי כימות בשיטת imatrix שיצר mradermacher על בסיס מודל מקור של DavidAU. השם המורכב מרמז על שילוב סגנונות ומשקלים מבוססי קוד פתוח של עשרים מיליארד פרמטרים, כשהמטרה המוצהרת היא התנהגות לא מצונזרת שאינה מסרבת להוראות.

בניגוד לגרסאות סטטיות רגילות, הכימות כאן משתמש במטריצת חשיבות כדי למזער את אובדן הדיוק במעבר למספרים קטנים. בפועל, המפרסם מציע מגוון רחב של רמות דחיסה, החל מפורמטים זעירים מסוג IQ ועד לגרסאות כבדות יותר, כדי לאפשר גמישות בין צריכת זיכרון לאיכות הטקסט.

הכרטיס לא מציג מבחני ביצועים השוואתיים או ציונים רשמיים, אלא מסתמך על תרשים כללי של ikawrakow שמציג את היחס בין רמות הדחיסה השונות. המשמעות היא שאת רמת ההבנה, העקביות והיכולת הלשונית בפועל תצטרכו לבחון בעצמכם על משימות ספציפיות.

מתאים ל

  • מחקר על מודלים לא מצונזרים

    בדיקת תגובות של מודל עשרים מיליארד פרמטרים ללא שכבות סינון תאגידיות בסביבה מבודדת.

  • ניסויי כימות מקומיים

    השוואת ביצועים בין שיטות דחיסה שונות של imatrix מול זיכרון מוגבל במחשב מקומי.

  • ייצור טקסט באנגלית ללא רשת

    הרצה מקומית מלאה על גבי חומרת קצה לצורך פרטיות מוחלטת ללא תלות בשרת חיצוני.

איפה זה נופל

היוצר עצמו מסמן את גרסאות ה־IQ1 כפתרון לנואשים בלבד, ואת Q2_K_S כבעלת איכות נמוכה מאוד, כך שירידה אל מתחת לרמת ארבעה ביט פוגעת קשות בתוצאות. בנוסף, חוסר הצנזורה מוריד כל מנגנון הגנה, כך שהמודל עשוי לייצר מידע שגוי, רעיל או פוגעני ללא התרעה. מעבר לכך, אין תיעוד לגבי תמיכה בשפות אחרות מלבד אנגלית, ואין נתוני דיוק ספציפיים על ארכיטקטורת הבסיס.

שאלות
נפוצות

איזו גרסת קובץ כדאי להוריד לשימוש ראשוני?

ההמלצה בכרטיס המודל היא לבחור בגרסת i1-Q4_K_M במשקל של 15.9 גיגהבייט. היא מציעה איזון טוב בין מהירות לאיכות, בעוד שגרסאות ה־IQ הנמוכות יותר מיועדות רק למי שמוגבל מאוד במקום ומוכן לספוג ירידה חדה באיכות.

האם המודל תומך בעברית?

התיעוד מציין תמיכה בשפה האנגלית בלבד. מודלים מסוג זה עשויים לייצר עברית משובשת או מקוטעת, ולכן לא מומלץ להסתמך עליו למשימות בשפה העברית בלי לבדוק אותו מראש.

איך מריצים

המשקל הכולל של כלל הקבצים מגיע ל־285 גיגהבייט, אבל מורידים רק קובץ בודד. הקבצים מתחילים ב־12.1 גיגהבייט עבור גרסאות IQ1 קיצוניות ומגיעים עד 22.3 גיגהבייט עבור Q6_K. לשימוש מאוזן, היוצר ממליץ על Q4_K_M במשקל 15.9 גיגהבייט, שדורש מעבד גרפי עם מספיק זיכרון כדי להחזיק את המודל בשלמותו.

מריצים אותו בכל כלי שתומך בקובצי GGUF, כמו llama.cpp או סביבות תואמות, תוך טעינת המשקל המתאים לחומרה שלכם. אם אין לכם כרטיס מסך עם לפחות שישה עשר עד עשרים וארבעה גיגהבייט זיכרון פנוי, או אם אין לכם צורך מובהק בריצה מקומית ופרטית לחלוטין, עדיף להשתמש ב־API חיצוני של מודל קיים.

ollama run hf.co/mradermacher/OpenAI-gpt-oss-20B-Claude-4.5-Opus-Heretic-Uncensored-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

26 קבצים במאגר, 285 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי והפצה, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. לפני שילוב במוצר, כדאי לוודא שנתוני האימון ומודל המקור שעליו התבסס הפיתוח אינם כוללים מגבלות נוספות מעבר לרישיון המוצהר כאן.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗