GPT
L

Llama3.3-8B-Instruct-Thinking-Heretic-Uncensored-Claude-4.5-Opus-High-Reasoning-i1-GGUF

קוד פתוח

mradermacherapache-2.02026-01-02

  • transformers
  • gguf
  • thinking
  • reasoning
  • instruct

גרסת כימות מקומית למודל קהילתי בגודל שמונה מיליארד פרמטרים, שמנסה לחקות חשיבה מעמיקה בלי חסימות תוכן. מי שבוחר בו מחפש הרצה זולה בלי מסננים ובלי תלות בשירותי ענן.

  • 87.4 GBמשקל הקבצים
  • 65,933הורדות בחודש
  • 82לייקים

מה זה

מדובר בהמרה לפורמט GGUF על בסיס כימות imatrix של מודל המקור מאת DavidAU. השם הארוך מרמז על כיוונון מיוחד שאמור לדמות סגנון חשיבה מורכב, כביכול בהשראת מודלים מתקדמים, אך בלי מעצורי הבטיחות והסינון הרגילים.

היוצר mradermacher ארז אותו בטווח רחב של משקלים, מקבצים שבורים לחלוטין של 2.1 גיגה ועד קבצים מלאים יחסית של 6.7 גיגה. המודל תומך רשמית בשמונה שפות ובהן אנגלית, צרפתית, גרמנית, ספרדית, איטלקית, פורטוגזית, סינית ויפנית. עברית לא מופיעה ברשימת השפות הנתמכות, ולכן פלט בעברית תקינה אינו מובטח.

מתאים ל

  • ניסויי שפה ללא סינון

    בדיקת תגובות של מודל פתוח בנושאים רגישים שלא עוברים במסננים מסחריים.

  • הרצה מקומית על חומרה צנועה

    עבודה במחשב אישי עם 8 גיגה זיכרון וידאו באמצעות גרסת כימות Q4_K_M.

  • פיתוח אוטומציות מקומי

    שילוב מודל חופשי בתוך סקריפטים מקומיים שאינם דורשים חיבור רשת חיצוני.

איפה זה נופל

כרטיס המודל לא מציג מבחני ביצועים, מדדים השוואתיים או הוכחות ליכולות החשיבה שהוא מבטיח בשם שלו. בנוסף, המפרסם מודה בהערות שהגרסאות הנמוכות, במיוחד IQ1 ו־Q2, סובלות מאיכות נמוכה מאוד, והן מתאימות רק למצבי ייאוש. העדר חסימות תוכן מציב סיכון ממשי לפלט פוגעני או שגוי, מה שהופך אותו ללא מתאים ליישומים ארגוניים ללא מעטפת בטיחות נפרדת.

שאלות
נפוצות

האם המודל באמת חושב כמו הדגמים הגדולים שמוזכרים בשם שלו?

השם כולל בעיקר מונחים שיווקיים של יוצר המיזוג המקורי. זהו מודל בגודל 8B בלבד, ואין לצפות ממנו לרמת הסקת מסקנות או אמינות של מודלי ענק מסחריים.

איזו גרסת כימות הכי כדאי להוריד למחשב אישי רגיל?

עדיף לבחור בגרסת Q4_K_M ששוקלת 5.0 גיגה ומספקת יחס מהירות ואיכות מיטבי. גרסאות קטנות מ־3 גיגה מוגדרות על ידי היוצר כבעלות איכות ירודה במיוחד.

איך מריצים

טוענים את קובץ ה־GGUF ישירות בכלים כמו llama.cpp, Ollama או LM Studio. הגרסה המומלצת ביותר לפי המפרסם היא Q4_K_M במשקל של 5.0 גיגה, שנותנת שילוב טוב של ביצועים ודיוק ודורשת כרטיס מסך בסיסי עם 6 עד 8 גיגה זיכרון וידאו. אם החומרה חלשה יותר, אפשר לרדת ל־Q4_K_S או ל־IQ3_M, אך עדיף להימנע מגרסאות IQ1 ו־IQ2 שמספקות פלט משובש.

אם יש לכם מחשב ללא כרטיס מסך ייעודי, או שאתם מחפשים אמינות גבוהה בלי בדיקות איכות עצמאיות, עדיף להשתמש ב־API של מודל מסחרי סטנדרטי במקום להתעסק עם הרצה מקומית.

ollama run hf.co/mradermacher/Llama3.3-8B-Instruct-Thinking-Heretic-Uncensored-Claude-4.5-Opus-High-Reasoning-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

27 קבצים במאגר, 87.4 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0. הרישיון מתיר שימוש מסחרי, שינוי קוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים וההצהרה המקורית. עם זאת, יש לזכור שמדובר בכימות של מיזוג מודלים, וכדאי לוודא שאין תנאים סותרים ברישיונות הבסיס של מודל המקור.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗