GPT
Q

Qwen3.6-35B-A3B-uncensored-heretic-APEX-GGUF

קוד פתוח

mudlerapache-2.02026-04-21

  • gguf
  • quantized
  • apex
  • moe
  • mixture-of-experts

גרסה מכווצת ומבוססת תערובת מומחים של קוון, שעברה הסרת צנזורה מלאה. היא פועלת עם שלושה מיליארד פרמטרים פעילים בלבד מתוך 35 מיליארד.

  • 137 GBמשקל הקבצים
  • 22,816הורדות בחודש
  • 74לייקים

מה זה

הבסיס כאן הוא מודל תערובת מומחים עם 35 מיליארד פרמטרים בסך הכול, אבל בכל טוקן פעילים רק כשלושה מיליארד, מה שנותן מהירות תגובה של מודל קטן עם מאגר ידע רחב בהרבה. הארכיטקטורה משלבת תשומת לב מלאה בכל שכבה רביעית לצד שכבות ליניאריות מסוג ממבה, וכוללת גם תמיכה בקלט תמונה בעזרת קובץ מקרן ייעודי של ג'יגה בייט אחד.

הייחוד בגרסאות האלו הוא שיטת הדחיסה שנקראת אייפקס. היא מזהה את התפקיד של כל משקולת, שומרת על דיוק גבוה בשכבות הקצוות וברכיבי המומחה המשותף, ודוחסת חזק יותר את המומחים הפנימיים שאינם מופעלים תמיד. גרסאות שמסומנות באות איי עברו כיול עם נתונים מגוונים של שיחה, קוד, חשיבה וקריאות לכלים, כך שהן אמורות לסבול מפחות ירידה באיכות לעומת דחיסה רגילה באותו נפח.

מתאים ל

  • ניתוח תמונות מקומי

    כולל קובץ מקרן ייעודי של ג'יגה בייט לפענוח תמונות בתוך הרשת הפנימית בלי להוציא מידע החוצה.

  • מערכות ללא סינון תוכן

    עבר כוונון ייעודי שמסיר את סירובי המודל הסטנדרטיים, מתאים למחקר אבטחה וכתיבה יוצרת חופשית.

  • שרת מקומי חסכוני במשאבים

    מפעיל רק שלושה מיליארד פרמטרים בכל שלב ומאפשר זמני תגובה מהירים גם על כרטיס מסך ביתי יחיד.

איפה זה נופל

המודל מוגדר כחסר צנזורה לחלוטין, מה שאומר שאין בו מנגנוני בטיחות מובנים מפני תוכן פוגעני, שגוי או זדוני, ואסור לשלב אותו בממשק שפונה למשתמשי קצה בלי שכבת סינון נפרדת שאתם בונים בעצמכם. בנוסף, הדחיסה החזקה בשכבות האמצע עלולה לייצר אי דיוקים במשימות שמסתמכות על ידע עובדתי דק או קוד מורכב, במיוחד בגרסת המיני שהוקרבה לטובת מהירות ונפח אחסון נמוך.

שאלות
נפוצות

מה ההבדל בין קובץ עם האות איי לקובץ רגיל באותו הגודל?

הקבצים עם התחילית איי מכוילים לפי מטריצת חשיבות שנבנתה מנתוני שיחה, קוד, היגיון וויקיפדיה. הם שומרים על דיוק גבוה יותר בשימושים האלה בלי להגדיל את נפח הקובץ בדיסק.

חייבים להוריד את קובץ התמונה כדי שהמודל יעבוד?

לא, קובץ המקרן נחוץ רק אם אתם שולחים למודל תמונות יחד עם הטקסט. לשימוש רגיל של שאלות, תשובות וכתיבת קוד מספיק להוריד רק את קובץ המודל שבחרתם.

איך מריצים

בשביל להריץ אותו צריך חומרה שמסוגלת להחזיק בין 14 ג'יגה בייט בגרסה הכי קטנה לבין 24 ג'יגה בייט בגרסה המאוזנת, בנוסף לזיכרון עבור קובץ התמונה אם משתמשים בו. כרטיס מסך ביתי יחיד עם 16 עד 24 ג'יגה בייט יספיק לרוב הגרסאות הקומפקטיות, ומי שמחזיק פחות מזה יצטרך לפצל שכבות לזיכרון המרכזי של המחשב ולספוג ירידה בקצב היצירה.

ההרצה מתבצעת ישירות דרך לוקאל איי איי בפקודת הרצה פשוטה שמצביעה על הקובץ הרצוי, או בכל סביבה שתומכת בפורמט ג'י ג'י יו אף כמו לאמה סי פי פי. אם אתם לא צריכים דווקא מודל ללא מגבלות סינון או שאין לכם כרטיס גרפי מתאים, עדיף להשתמש במודל ענן פשוט במקום לקנות חומרה ייעודית.

ollama run hf.co/mudler/Qwen3.6-35B-A3B-uncensored-heretic-APEX-GGUF:Qwen3.6-35B-A3B-uncensored-heretic-APEX-I-Compact

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא אפאצ'י שתיים אפס, שמאפשר שימוש מסחרי, שינוי קוד והפצה חופשית לכל מטרה. התנאי העיקרי הוא שמירה על הודעות זכויות היוצרים וציון הרישיון המקורי, כך שאפשר להטמיע את המשקולות במוצר שלכם בלי חובת פתיחת קוד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗