GPT
Q

Qwen3.5-9B-Claude-4.6-HighIQ-INSTRUCT-HERETIC-UNCENSORED-GGUF

קוד פתוח

mradermacherapache-2.02026-03-04

  • transformers
  • gguf
  • fine tune
  • creative
  • creative writing

גרסת GGUF מכווצת של מודל 9B שעבר כוונון ללא צנזורה בהשראת קלוד. מתאימה למי שרוצה להריץ מקומית הוראות מורכבות בלי סינונים תאגידיים.

  • 76.9 GBמשקל הקבצים
  • 7,569הורדות בחודש
  • 50לייקים

מה זה

המאגר מציע המרות סטטיות בפורמט GGUF למודל הבסיס של DavidAU, שמשלב את ארכיטקטורת Qwen עם כוונון הוראות שנועד לדמות חשיבה בסגנון קלוד, לצד הסרה מוחלטת של מנגנוני הסירוב הרגילים. השילוב הזה מכוון לביצוע משימות ניתוח וכתיבה מורכבות יחסית לגודל של תשעה מיליארד פרמטרים, בלי שהמודל יטיף מוסר או יחסום בקשות יוצאות דופן.

ההבדל העיקרי מול מודלים רגילים באותו סדר גודל הוא הסרת המגבלות והשילוב עם רכיבי ראייה מולטימודליים שנכללים בחבילה, דרך קובצי mmproj ייעודיים. התמיכה הלשונית המוצהרת מתמקדת באנגלית ובסינית, כך שמי שבונה על עברית שוטפת ברמת ניסוח גבוהה יגלה כנראה קושי בתחביר או באוצר המילים בלי הרחבה מתאימה.

מתאים ל

  • מחקר תוכן ללא הגבלות

    מאפשר בדיקת תרחישי קצה וניתוח טקסטים רגישים שמערכות מסחריות רגילות נוטות לסרב לעבד או לצנזר.

  • הרצה מקומית במחשב אישי

    קבצי Q4 נכנסים בזיכרון של כרטיסי מסך סטנדרטיים ומספקים זמני תגובה מהירים בלי תלות ברשת.

  • עיבוד משולב טקסט ותמונה

    כולל קובצי mmproj נלווים שמתחברים למנועי הרצה פנימיים כדי לנתח תמונות לצד קלט טקסטואלי.

איפה זה נופל

השם המפורש מעיד על הסרת צנזורה, מה שאומר שהמודל מייצר תשובות ללא מסנני בטיחות או הגנות תוכן. אסור לחבר אותו לממשק משתמש קצה בלי מעטפת סינון עצמאית משלכם. בנוסף, מודל של תשעה מיליארד פרמטרים עדיין מוגבל ביכולות ההיגיון שלו בהשוואה למודלי ענק, והוא נוטה להזיות בעובדות מורכבות. המפרסם מציין במפורש שגרסאות כמו Q3_K_M מספקות איכות ירודה, והתמיכה בשפות שאינן אנגלית או סינית לא נבדקה ולא מובטחת.

שאלות
נפוצות

איזו גרסת קובץ הכי מתאימה לשימוש יומיומי?

עבור רוב האנשים, קובץ Q4_K_M במשקל 5.7 גיגה בייט הוא הבחירה הנכונה. הוא רץ מהר, צורך מעט זיכרון ושומר על דיוק גבוה מאוד לעומת המודל המקורי. המפרסם עצמו מגדיר אותו ואת Q4_K_S כאופציות המומלצות.

האם המודל יבין הוראות בעברית?

ההגדרות הרשמיות מציינות תמיכה באנגלית ובסינית בלבד. המודל עשוי להחזיר מילים בעברית בזכות הידע הכללי של מודל הבסיס, אך לא מומלץ להסתמך עליו למשימות ניסוח או הבנה מקומית בלי בדיקה יסודית מראש.

איך מריצים

טוענים קובץ GGUF ישירות דרך llama.cpp או סביבות תואמות. המשקלים נעים בין 3.7 גיגה בייט בגרסת Q2_K המצומצמת ועד 18 גיגה בייט בגרסת f16 המלאה. אם יש לכם כרטיס מסך עם שמונה גיגה זיכרון, גרסאות Q4_K_M במשקל 5.7 גיגה בייט או Q4_K_S במשקל 5.4 גיגה בייט יכנסו בקלות לזיכרון הגרפי ויתנו יחס מהירות ודיוק מצוין, כפי שממליץ המפרסם.

למי שיש כרטיס חזק יותר עם 12 או 16 גיגה זיכרון וידאו, אפשר לעלות לגרסת Q8_0 ששוקלת 9.6 גיגה בייט ומציעה איכות מקסימלית בלי פשרות דחיסה. אם אתם עובדים רק על מעבד מרכזי בלי מאיץ גרפי, עדיף להשתמש במודל ענן זול דרך API כי קצב הפקת הטוקנים עלול לתסכל.

ollama run hf.co/mradermacher/Qwen3.5-9B-Claude-4.6-HighIQ-INSTRUCT-HERETIC-UNCENSORED-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. הרישיון מתיר שימוש מסחרי, שינוי קוד והפצה מחדש בלי תמלוגים, בתנאי ששומרים על הודעות זכויות היוצרים ומצרפים עותק של כתב הרישיון המקורי בכל מוצר שאתם משחררים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗