GPT
H

Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF

קוד פתוח

huihui-aimit2026-05-26

  • transformers
  • gguf
  • abliterated
  • uncensored
  • GGUF

גרסה ללא מגבלות בטיחות של המודל של דיפסיק, שמיועדת למנועי הסקה מהירים. היא נועדה למי שצריך תגובות ישירות בלי סירובים מובנים ורוצה להריץ הכל מקומית.

  • 330 GBמשקל הקבצים
  • 226,308הורדות בחודש
  • 137לייקים

מה זה

מדובר בהמרה שעברה תהליך הסרת סירובים על בסיס הדגם המקורי, במטרה לעקוף חסימות תוכן. הקבצים מותאמים לעבודה מול מנוע ההסקה של ds4 וגרסאות מותאמות של llama.cpp, עם תמיכה בהרצה על מספר כרטיסי מסך במקביל דרך פאצ'ים ייעודיים להאצה. בבדיקות של המפרסמים בסביבת לינוקס על גבי כרטיס RTX 6000 Pro יחיד עם 96 גיגה זיכרון, הגרסה הגיעה לקצב של מעל 35 טוקנים לשנייה, מה שמספק מהירות עבודה טובה מאוד לפיתוח ולבדיקות פנימיות.

המודל מגיע בכמה רמות כימות, החל מגרסת IQ2_XXS בגודל של 74.7 גיגה ועד לגרסת Q4_K שתופסת 153 גיגה. יש גם קובץ MTP אופציונלי ששוקל 3.6 גיגה שנועד להאצת פענוח ספקולטיבי. ההבדלים בין הגרסאות מתבטאים בעיקר ברמת הדיוק של שכבות המומחים, כששאר השכבות המרכזיות נשמרות ברמת דיוק גבוהה כדי למנוע קריסה של איכות הפלט.

מתאים ל

  • פיתוח ובדיקת קוד מקומי

    גרסת ה־Q2 מוגדרת כמתאימה לכתיבת קוד בסביבה מקומית ללא חסימות רשת.

  • מחקר על מודלים לא מסוננים

    הסרת מנגנוני הבטיחות מאפשרת לבחון תגובות ישירות ללא שכבות צנזורה מובנות.

  • שרת הסקה פנימי מהיר

    שילוב עם מנוע ds4 מאפשר פריסת שרת שמגיע ליותר מ־35 טוקנים לשנייה על חומרה מתאימה.

איפה זה נופל

ההסרה של מנגנוני הסינון חושפת את המערכת לפליטה של תוכן פוגעני, רגיש או לא חוקי בלי שום בקרה מובנית. היוצרים מודים במפורש שגרסת ה־Q2 סובלת משיעור סירובים מסוים וטוענים שהיא אמורה להתאים לכתיבת קוד, בעוד שאר הגרסאות עדיין נמצאות תחת בדיקות. בנוסף, קובץ ה־MTP לא עובד כמודל עצמאי ודורש רכיב טעינה ייעודי, ומנוע ds4 עצמו לא נבדק על ידי המפרסמים בסביבת מחשבי אפל.

שאלות
נפוצות

איזה כרטיס מסך צריך כדי להריץ את המודל?

הבדיקות היחידות שפורסמו בוצעו על כרטיס RTX 6000 Pro עם 96 גיגה זיכרון. לגרסאות ה־Q2 דרוש מחשב עם לפחות 128 גיגה זיכרון, ולגרסת ה־Q4 נדרשים 256 גיגה זיכרון לפחות.

האם המודל יסרב לענות על שאלות?

למרות הסרת החסימות, המפרסמים מציינים שבגרסת ה־Q2 עדיין קיים אחוז מסוים של סירובים. שאר הגרסאות עדיין נמצאות בשלבי בדיקה ולכן ייתכנו תגובות לא צפויות.

האם אפשר להשתמש בקובץ ה־MTP לבד?

לא, קובץ ה־MTP שוקל 3.6 גיגה והוא אינו מודל עצמאי. הוא נועד לפענוח ספקולטיבי בלבד ומחייב שימוש ברכיב טעינה ייעודי יחד עם אחד הקבצים הראשיים.

איך מריצים

כדי להריץ את הגרסאות הקלות נדרשת חומרה כבדה מאוד. המפרסמים ממליצים על מחשבי מק עם 128 גיגה זיכרון לגרסאות ה־Q2, או שרתים עם 256 גיגה זיכרון לפחות אם בוחרים בגרסת ה־Q4. נכון לעכשיו הבדיקה הרשמית של היוצרים בוצעה רק על כרטיס RTX 6000 Pro, כך שחומרה אחרת לא נבדקה ישירות על ידם.

אם אין לכם תחנת עבודה ייעודית או שרת פרטי עם כמות זיכרון כזו, ההרצה העצמית פשוט לא ריאלית בגלל עלויות החומרה. במצב כזה עדיף להתחבר לפתרון מרוחק דרך ממשק תוכנה חיצוני במקום לנסות לטעון קבצים של עשרות גיגות על ציוד קצה רגיל.

ollama run hf.co/huihui-ai/Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF:BF16

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון MIT שמאפשר שימוש חופשי, כולל שינוי הקוד ושילובו במוצרים מסחריים. עם זאת, זכויות היוצרים על דגם הבסיס שייכות לחברת דיפסיק, וההפצה כפופה לתנאי השימוש המקוריים שלהם. אין כאן שום אחריות מצד היוצרים לנזקים שייגרמו משימוש בתוכן.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗