GPT
H

Huihui-Qwen3-Coder-30B-A3B-Instruct-abliterated-i1-GGUF

קוד פתוח

mradermacherapache-2.02025-08-03

  • transformers
  • gguf
  • abliterated
  • uncensored
  • en

גרסת כימות מבוססת חשיבות למודל קוד של שלושים מיליארד פרמטרים שעבר הסרת מגבלות. הוא מתאים למי שרוצה סיוע בפיתוח מקומי בלי סירובים על בקשות רגישות.

  • 302 GBמשקל הקבצים
  • 18,372הורדות בחודש
  • 162לייקים

מה זה

המאגר מכיל קובצי כימות של מודל קוד שעבר תהליך עיוורון להנחיות בטיחות. המקור מגיע מבית היוצר של huihui-ai, והגרסה הנוכחית עובדה באמצעות מטריצת חשיבות כדי לצמצם אובדן דיוק במעבר למשקלים קלים. המודל מתמקד במשימות פיתוח תוכנה, הבנת שפות תכנות וכתיבת סקריפטים באנגלית.

ההבדל המרכזי מול מודלים רגילים באותו סדר גודל טמון בהסרת מנגנוני הסירוב המובנים. הוא לא מתחמק מניתוח קוד פגיע, כתיבת בדיקות חדירה או ניסוח פקודות שמערכות אחרות מסמנות כמסוכנות. הכרטיס אינו מציג מדדי ביצועים או מבחני השוואה רשמיים, כך שקשה לאמוד את היכולת התכנותית המדויקת שלו ביחס למודלים מובילים אחרים בלי לבדוק אותו ישירות.

מתאים ל

  • מחקר חולשות אבטחה

    הסרת מנגנוני הסירוב עוזרת לנתח קוד זדוני או לכתוב בדיקות חדירה בלי שהמודל יחסום את השאילתה.

  • פיתוח אוטומטי מקומי

    המודל רץ באופן מבודל על חומרה פנימית ושומר על קוד המקור מפני דליפה לרשת חיצונית.

  • יצירת כימותים מותאמים

    המאגר כולל קובץ מטריצת חשיבות ייעודי שמאפשר לייצר גרסאות כימות נוספות לפי צורכי המערכת שלכם.

איפה זה נופל

הסרת המגבלות פותחת פתח לטעויות חמורות. מודל ללא ריסון עלול לייצר קוד עם פרצות אבטחה, פקודות הרסניות למערכת ההפעלה או הנחיות שגויות לחלוטין בלי להתריע. אין להזין את הפלט ישירות לסביבת ייצור בלי בדיקה קפדנית של כל שורה.

בנוסף, הכרטיס לא מציין נתוני בדיקה סטנדרטיים להערכת איכות הפיתוח שלו. המודל מוגדר רשמית לשפה האנגלית בלבד, כך שלא כדאי לבנות עליו לעבודה עם הערות, תיעוד או פקודות בעברית.

שאלות
נפוצות

איזו גרסה כדאי להוריד כדי לקבל תוצאה טובה בלי לבזבז זיכרון?

הגרסה המומלצת בדף היא Q4_K_M שדורשת מעט פחות מתשעה עשר ג'יגה בייט. היא מציעה יחס אופטימלי בין מהירות לדיוק, בעוד שגרסאות IQ3 או Q4_K_S יתאימו למי שחייב לחסוך עוד כמה ג'יגה בייט.

האם אפשר להשתמש במודל הזה לקוד עם תיעוד בעברית?

הכרטיס מצהיר על תמיכה באנגלית בלבד. עדיף לא להסתמך עליו לפרויקטים שדורשים הבנת עברית, שכן הביצועים שלו בשפה זו לא נבדקו ועלולים להיות ירודים במיוחד.

איך מריצים

כדי להריץ את המודל תצטרכו תוכנה תומכת פורמט GGUF. גודל הקבצים נע בין שישה וחצי ג'יגה בייט בגרסאות הנמוכות ביותר ועד מעל עשרים וחמישה ג'יגה בייט ברמות הגבוהות. רוב המשתמשים ירצו את גרסת Q4_K_M ששוקלת כמעט תשעה עשר ג'יגה בייט, שכן היוצר ממליץ עליה כאיזון המהיר והאיכותי ביותר. כדי להריץ אותה בקצב סביר צריך כרטיס מסך עם לפחות עשרים וארבעה ג'יגה זיכרון ייעודי, או זיכרון מערכת מאוחד נרחב.

הקצוות התחתונים כמו גרסאות IQ1 מוגדרים בכרטיס כמיועדים לנואשים בלבד ומציגים איכות נמוכה מאוד. אם החומרה שלכם כוללת פחות משישה עשר ג'יגה בייט של זיכרון גרפי פנוי, עדיף להשתמש במודל קטן יותר או לצרוך מודל פיתוח דרך שרת מרוחק, במקום לסבול מאיטיות ומקוד משובש.

ollama run hf.co/mradermacher/Huihui-Qwen3-Coder-30B-A3B-Instruct-abliterated-i1-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

26 קבצים במאגר, 302 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון אפאצ'י שתיים אפס. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של הקוד והמשקלים, הפצה פנימית או שילוב במוצרים חיצוניים. הדרישה העיקרית היא שמירה על הודעות זכויות היוצרים וציון תנאי הרישיון המקורי בכל הפצה של הקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗