GPT
Q

Qwen3.5-9B-Uncensored

קוד פתוח

LEONW24apache-2.02026-03-10

  • gguf
  • qwen3.5
  • uncensored
  • ollama
  • text-generation

גרסת GGUF לא מצונזרת של מודל 9B שמתאימה להרצה מקומית. הוא עונה על בקשות בלי מנגנוני סינון ומיועד למי שצריך תגובות ישירות בלי שגיאות תאימות בתוכנות הרצה.

  • 6.2 GBמשקל הקבצים
  • 3,606הורדות בחודש
  • 54לייקים

מה זה

הבסיס כאן הוא מודל בגודל תשעה מיליארד פרמטרים ממשפחת Qwen 3.5, שעבר הסרה של מגבלות הבטיחות כדי למנוע סירובים. המפרסם ארז אותו מחדש כקובץ GGUF בכימות Q4_K_M לאחר שבגרסה המקורית שלו התגלו בעיות תאימות שמנעו טעינה תקינה. המודל מתמקד בשפות אנגלית וסינית, ומסוגל לקבל חלון הקשר של עד 131,072 טוקנים בהתאם להגדרות ההרצה.

בניגוד למודלים רשמיים באותו סדר גודל, כאן אין שכבת שיפוט מוסרית שתעצור מענה על טקסטים רגישים. המפרסם משתמש בו בפועל כגיבוי מקומי במערכת אוטומציה לסינון תכנים, שבה סירובים אוטומטיים של מודלים ענן מקלקלים את רצף העבודה.

מתאים ל

  • סינון תוכן ללא סירובים

    ניתוח טקסטים גולמיים ובוטים במערכות פנימיות בלי שהמודל יסרב לעבד מידע עקב מילות מפתח רגישות.

  • עבודה מקומית ללא אינטרנט

    הרצה ישירה על חומרת קצה פשוטה דרך Ollama כשחייבים פרטיות מוחלטת ומענה טקסטואלי חופשי.

  • מערכת גיבוי מקומית

    פתרון חלופי לשירותי ענן יקרים שיודע לקבל פרומפטים ישירים כשהחיבור לרשת נופל.

איפה זה נופל

למרות שכרטיס המודל מזכיר שימוש בו כמודל ראייה לניתוח סרטונים, הוא מודה במפורש שהאריזה של גרסת הבסיס שברה את קלט המולטימודל. משמעות הדבר היא שקלט תמונה לא עובד בצורה תקינה, והוא מתפקד בעיקר כמודל טקסט. בנוסף, הסרת הסינון מוחקת כל רשת ביטחון, כך שהוא עלול לייצר תוכן פוגעני, שגוי או לא אמין, ואין לו תמיכה רשמית מובטחת בעברית.

שאלות
נפוצות

האם המודל באמת מבין תמונות כמו שכתוב בכרטיס?

לא באופן מעשי. כרטיס המודל מציין שהאריזה שוברת את מנגנון המולטימודל, ולכן כרגע יש להתייחס אליו כמודל טקסט בלבד.

איזו חומרה מינימלית צריך כדי לקבל זמני תגובה טובים?

כרטיס מסך ביתי עם 8 גיגה בייט זיכרון וידאו יספיק כדי לטעון את כל 6.3 הגיגה בייט של המשקלים. אפשר להריץ גם על מעבד רגיל עם 16 גיגה זיכרון פנימי, אך קצב יצירת המילים יהיה איטי בהרבה.

איך מריצים

הקובץ שוקל בערך 6.3 גיגה בייט, כך שאפשר להריץ אותו ישירות דרך Ollama או llama.cpp על מעבד גרפי ביתי פשוט עם 8 גיגה בייט זיכרון וידאו, או על מעבד רגיל עם 16 גיגה זיכרון עבודה. כל השכבות נכנסות לזיכרון כרטיס המסך ללא צורך בהתקנת PyTorch.

המפרסם ממליץ בהגדרות המודל לקבוע הקשר של 16,384 טוקנים, ערך טמפרטורה של 0.7 ושימוש בתבנית ChatML. אם אין לכם מחשב ייעודי פנוי לעיבוד מקומי או שאתם לא צריכים עבודה מנותקת מרשת, שירותי API חיצוניים יהיו מהירים ופשוטים יותר לתחזוקה.

ollama run hf.co/LEONW24/Qwen3.5-9B-Uncensored:Q4_K_M

הקבצים

4 קבצים במאגר, 6.2 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון המדווח הוא Apache 2.0. הוא מתיר שימוש מסחרי חופשי, שינוי של המשקלים והפצה מחדש בתוך מוצרים, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. אין כאן הגבלות מיוחדות על שילוב ביישומים סגורים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗