GPT
Q

Qwen3-VL-8B-NSFW-Caption-V4.5-GGUF

קוד פתוח

mradermacherapache-2.02025-11-08

  • transformers
  • gguf
  • qwen
  • qwen3-vl
  • image-captioning

גרסת GGUF מכווצת למודל ראייה שמיועד לתיוג תמונות למבוגרים. מתאים למי שרוצה לתאר תוכן ויזואלי רגיש מקומית בלי חסימות של ספקי ענן מסחריים.

  • 70.2 GBמשקל הקבצים
  • 13,001הורדות בחודש
  • 84לייקים

מה זה

מדובר בהמרה של thesby/Qwen3-VL-8B-NSFW-Caption-V4.5 לפורמט GGUF, שמיועדת להרצה מקומית על מעבדים או כרטיסי מסך ביתיים. המודל הבסיסי מתמקד בניתוח תמונה וטקסט עם התמחות ספציפית בתיאור ויזואלי של תכנים למבוגרים, תחום שבו מודלים מסחריים רגילים נוטים לסרב לעבד או להחזיר שגיאות צנזורה.

הפרסום הנוכחי כולל רק את קובצי הקוונטיזציה הסטטיים שנוצרו על ידי mradermacher, ולא מכיל מבחני ביצועים או השוואות מספריות ישירות בין הגרסאות השונות. ההבדל המרכזי מול מודלי ראייה סטנדרטיים בגודל 8B הוא הכוונון הממוקד של הדגם המקורי למשימות תיוג וזיהוי של תוכן בוגר באנגלית ובסינית, ללא מנגנוני הבטיחות הרגילים שחוסמים תמונות כאלה במודלים כלליים.

מתאים ל

  • תיוג תמונות עירום מקומי

    מאפשר לייצר תיאורי טקסט לתמונות בוגרות בלי לשלוח מידע אינטימי לשרתים חיצוניים.

  • סינון מאגרי תמונות

    מתאים לזיהוי ותיאור של תוכן למבוגרים כדי לבצע קלסיפיקציה וניהול של קטלוגים מקומיים.

  • הכנת דאטהסטים למודלי ציור

    מייצר כיתובים מפורטים עבור אימון מודלים של דיפוזיה שמתמקדים באמנות עירום.

איפה זה נופל

כרטיס המודל לא מציג נתוני אימון, מדדי דיוק או מבחני בנצ'מרק שמראים עד כמה התיאורים אמינים. הוא תומך רשמית רק באנגלית ובסינית, כך שאינו מתאים לעבודה בעברית. בנוסף, מדובר בהמרה סטטית פשוטה בלי שימוש ב־imatrix, ורמות הכיווץ הנמוכות כמו Q2_K או Q3_K_M מוגדרות במפורש כבעלות איכות ירודה.

שאלות
נפוצות

איזה קבצים צריך להוריד כדי שזה יעבוד?

בניגוד למודלי טקסט רגילים, מודל ראייה בפורמט הזה דורש שני קבצים נפרדים. חייבים להוריד קובץ שפה אחד מהרשימה לפי גודל הזיכרון, ובנוסף את אחד מקובצי ה־mmproj שמשמשים כרכיב הראייה לעיבוד התמונה.

האם המודל מבין פקודות בעברית?

לא. שפות המודל שצוינו במפורש הן אנגלית וסינית בלבד. כל ניסיון לבקש ממנו לתאר תמונה בעברית או לשלוח פרומפטים בעברית יספק תוצאות משובשות או לא מדויקות.

מה עדיף, הגרסה הזו או גרסת ה־i1?

הגרסאות כאן הן קוונטיזציה סטטית רגילה. בעמוד המודל מצוין שיש גרסאות i1-GGUF מבוססות מטריצת חשיבות בעמוד נפרד, והן בדרך כלל שומרות על איכות פלט טובה יותר באותו נפח זיכרון.

איך מריצים

כדי להריץ את המודל צריך להוריד את קובץ הראייה הנפרד, mmproj, יחד עם קובץ המודל המכווץ עצמו. הגרסאות הקלות מתחילות בנפח של 3.4 ג'יגה בייט בגרסת Q2_K ומגיעות עד 16.5 ג'יגה בייט בגרסת f16 המלאה, כאשר גרסאות Q4_K_S ו־Q4_K_M ששוקלות סביב 5 ג'יגה בייט מוגדרות כמומלצות למהירות ואיכות.

כרטיס מסך ביתי עם 8 עד 12 ג'יגה בייט זיכרון יספיק כדי להריץ את גרסאות ה־4 ביט או 5 ביט בצורה חלקה יחד עם רכיב המולטימודל. מי שמחזיק חומרה חלשה יותר או מעבד בלבד יכול לנסות את רמות הכיווץ הנמוכות יותר, אך איכות הפלט בטקסט תרד.

ollama run hf.co/mradermacher/Qwen3-VL-8B-NSFW-Caption-V4.5-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא apache-2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי קוד והפצה חופשית של הקבצים, בתנאי ששומרים על הודעות זכויות היוצרים ומצרפים עותק של תנאי הרישיון המקוריים בכל הפצה של המוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗