GPT
G

Gemma-3-4B-VL-it-Gemini-Pro-Heretic-Uncensored-Thinking_GGUF

קוד פתוח

Andycurrentapache-2.02026-02-09

  • gguf
  • vision-language
  • multimodal
  • uncensored
  • text-generation

גרסת GGUF לא מיושרת של ג׳מה 4B שמשלבת ניתוח תמונות וחשיבה ללא צנזורה. מי שמחפש מודל ויזואלי קל שלא חוסם שאלות על בטיחות ימצא פה מענה מדויק.

  • 23.4 GBמשקל הקבצים
  • 4,393הורדות בחודש
  • 66לייקים

מה זה

מדובר בהמרה של דגם Gemma 3 בגודל 4 מיליארד פרמטרים, שמותאמת לעבודה מקומית ומקבלת גם טקסט וגם תמונות. המאפיין הבולט כאן הוא הסרת מגבלות הסינון והיישור המקוריות של גוגל, יחד עם כוונון שמכוון לחשיבה פתוחה ומענה ישיר.

המודל מתמודד עם תיאור תמונות, שאלות על תוכן ויזואלי וניתוח סצנות, לצד משימות טקסט שגרתיות כמו כתיבה יוצרת או תמצות. בניגוד לגרסאות רשמיות שמסרבות לענות על נושאים רגישים, ההתאמה הזו מספקת תשובות גולמיות. אין בדף נתוני ביצועים מספריים או מבחני השוואה, כך שאת איכות ההסקה תצטרכו לבדוק בעצמכם על המשימות שלכם.

מתאים ל

  • ניתוח מסמכים ותמונות מקומי

    מאפשר לפענח תוכן חזותי במחשב המקומי בלי לשלוח מידע רגיש לשרתים חיצוניים.

  • מחקר על מודלים ללא יישור

    מתאים לבדיקת תגובות של מודל ויזואלי שלא עבר סירוס של תכנים על ידי היצרן.

  • עוזר שיחה למערכות פנימיות

    רץ בחומרה קלה יחסית ומספק מענה לשאלות משולבות תמונה וטקסט בלי מגבלות רשת.

איפה זה נופל

הכרטיס מדגיש שהמודל מוגדר כלא מצונזר, מה שאומר שהוא עלול לפלוט תוכן פוגעני או רגיש ללא אזהרה. הוא לא מתאים למערכות שפונות לקהל הרחב בלי שכבת סינון נוספת שאתם תבנו בעצמכם, ובטח שלא למערכות קריטיות לבטיחות. בנוסף, השפה היחידה שרשומה עבורו היא אנגלית, כך שאין להסתמך עליו בעברית. גם איכות ניתוח התמונה תלויה מאוד ברזולוציה ובמבנה הקלט שתספקו לו.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה ישירות מול לקוחות?

עדיף שלא לעשות את זה בלי להוסיף מערכת בקרה חיצונית. המודל מוגדר כלא מצונזר וללא מנגנוני בטיחות, ולכן הוא עלול לייצר תשובות לא הולמות שאי אפשר לחזות מראש.

האם הוא מבין עברית?

המאגר מציין תמיכה בשפה האנגלית בלבד. מודלים שמבוססים על ג׳מה עשויים לקלוט עברית ברמה בסיסית, אבל כאן אין שום הבטחה לתפקוד תקין בשפה הזו.

איך מריצים

את הקבצים מריצים דרך llama.cpp או Ollama ותוכנות שתומכות בפורמט GGUF. סך כל הקבצים במאגר שוקל 23.4 גיגה בייט ומחולק לעשרה קבצים שונים, מה שאומר שיש שם רמות שונות של קוונטיזציה לצד גרסת F16 מלאה. בשביל מודל של 4B בכימות סביר תצטרכו כרטיס מסך בסיסי עם 6 עד 8 גיגה זיכרון, או מעבד סביר עם מספיק RAM.

אם אתם צריכים רק מדי פעם לחלץ טקסט מתמונה פשוטה בלי לגעת בתכנים רגישים, קריאה ישירה לשרתי ענן תחסוך לכם תחזוקה מקומית. הריצה המקומית משתלמת כשרוצים פרטיות מוחלטת או כשנמאס לכם מסירובים גורפים של שירותים מסחריים.

ollama run hf.co/Andycurrent/Gemma-3-4B-VL-it-Gemini-Pro-Heretic-Uncensored-Thinking_GGUF:Gemma-3-4B-VL-it-Gemini-Pro-Heretic-Uncensored-Thinking_Q4_k_m

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0 שעובר בירושה מדגם הבסיס. מותר להשתמש בו לצרכים מסחריים, לשנות אותו ולהפיץ הלאה, בתנאי ששומרים על הודעות זכויות היוצרים וכתב הוויתור על אחריות. אין כאן הגבלות מיוחדות על מכירת שירותים שמבוססים עליו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗