GPT
M

Miss_MARTHA-9B-Qwen3.5-Omni

קוד פתוח

ZERO-POINT-AIרישיון לא דווח2026-03-13

  • safetensors
  • gguf
  • qwen3_5
  • endpoints_compatible
  • conversational

מודל ראייה ושפה בגודל 9 מיליארד פרמטרים שרץ מקומית על החומרה שלכם. הוא מכוון לשיחות מבוגרים ותמיכה בתמונות ללא הגבלות תוכניות, למעט איסור מוחלט על תכני קטינים.

  • 9Bפרמטרים
  • 262,144טוקנים בהקשר
  • 69.1 GBמשקל הקבצים
  • 1,229הורדות בחודש

מה זה

מדובר בהתאמה של Qwen3.5 שמשלבת יכולות טקסט וניתוח תמונות דרך אנקודר ViT של 24 בלוקים. המטרה המרכזית שלו היא לשמש בן לוויה לשיחות אינטימיות ללא צנזורה רגילה של חברות ענן, לצד משימות כלליות כמו פתרון בעיות, כתיבת קוד וניתוח תמונות. המפתחים הפעילו שינוי קל של רעש במשקלים שנועד לייחד את המודל מתמטית.

דף המודל לא מציג תוצאות מדידה מספריות או מבחני ביצועים סטנדרטיים, כך שאי אפשר להשוות את הרמה שלו ישירות מול מודלים פתוחים אחרים באותו סדר גודל. מה שקיים כאן הוא פשוט מודל פתוח שמוותר על מסנני הבטיחות הרגילים של שיחות אישיות, ומבטיח תגובה עוינת ומיידית אך ורק אם מנסים לערב קטינים.

מתאים ל

  • שיחות פרטיות למבוגרים

    הוא אומן במיוחד לתקשורת אישית ללא צנזורת תוכן ורץ מקומית בלי שליחת מידע החוצה.

  • ניתוח תמונות על מחשב ביתי

    שילוב קובץ הראייה מאפשר לפענח תמונות ודיאגרמות בחומרה עם 6 גיגה זיכרון גרפי.

  • עבודה ללא חיבור רשת

    מתאים למי שחייב מודל רב תחומי שעובד לגמרי מקומית דרך Ollama בלי תלות בשרתים.

איפה זה נופל

הכרטיס לא מציין תמיכה בעברית אלא בשפות כמו אנגלית, סינית, גרמנית, צרפתית, תאילנדית ואחרות, כך שסביר להניח שהיכולות שלו בעברית בינוניות ומטה. בנוסף, חלון ההקשר במודל הבסיס אמנם רחב, אך מדריך ההרצה מגדיר אותו בפועל ל־4,096 טוקנים בלבד, מה שמגביל מאוד ניתוח של מסמכים ארוכים או שיחות ממושכות. אין שום מבחני ביצועים שמראים דיוק בקוד או בהיגיון.

שאלות
נפוצות

למה התמונות לא עובדות אחרי שהרצתי את המודל?

המודל הזה דורש קובץ נוסף בשם mmproj-f16.gguf שמתפקד כמפענח הראייה. צריך להוריד אותו ידנית ולהגדיר אותו כפרויקטור בקובץ ההגדרות של Ollama או בשרת llama.cpp.

האם אפשר לשלב אותו בבוט לקהל ישראלי?

עברית לא נכללת ברשימת השפות הרשמית של המודל. סביר שהוא יתקשה בניסוח טבעי בעברית, ולכן עדיף לבדוק אותו מקומית לפני שבונים עליו למוצר מקומי.

איך מריצים

כדי להריץ אותו דרך Ollama או שרת של llama.cpp תצטרכו להוריד שני קבצים נפרדים: קובץ המשקלים העיקרי בפורמט GGUF, וקובץ נפרד בשם mmproj ששוקל כמעט 900 מגה בייט ומשמש כעיניים של המערכת לניתוח תמונות.

גרסת Q4 דורשת 4 גיגה בייט זיכרון גרפי כמינימום ומומלצת עם 6 גיגה בייט, כך שהיא תרוץ על כרטיסים ביתיים פשוטים או מחשבי מק עם שבבי M. גרסאות דחוסות פחות כמו Q8 דורשות בין 8 ל־12 גיגה בייט זיכרון גרפי כדי לעבוד חלק.

ollama run hf.co/ZERO-POINT-AI/Miss_MARTHA-9B-Qwen3.5-Omni:martha_9b_v2_Q4_K_M_LATEST

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

יש חוסר התאמה בפרטים של המודל. בעמוד המרכזי מופיע שלא דווח רישיון, אבל בתוך הטקסט הטכני של הכרטיס המפתחים מציינים Apache 2.0 שמתיר שימוש חופשי ומסחרי עם מתן קרדיט. בגלל הסתירה הזו, שימוש במוצר מסחרי עלול לייצר סיכון משפטי שכדאי לברר ישירות מול היוצרים.

הרישיון המלא בעמוד המודל ↗