GPT
Q

Qwen3.5-9B-MLX-4bit

קוד פתוח

mlx-communityapache-2.02026-03-02

  • mlx
  • safetensors
  • qwen3_5
  • qwen3.5
  • vision-language-model

גרסה מכווצת למק של מודל ראייה וטקסט עם 9.4 מיליארד פרמטרים. היא תופסת 5.6 גיגה בייט בלבד ומציעה חלון הקשר עצום של 262 אלף טוקנים.

  • 9.4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 5.6 GBמשקל הקבצים
  • 26,271הורדות בחודש

מה זה

מדובר בהמרה של מודל המקור ממשפחת קוון לארכיטקטורת אפל סיליקון, שנעשתה באמצעות ספריית mlx-vlm. המודל שייך לקטגוריית תמונה וטקסט לטקסט, כך שהוא מסוגל לקבל תמונות לצד פרומפטים מילוליים ולנתח אותן ישירות במכשיר המקומי.

הייחוד כאן הוא השילוב בין נפח צנוע של 5.6 גיגה בייט לבין חלון הקשר של 262,144 טוקנים, נתון חריג למדי למודלים שרצים מקומית על מחשב נייד. הכיווץ לרמת 4 ביט עם גודל קבוצה 64 מקטין משמעותית את תפיסת הזיכרון ביחס לגרסאות מלאות או שמונה ביט, ומאפשר עבודה שוטפת בלי לחנוק את המחשב.

מתאים ל

  • תיאור וניתוח תמונות במק

    הוא מריץ הסברים על תמונות ישירות ממעבדי אפל בלי לשלוח נתונים החוצה.

  • פיתוח יישומי ראייה אופליין

    משקל של 5.6 גיגה בייט מאפשר לשלב ראייה ממוחשבת בתוך כלי שולחני מקומי.

  • ניתוח מסמכים ארוכים עם גרפיקה

    חלון של 262 אלף טוקנים מאפשר להזין טקסט רב לצד תמונות רלוונטיות.

איפה זה נופל

יוצרי ההמרה מציינים במפורש שייתכן ותהיה גרסה ממוטבת וטובה יותר בעתיד, כך שההמרה הנוכחית אינה בהכרח היעילה ביותר שניתן להפיק מהארכיטקטורה. מעבר לכך, מדובר במודל מכווץ ברמת 4 ביט שמקריב מעט דיוק בפרטים חזותיים עדינים, ויש לבחון היטב את היכולת שלו בהבנת מסמכים ותמונות מורכבות לפני שמשלבים אותו בזרימת עבודה אמיתית.

אותה משפחה

Qwen3.5 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה על מחשב עם כרטיס של אנבידיה?

לא. מודלים מספריות MLX נבנו אך ורק עבור החומרה והמעבדים הגרפיים של אפל סיליקון. כדי להריץ על חומרה אחרת תצטרכו להוריד את מודל המקור המקורי של קוון.

כמה זיכרון מאוחד נדרש במק כדי להריץ אותו בנוחות?

הקבצים שוקלים 5.6 גיגה בייט, כך שמחשב עם 16 גיגה בייט יריץ אותו בקלות לצד יישומים רגילים. במחשבים של 8 גיגה בייט הוא עשוי לרוץ אך ישאיר מעט מאוד מרווח נשימה לשאר המערכת.

איך מריצים

כדי להריץ אותו צריך מק עם מעבד מסדרת M1, M2, M3 או M4, יחד עם חבילת mlx-vlm מותקנת בפייתון. הקריאה מתבצעת בכמה שורות קוד דרך הפונקציות load ו־generate, או ישירות משורת הפקודה עם הפקודה mlx_vlm generate.

בגודל של 5.6 גיגה בייט הוא יעבוד יפה על מחשבים עם 16 גיגה זיכרון מאוחד בלי לדרוש משאבים כבדים. אם אתם עובדים על שרתי לינוקס או חומרה שאינה של אפל, המודל הזה בכלל לא רלוונטי עבורכם ועדיף לפנות לגרסת המקור או להשתמש ב־API מרוחק.

pip install -U huggingface_hub
hf download mlx-community/Qwen3.5-9B-MLX-4bit

הרישיון

המודל מופץ תחת רישיון apache-2.0 שהוא רישיון פתוח ומתירני במיוחד. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו בתוך מוצרים, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗