GPT
Q

Qwen3.6-27B-4bit

קוד פתוח

mlx-communityapache-2.02026-04-22

  • mlx
  • safetensors
  • qwen3_5
  • image-text-to-text
  • conversational

גרסה מכווצת בארבעה ביטים של מודל ראייה ושפה עם 27 מיליארד פרמטרים. היא מיועדת להרצה מקומית ישירה על מעבדי אפל בלי לשלוח תמונות וטקסט לשום שרת חיצוני.

  • 27Bפרמטרים
  • 262,144טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 23,187הורדות בחודש

מה זה

מדובר במודל שמקבל תמונות לצד טקסט ומחזיר טקסט, שעבר המרה לעבודה עם ספריית MLX של אפל באמצעות חבילת mlx-vlm בגרסה 0.4.4. הבסיס שלו הוא מודל של 27 מיליארד פרמטרים, אבל בגלל הכיווץ הוא תופס 15.0 גיגה בייט בלבד, מה שמאפשר להחזיק מודל רב-מודאלי כבד יחסית בתוך הזיכרון המאוחד של מחשב מק.

חלון ההקשר עומד על 262,144 טוקנים, שזה נפח עצום שמתאים לניתוח מסמכים ארוכים, תמונות מרובות וספריות קוד בלי לאבד את ההקשר. המפרסמים לא הוסיפו בכרטיס תוצאות מבחנים או מדדי דיוק משלהם, כך שאין כאן הבטחות רשמיות לביצועים, אלא פשוט התאמה טכנית ישירה לחומרת מק.

מתאים ל

  • ניתוח מסמכים עתירי גרפיקה

    חלון של 262,144 טוקנים ויכולת קריאת תמונה מתאימים לסריקת דוחות ארוכים עם תרשימים.

  • תיאור תמונות מקומי במק

    משקל של 15.0 גיגה בייט מאפשר לחלץ תיאורי תמונה ישירות על המחשב ללא פנייה לרשת.

  • עיבוד תמונה וטקסט במוצר

    רישיון apache-2.0 מאפשר להטמיע את המודל ביישומים מסחריים ללא עלויות רישוי.

איפה זה נופל

הכרטיס הנוכחי דל מאוד ולא מציג שום מידע על מגבלות הראייה, הזיות או חולשות בתחומים ספציפיים. כיווץ לארבעה ביטים חוסך מקום אבל עלול לגרור ירידה באיכות הזיהוי של פרטים קטנים בתמונות, ואין בכרטיס שום פירוט על מידת הפגיעה הזו. בנוסף, הוא פועל אך ורק בסביבת MLX, כך שמי שעובד על לינוקס או חומרה אחרת לא יכול להשתמש בקבצים האלה.

אותה משפחה

Qwen3.6 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל על מחשב עם כרטיס של אנבידיה?

לא. הקבצים האלה הומרו במיוחד עבור ספריית MLX שפותחה למעבדי אפל בלבד. אם אתם עובדים על מחשב פיסי או שרת לינוקס, תצטרכו להשתמש במודל המקורי ולא בגרסה הזו.

כמה מקום ומשאבים המודל דורש בפועל?

הוא שוקל 15.0 גיגה בייט בדיסק, וכולל 27 מיליארד פרמטרים בארבעה ביטים. כדי להריץ אותו בלי קריסות צריך מחשב מק שבו הזיכרון המאוחד מסוגל להחזיק את הקבצים וגם להשאיר מקום לחלון ההקשר.

איך מריצים

כדי להריץ אותו מתקינים את החבילה mlx-vlm ומפעילים ישירות את פקודת ההרצה דרך שורת הפקודה עם הנתיב לתמונה. הקבצים שוקלים 15.0 גיגה בייט ומחולקים לשישה עשר קבצים, כך שחובה שיהיה לכם מחשב מק עם זיכרון מאוחד שיכול להכיל את המשקל הזה ועוד מרווח נשימה לעיבוד הטוקנים.

אם יש לכם מחשב ללא חומרת אפל או שאין לכם מספיק זיכרון פנוי למשקל הקבצים, אין טעם לנסות להריץ אותו מקומית. במצב כזה עדיף לקרוא לשרת מרוחק שמריץ את המודל המקורי.

pip install -U huggingface_hub
hf download mlx-community/Qwen3.6-27B-4bit

הרישיון

המודל מופץ תחת רישיון apache-2.0. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי של הקוד והפצה מחדש, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי. אפשר לשלב אותו במוצרים מסחריים בלי לשלם תמלוגים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗