GPT
Q

Qwen3.6-35B-A3B-4bit

קוד פתוח

mlx-communityapache-2.02026-04-16

  • mlx
  • safetensors
  • qwen3_5_moe
  • image-text-to-text
  • conversational

גרסה מכווצת בארבעה ביט למודל ראייה ושפה של שלושים וחמישה מיליארד פרמטרים. היא פונה למי שמחפש חלון הקשר ענק ומריץ קוד מקומי על חומרת אפל.

  • 35Bפרמטרים
  • 262,144טוקנים בהקשר
  • 19.0 GBמשקל הקבצים
  • 31,779הורדות בחודש

מה זה

המשקל יושב על ארכיטקטורת תערובת מומחים של קוון, והוא הומר ישירות לעבודה עם ספריית התשתית של אפל סיליקון. המטרה כאן היא עיבוד תמונה וטקסט יחד, עם חלון שמגיע עד 262,144 טוקנים, מה שמאפשר להזין מסמכים ארוכים מאוד עם תמונות בלי לחתוך אותם מראש.

בזכות ארכיטקטורת המומחים והכיבוץ, רק חלק מהפרמטרים מופעל בכל צעד, כך שמהירות התגובה סבירה יחסית לגודל מלא של שלושים וחמישה מיליארד פרמטרים. המרה כזו מיועדת למי שרוצה יכולות מולטימודליות על חומרה מקומית בלי לתחזק שרת ענן ייעודי.

מתאים ל

  • ניתוח מסמכים מרובי עמודים

    חלון של מעל מאתיים אלף טוקנים מתאים לסריקת חוזים ותעודות מצולמות יחד.

  • חילוץ מידע מתמונות במק

    שילוב של ראייה וטקסט שרץ ישירות דרך ספריית אפל ללא תלות ברשת.

  • תיאור וקטלוג תמונות

    מענה על שאלות וחילוץ פרטים מתמונות לפי הוראות טקסט מוגדרות.

איפה זה נופל

הכיבוץ לארבעה ביט חוסך מקום, אבל הוא פוגע בדיוק בפרטים עדינים בתמונות או בטקסטים מורכבים. מעבר לכך, המודל הזה תלוי כולו באקוסיסטם של ספריית אפל, ולכן הוא לא מתאים למי שעובד על לינוקס או חומרת אנבידיה. כדאי לבדוק היטב הבנת עברית בתמונות לפני שסומכים עליו.

אותה משפחה

Qwen3.6 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה על שרת לינוקס עם כרטיס גרפי רגיל?

לא באופן הזה. הקבצים הומרו במיוחד עבור ספריית החומרה של אפל סיליקון, וכדי להריץ אותם על לינוקס תצטרכו את משקלי המקור ולא את גרסת ההמרה הזו.

איך מפעילים אותו מיד אחרי ההורדה?

מתקינים את ספריית הראייה בפייתון לפי ההוראות, ומריצים את פקודת ההרצה של mlx-vlm עם נתיב לתמונה והנחיה מבוקשת.

איך מריצים

מריצים אותו דרך חבילת הפייתון mlx-vlm בגרסה 0.4.4 ומעלה, בפקודת שורת פקודה פשוטה שקוראת לתמונה ולטקסט. הקבצים שוקלים 19.0 ג'יגה בייט בסך הכול, כך שחייבים מחשב מק עם זיכרון מאוחד שמסוגל לטעון את כל המשקל הזה ועדיין להשאיר מקום לפעולת המערכת.

אם יש לכם מחשב עם זיכרון צנוע, עדיף להשתמש בממשק מרוחק ולא לנסות להריץ אותו מקומית, כי המודל פשוט יקרוס מחוסר זיכרון.

pip install -U huggingface_hub
hf download mlx-community/Qwen3.6-35B-A3B-4bit

הרישיון

הרישיון הוא אפאצ'י שתיים אפס, שמאפשר שימוש מסחרי מלא, שינוי הקוד והפצה חופשית. מותר לשלב אותו במוצר פנימי או מסחרי, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗