GPT
Q

Qwen3-Coder-30B-A3B-Instruct-4bit

קוד פתוח

mlx-communityapache-2.02025-07-31

  • mlx
  • safetensors
  • qwen3_moe
  • text-generation
  • conversational

גרסה מכווצת למק של מודל קוד מבוסס תערובת מומחים. הוא נותן חלון הקשר ענק בלי לטחון את כל הזיכרון של המחשב.

  • 31Bפרמטרים
  • 262,144טוקנים בהקשר
  • 16.0 GBמשקל הקבצים
  • 10,630הורדות בחודש

מה זה

מדובר בהמרה של מודל קוד של עליבאבא לספריית MLX של אפל, בכימות של 4 ביט. הארכיטקטורה כאן היא תערובת מומחים עם יותר משלושים מיליארד פרמטרים בסך הכול, אבל בפועל רק חלק קטן מהם פעיל בכל טוקן. זה מה שמאפשר לו לרוץ מהר יחסית בלי לדרוש תחנת עבודה מפלצתית.

היתרון הגדול נמצא בחלון ההקשר, שמגיע למעל רבע מיליון טוקנים. אתם יכולים לזרוק פנימה תיקיות שלמות של פרויקט, לוגים מנופחים או תיעוד ארוך בלי לחתוך שום דבר באמצע. המודל עבר כוונון לפקודות ולתכנות, כך שהוא מכוון מראש לכתיבת קוד, הסבר שגיאות ותרגום פונקציות בין שפות, במקום סתם לפטפט ברשת.

מתאים ל

  • ניתוח בסיסי קוד

    חלון ההקשר המאסיבי מאפשר להזין קבצים מרובים כדי למצוא תלויות ובאגים בפרויקט שלם.

  • כתיבת בדיקות יחידה

    הוא מותאם לקוד ויודע לקחת פונקציות קיימות ולייצר עבורן כיסוי בדיקות במהירות.

  • עבודה מקומית ומאובטחת

    פיתוח על מחשב מבודד בלי להוציא קוד קנייני של החברה לשרתים חיצוניים.

איפה זה נופל

הכימות ל־4 ביט גובה מחיר מסוים בדיוק. במשימות כתיבה מורכבות או ארכיטקטורת תוכנה עדינה הוא עלול לפספס פרטים קטנים או לייצר באגים שלא קיימים במקור. חלון של רבע מיליון טוקנים נשמע מפתה, אבל בפועל מילוי של חלון כזה יאט את מהירות התגובה באופן מורגש וידרוש זיכרון נוסף מעבר למשקל הבסיסי של הקבצים. כרטיס המודל לא מציג מבחני ביצועים, ולכן תצטרכו לבדוק בעצמכם אם הקוד שהוא מייצר בכלל מתקמפל לפני שאתם סומכים עליו.

שאלות
נפוצות

האם המודל יעבוד על מחשב עם כרטיס מסך של אנבידיה?

לא. הגרסה הזו מומרת במיוחד עבור ספריית MLX, שפותחה לעבוד אך ורק על המעבדים הגרפיים של אפל סיליקון במחשבי מק. אם יש לכם לינוקס או ווינדוס, תצטרכו לחפש המרה אחרת כמו GGUF.

כמה זיכרון בפועל הוא תופס בזמן עבודה?

המשקל של הקבצים הוא שישה עשר גיגה, אבל בזמן ריצה והזנת פקודות ארוכות תצטרכו לפחות עוד כמה גיגות פנויים. מומלץ לא לנסות להריץ אותו עם פחות משלושים ושניים גיגה זיכרון במחשב.

איך מריצים

כדי להריץ אותו צריך מק עם שבב אפל סיליקון, רצוי עם לפחות שלושים ושניים גיגה זיכרון מאוחד. המשקל הכולל של הקבצים עומד על שישה עשר גיגה, כך שעל מחשב עם שישה עשר גיגה בלבד מערכת ההפעלה תיחנק ברגע שתפתחו דפדפן לצדו.

ההתקנה דורשת רק את ספריית mlx-lm בפייתון וכמה שורות קוד כדי לטעון אותו מהמאגר. אם אין לכם מק חזק בהישג יד או שאתם צריכים לשרת מאות בקשות במקביל, אין טעם להריץ אותו מקומית. עדיף להשתמש בשרת ייעודי או לפנות לשירותי ענן.

pip install -U huggingface_hub
hf download mlx-community/Qwen3-Coder-30B-A3B-Instruct-4bit

הרישיון

הרישיון הוא אפאצ׳י שתיים אפס. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהטמיע אותו במוצרים שלכם בלי לשלם תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗