GPT
Q

Qwen3-Coder-Next-int4-AutoRound

קוד פתוח

Intelרישיון לא דווח2026-02-09

  • safetensors
  • qwen3_next
  • text-generation
  • conversational
  • 4-bit

גרסת קוונטיזציה של אינטל למודל קוד עם 12 מיליארד פרמטרים. היא מכוונת למי שרוצה חלון הקשר ענק של 262 אלף טוקנים על גבי תשתית מקומית.

  • 12Bפרמטרים
  • 262,144טוקנים בהקשר
  • 40.6 GBמשקל הקבצים
  • 6,083הורדות בחודש

מה זה

אינטל לקחו את מודל הקוד של סדרת Qwen3 ודחסו אותו באמצעות כלי ה־AutoRound שלהם לרמת 4 ביט סימטרית. המודל בנוי על כמעט 12 מיליארד פרמטרים ב־48 שכבות, ונועד למשימות יצירת טקסט ופיתוח קוד, כשהוא מנסה לחסוך בזיכרון בלי להרוס את היכולות של המקור.

הנתון החריג פה הוא חלון ההקשר, שמגיע ל־262,144 טוקנים. זה מאפשר לטעון תיקיות פרויקט שלמות, קבצי תיעוד ארוכים או היסטוריית שיחה ענקית בבת אחת, תחום שבדרך כלל מוגבל מאוד במודלים מקומיים בגודל הזה. הדחיסה אמורה להוריד את דרישות החומרה ביחס למודל הבסיס הלא מכווץ, אבל מדובר עדיין בחבילת קבצים כבדה שדורשת משאבים אמיתיים.

מתאים ל

  • ניתוח בסיסי קוד גדולים

    חלון של 262 אלף טוקנים מאפשר להזין פרויקט שלם כדי לאתר באגים או להבין ארכיטקטורה.

  • השלמת קוד מקומית ומאובטחת

    הרצה פנימית בארגון דרך vLLM שמונעת יציאה של קוד רגיש לשרתים חיצוניים.

  • ייצור פונקציות ואלגוריתמים

    המודל מיועד לכתיבת קוד לפי דרישה ומסוגל להפיק פתרונות אלגוריתמיים במהירות.

איפה זה נופל

יוצרי המודל מציינים במפורש שהוא מייצר טעויות עובדתיות, ולכן אסור להסתמך עליו כמקור מידע מדויק. מעבר לכך, בעקבות מגבלות מודל המקור והנתונים שעליהם אומן, הוא עלול לפלוט תוכן פוגעני, מוטה או לא הולם. חובה לבצע בדיקות תקינות ובטיחות לפני שמשלבים אותו במערכת פעילה, ובמיוחד לבדוק את איכות הקוד שהוא מייצר, שעלול להכיל באגים בלי שתשימו לב.

שאלות
נפוצות

איזה כוח מחשוב צריך כדי להריץ אותו?

הקבצים שוקלים 40.6 גיגה בייט, כך שצריך כרטיס מסך חזק עם מספיק זיכרון ייעודי. בנוסף, ניצול מלא של חלון ההקשר הענק יצרוך כמות משמעותית של זיכרון עבודה מעבר למשקל הבסיסי של המודל.

האם אפשר להשתמש בו ישירות במוצר מסחרי?

לא כדאי למהר לפני שבודקים את הרישיון המקורי. אינטל לא ציינו רישיון בעמוד ומפנים לבדוק את תנאי השימוש של מודל הבסיס כדי לוודא שאין שם הגבלות מסחריות.

איך מריצים

אינטל מספקים דוגמאות הרצה ישרות דרך Transformers בפייתון או כשרת עצמאי עם vLLM, כולל דרישה להפעלת קוד מרוחק. למרות שמדובר בכיול ל־4 ביט, משקל הקבצים הכולל להורדה עומד על 40.6 גיגה בייט המחולקים ל־24 קבצים נפרדים, כך שתצטרכו נפח אחסון פנוי וכרטיס מסך חזק כדי להחזיק אותו בזיכרון, במיוחד אם מנצלים את מלוא חלון ההקשר.

אם יש לכם שרת ייעודי או עמדת עבודה מתאימה, אפשר להרים את המודל לוקאלית לפיתוח מאובטח. אם אין לכם חומרה כזו, או שההורדה של עשרות גיגות כבדה עליכם, עדיף להשתמש ב־API מרוחק של מודל קוד במקום להסתבך עם תחזוקה עצמית.

pip install -U huggingface_hub
hf download Intel/Qwen3-Coder-Next-int4-AutoRound

הרישיון

הרישיון של המודל לא דווח בעמוד שלו. אינטל מפנים לרישיון של מודל הבסיס המקורי ומדגישים שההערות שלהם אינן ייעוץ משפטי, כך שאם אתם מתכננים להכניס אותו למוצר מסחרי, תצטרכו לאתר את תנאי המקור של המודל ולבדוק אותם מול עורך דין.

הרישיון המלא בעמוד המודל ↗