GPT
Q

Qwen3-Coder-Next-Base

קוד פתוח

Qwenapache-2.02026-02-01

  • transformers
  • safetensors
  • qwen3_next
  • text-generation
  • conversational

יש כאן גם סקירה על Qwen עצמו.

מודל בסיס לתכנות שמחזיק 80 מיליארד פרמטרים אבל מפעיל רק שלושה בכל צעד. הוא מיועד למי שרוצה בסיס לאימון סוכני קוד עם חלון הקשר עצום.

  • 80Bפרמטרים
  • 262,144טוקנים בהקשר
  • 148 GBמשקל הקבצים
  • 2,695הורדות בחודש

מה זה

זהו מודל בסיס שנועד מראש לעבודה עם סוכני פיתוח, קריאות לכלים והתאוששות משגיאות בקוד. הוא נבנה על שילוב של מנגנון היברידי עם תערובת מומחים דלילה במיוחד, שבה 512 מומחים אבל רק עשרה מהם מופעלים בפועל בכל טוקן, יחד עם מומחה משותף אחד. השילוב הזה מאפשר לו לעבד הקשר של מעל 260 אלף טוקנים בלי לקרוס תחת עומס החישוב הרגיל של מודלים ענקיים.

ההבדל המשמעותי לעומת מודלים סטנדרטיים בגודל הזה הוא הארכיטקטורה. במקום להסתמך רק על תשומת לב רגילה, הוא משלב שכבות ייעודיות לחישוב ליניארי כדי לתמוך בטיפול בתיקי קוד שלמים ובמעל 370 שפות. כדאי לזכור שזהו שלב ה־Pretraining, כך שהוא מגיע כחומר גלם שמיועד להמשך אימון והתאמה אישית, ללא מצב חשיבה מובנה וללא בלוקים של תהליך מחשבה בפלט.

מתאים ל

  • אימון סוכני קוד פנימיים

    מבנה הנתונים שלו תוכנן לשימוש בכלים והתאוששות משגיאות, בסיס מעולה לכוונון ייעודי.

  • ניתוח תיקי קוד שלמים

    חלון של 262,144 טוקנים מאפשר לבלוע פרויקטים שלמים בריצה אחת בלי לחתוך קבצים.

  • פיתוח בשפות מגוונות

    הוא אומן על מעל 370 שפות, כך שהוא מתאים לספריות נידחות שאינן רק פייתון או ג'אווהסקריפט.

איפה זה נופל

זהו מודל בסיס ולא מודל שעבר כוונון להוראות. אי אפשר לזרוק אליו שאלה ישירה בצ'אט ולצפות לשיחה מסודרת, אלא צריך להמשיך לאמן אותו או להשתמש בו להשלמת קוד ופיגומים. בנוסף, המודל אינו תומך במצב חשיבה ולא מייצר תהליכי ניתוח עצמיים, כך שפתרון באגים מורכבים תלוי כולו באימון ההמשך שתבצעו עליו.

אותה משפחה

Qwen3-Coder-Next יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מוכן לשימוש ישיר כעוזר תכנות?

לא. זהו מודל בסיס משלב ה־Pretraining. הוא אינו מיועד לצ'אט ישיר מול מתכנת אלא להשלמת טקסט, פיגומים או כבסיס שעליו עושים המשך אימון והתאמה למשימות ספציפיות.

למה מודל של 80 מיליארד פרמטרים מוגדר כמהיר?

הוא משתמש בארכיטקטורת תערובת מומחים שמפעילה רק עשרה מתוך 512 מומחים בכל שלב. בפועל רק שלושה מיליארד פרמטרים פעילים בכל צעד חישוב, מה שמזרז מאוד את היצירה למרות המשקל הכללי.

האם צריך להגדיר הגדרות מיוחדות כדי לבטל מצב חשיבה?

לא. המודל תומך אך ורק במצב ללא חשיבה ואינו מייצר בלוקים ייעודיים לתהליך מחשבה. אין צורך להעביר פרמטרים ידניים לביטול המצב הזה בריצה.

איך מריצים

כדי להריץ אותו מקומית צריך להתמודד עם משקל קבצים של 148 גיגה בייט בפורמט bfloat16. זה דורש שרת עם כמה כרטיסי מסך חזקים או שילוב זיכרון וידאו רחב מאוד רק כדי לטעון את כל 80 מיליארד הפרמטרים לזיכרון, גם אם בפועל מופעלים רק שלושה מיליארד בזמן החישוב.

אם אין לכם חומרה ייעודית עם מספיק זיכרון להחזקת המשקלים, כנראה שעדיף לחכות לגישה דרך ממשק חיצוני או להשתמש בגרסאות מכווצות כשיצאו. הריצה שלו מתאימה בעיקר למי שמאמן שכבות נוספות או בונה תשתית פנימית מאובטחת לסוכני פיתוח.

from transformers import pipeline

pipe = pipeline("text-generation", model="Qwen/Qwen3-Coder-Next-Base")
print(pipe("שלום"))

הקבצים

52 קבצים במאגר, 148 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הקוד והמשקלים זמינים תחת רישיון apache-2.0. מותר להשתמש בהם לצרכים מסחריים, לשנות את המשקלים, לאמן אותם הלאה ולהטמיע במוצר שלכם בלי לשלם תמלוגים, כל עוד שומרים על תנאי הרישיון המקוריים ומצרפים את הודעת זכויות היוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗