GPT
Q

lmstudio-community/Qwen3-Coder-30B-A3B-Instruct-GGUF

קוד פתוח

lmstudio-communityרישיון לא דווח2025-07-31

  • gguf
  • text-generation
  • endpoints_compatible
  • conversational

גרסת GGUF מכווצת של מודל קוד בגודל שלושים מיליארד פרמטרים. היא פונה למי שרוצה להריץ מודל פיתוח מקומי ישירות דרך כלי llama.cpp.

  • 84.6 GBמשקל הקבצים
  • 88,840הורדות בחודש
  • 42לייקים

מה זה

מדובר במודל שמיועד ליצירת טקסט וקוד, במקור מבית Qwen, שהומר לפורמט GGUF על ידי bartowski בעזרת גרסה b6014 של llama.cpp. הוא שוקל סך הכול 84.6 ג'יגה בייט שמתחלקים בין שישה קבצים שונים, ומיועד להורדה והרצה מקומית בלי תלות ברשת חיצונית.

הכרטיס לא מציג תוצאות של מבחני ביצועים, בנצ'מרקים או פירוט על ארכיטקטורת A3B, כך שאין נתונים רשמיים לגבי הדיוק שלו מול מודלים אחרים בקטגוריה. מה שברור הוא שמדובר בחבילה גדולה שמשכה מעל שמונים ושמונה אלף הורדות, בעיקר בזכות ההתאמה הישירה לתוכנת LM Studio ולסביבות עבודה מקומיות.

מתאים ל

  • השלמת קוד מקומית

    הרצה מקומית למי שמחפש סיוע בכתיבת קוד בלי לשלוח שום קובץ לשרתים חיצוניים.

  • ניסויי פיתוח פנימיים

    בדיקת יכולות של מודלי שפה על תשתיות ארגוניות פרטיות ומבודדות לחלוטין מרשת האינטרנט.

  • עבודה עם LM Studio

    הורדה ישירה לסביבות llama.cpp שמאפשרות טעינת קובצי GGUF מוכנים ללא המרה ידנית.

איפה זה נופל

יוצרי ההפצה לא פירטו מגבלות טכניות או חולשות ספציפיות בכתיבת שפות תכנות מסוימות, אך הם מדגישים בהסכם הוויתור שהתוצרים עלולים להיות לא מדויקים, פוגעניים או שגויים לחלוטין. חובה לבדוק כל שורת קוד שהוא מייצר לפני שמריצים אותה בסביבה אמיתית, כי אין שום התחייבות ליציבות או לנכונות.

אותה משפחה

Qwen3-Coder יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים למחשב נייד סטנדרטי?

לא. משקל הקבצים מגיע ל־84.6 ג'יגה בייט בסך הכול. הרצה כזו דורשת חומרה כבדה עם עשרות ג'יגה בייט של זיכרון ייעודי כדי לפעול בקצב סביר.

אפשר להשתמש במודל הזה במוצר מסחרי?

הרישיון של החבילה הזו לא דווח כלל בעמוד המודל. מבחינה משפטית מסוכן להכניס אותו למערכת מסחרית בלי לברר קודם את תנאי הרישיון של מודל המקור מבית Qwen.

איך מריצים

בשביל להריץ קבצים במשקל כולל של 84.6 ג'יגה בייט תצטרכו חומרה חזקה מאוד עם שפע של זיכרון RAM וכרטיסי מסך ייעודיים שמסוגלים לבלוע נפחים כאלה. המודל רץ ישירות דרך סביבות מבוססות llama.cpp או תוכנות כמו LM Studio.

אם אין לכם תחנת עבודה ייעודית עם זיכרון גרפי עצום, עדיף להשתמש ב־API מרוחק במקום להשבית את המחשב המקומי עם קבצים בגודל כזה.

ollama run hf.co/lmstudio-community/Qwen3-Coder-30B-A3B-Instruct-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון לא דווח בעמוד של המודל. במצב כזה אין אישור מפורש לשימוש מסחרי או להפצה בתוך מוצר, ואסור להניח שמותר להשתמש בו בחופשיות. מי שבונה מוצר צריך לאתר את הרישיון המקורי של Qwen לפני שילוב שלו בקוד.

הרישיון המלא בעמוד המודל ↗