GPT
Q

Qwopus3.5-4B-v3-GGUF

קוד פתוח

Jackrongapache-2.02026-04-01

  • gguf
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

גרסה מכווננת של מודל ארבעה מיליארד פרמטרים שמיועדת להפעלת סוכנים וקריאות לכלים. היא מתאימה למי שרוצה הרצה מקומית קלה ומוכן לשלם בשרשראות חשיבה ארוכות יותר תמורת דיוק בקוד.

  • 262,144טוקנים בהקשר
  • 13.4 GBמשקל הקבצים
  • 1,714הורדות בחודש
  • 54לייקים

מה זה

המודל מבוסס על Qwen3.5-4B ועבר אימון מסוג SFT ו־LoRA בעזרת Unsloth. המפתח ניסה להתרחק מחיקוי שטחי של מודלים גדולים ולבנות תהליך חשיבה מפורט, שמכוון לגישה של פעולה ותיקון שגיאות תוך כדי תנועה במקום תכנון מוקדם אינסופי. יש כאן גם חיזוק ייעודי לקריאות לכלים במסגרות עבודה כמו OpenClaw.

במבחן HumanEval על פני 164 משימות תכנות, המודל הגיע לתוצאה של 75.61 אחוז תחת בדיקה קפדנית, לעומת 72.56 אחוז של מודל הבסיס ו־69.51 אחוז בגרסה הקודמת שלו. המשמעות בפועל היא פחות שגיאות תחביר ופחות צורך בהתערבות ידנית כדי לחלץ קוד עובד מתוך הפלט.

מתאים ל

  • סוכני קוד מבוססי משוב

    אימון המודל מתמקד בקריאה לכלים ותיקון טעויות לאחר ריצה במסגרות אוטומטיות.

  • ניתוח לוגיקה במחשב אישי

    גודל קומפקטי של ארבעה מיליארד פרמטרים שרץ על חומרה מקומית ללא ענן.

  • מעקב אחר שרשראות חשיבה

    פירוט שלבי ההסקה מאפשר לבדוק את אמינות הפתרון לפני שמריצים אותו.

איפה זה נופל

המפתח מצהיר בגלוי שמדובר בפרויקט עצמאי ללא משאבים של מעבדת מחקר, והמודל מוגדר לצרכי מחקר וניסוי בלבד. שרשראות החשיבה שלו עלולות להיכנס ללולאות, לנדוד מהנושא או להציג הזיות בעובדות מחוץ לעולם התכנות.

התוצרים הגולמיים כוללים לעיתים בעיות עימוד וערבוב של הסברים בתוך בלוקים של קוד. כמו כן, הוא תומך באנגלית, סינית וקוריאנית, כך שהוא לא מתאים לעיבוד שפה טבעית בעברית.

אותה משפחה

Qwopus3.5 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים לפיתוח בעברית?

לא מומלץ. רשימת השפות הנתמכות כוללת אנגלית, סינית וקוריאנית בלבד. הוא עשוי להחזיר פלטים משובשים או חלקיים אם תנסו לנהל איתו שיחה בעברית.

למה זמני התגובה שלו ארוכים ביחס לגודל?

האימון החדש בגרסה הזו מייצר שרשראות חשיבה מפורטות ומאומתות יותר. כתוצאה מכך כמות הטוקנים שהמודל פולט לפני התשובה הסופית גדולה יותר, וזה מאריך את זמן ההמתנה.

האם אפשר להשתמש בו במוצר מסחרי?

מבחינה משפטית הרישיון הוא apache-2.0 ומאפשר זאת. מנגד, המפתח מציין שזהו מודל ניסיוני למטרות מחקר וחקירה טכנולוגית, ולכן שימוש כזה דורש בדיקות יציבות קפדניות מצדכם.

איך מריצים

הקבצים שוקלים 13.4 גיגה בייט בפורמט GGUF, מה שאומר שכרטיס מסך מודרני עם שמונה עד שנים עשר גיגה זיכרון יספיק לרוב שימושי ההסקה. אפשר להריץ אותו דרך ספריות כמו llama.cpp על מחשב אישי או שרת עצמאי קטן בלי עלויות תשתית כבדות.

אם אתם צריכים לפתוח את מלוא חלון ההקשר הענק או שאתם מחפשים תגובות מיידיות בלי להמתין לשלבי החשיבה המפורטים, כדאי לשקול קריאה למודל מסחרי דרך API. המודל מייצר פלט חשיבה ארוך משמעותית שמורגש בזמן ההמתנה לטוקנים.

ollama run hf.co/Jackrong/Qwopus3.5-4B-v3-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

8 קבצים במאגר, 13.4 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0, שמתיר שימוש מסחרי, שינוי קוד והפצה מחדש כמעט ללא הגבלות, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון. עם זאת, מכיוון שהמפתח עצמו מגדיר את הגרסה כניסיונית ולצורכי מחקר, כדאי לשקול היטב לפני שמשלבים אותה בתשתית קריטית למוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗