GPT
Q

Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled

קוד פתוח

Jackrongapache-2.02026-02-27

  • safetensors
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

גרסה מכווננת של Qwen בנפח 28 מיליארד פרמטרים שזוקקה מדפוסי חשיבה של קלוד. מתאימה למי שרוצה הרצה עצמאית של סוכן קוד עם חלון של 262 אלף טוקנים ובלי תלות בשרתים חיצוניים.

  • 28Bפרמטרים
  • 262,144טוקנים בהקשר
  • 51.8 GBמשקל הקבצים
  • 2,218הורדות בחודש

מה זה

הבסיס הוא ארכיטקטורת Qwen3.5 בגודל 28 מיליארד פרמטרים, שעברה אימון בשיטת LoRA על דאטהסטים שמכילים מסלולי חשיבה של Claude 4.6 Opus. היוצר כיוון את המשקלים במטרה לפתור בעיה מוכרת בדגם המקורי, שנוטה להיתקע בלולאות מחשבה ארוכות ומיותרות בשאלות פשוטות. כאן תהליך ההסקה בתוך תגיות החשיבה מובנה ומסודר לפי שלבים קבועים.

בבדיקות קהילה של הרצת סוכני קוד כמו Claude Code ו־OpenCode, המודל פתר באג בתבנית ה־Jinja שלא תמכה בתפקיד מפתח, ושמר על מצב חשיבה פועל בלי קריסות. לפי דיווחי משתמשים שהריצו אותו על כרטיס בודד, הוא פועל ברצף יותר מתשע דקות ללא התערבות ידנית, מטפל בקריאות לכלים, קורא פלטים ומתקן שגיאות של עצמו. זאת בניגוד לגרסת הבסיס שנוטה לקפוא במשימות ארוכות כאלה.

מתאים ל

  • סוכני תכנות מקומיים

    תומך בהגדרת תפקיד מפתח ומחזיק ריצה רצופה מול קריאות לכלים ללא קריסות.

  • ניתוח מסמכים ארוכים

    מנצל חלון הקשר של 262 אלף טוקנים לעיבוד קוד ומפרטים שלמים במכה.

  • פתרון בעיות לוגיות

    מפרק בעיות מורכבות לשלבים מוגדרים מראש בתוך תגיות חשיבה סדורות.

איפה זה נופל

הכרטיס מדגיש שמדובר בגרסת תצוגה מקדימה. האקוסיסטם מסביב, כולל תבניות הסקה ושילוב בכלים, עדיין לא יציב לחלוטין ועלול לגרור באגים וחוסר תאימות. בנוסף, למרות שמשימת המודל מוגדרת כטקסט ותמונה, האימון הנוכחי היה טקסט בלבד. קיימת גם בעיית הזיות מובנית בבדיקת עובדות בזמן שרשרת החשיבה, והוא לא כולל תמיכה מדווחת בעברית, כך שחובה לבדוק אותו ביסודיות לפני חיבור לשירות אמיתי.

אותה משפחה

Qwen3.5-27B-Claude-4.6-Opus-Reasoning יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה על מחשב נייד רגיל?

לא בגרסתו המלאה וגם לא בכימות בינוני. משקל הקבצים עומד על כמעט 52 גיגה בייט, וגם בכימות ל־4 ביט תצטרכו כרטיס מסך עם לפחות 16 גיגה בייט זיכרון גרפי ייעודי כדי לקבל קצב עבודה סביר.

האם המודל מתאים לעבודה בעברית?

השפות הרשמיות שמדווחות בכרטיס הן אנגלית וסינית בלבד. הוא עשוי לקלוט עברית בזכות משקלי הבסיס של Qwen, אבל האימון לא התמקד בזה, ולכן אי אפשר לבנות עליו לעיבוד טקסט עברי בלי בדיקה מוקדמת.

האם המודל מסוגל לעבד תמונות כפי שמופיע בהגדרת המשימה?

בפועל לא. למרות שהארכיטקטורה המקורית תומכת בקלט כזה, תהליך האימון של הגרסה הזו התבסס על טקסט בלבד, כך שלא כדאי להסתמך עליו למשימות ראייה ממוחשבת.

איך מריצים

כדי להריץ את קובצי המקור בפורמט bfloat16 במלואם, תצטרכו להחזיק כ־52 גיגה בייט בזיכרון של כרטיסי המסך, מה שמחייב שני כרטיסי 24 גיגה בייט לפחות. מי שמוכן לרדת לכימות Q4_K_M יצטרך כ־16.5 גיגה בייט של זיכרון מסך, תצורה שעובדת על כרטיס RTX 3090 בודד בקצב של 29 עד 35 טוקנים לשנייה.

אם אין לכם חומרה כזו זמינה מקומית או שאתם צריכים רק שאילתות בודדות פעם ביום, שכירת שרת או פנייה ל־API מסחרי תהיה זולה ופשוטה בהרבה מהתעסקות בהקמת תשתית עצמאית.

pip install -U huggingface_hub
hf download Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled

הרישיון

הקוד והמשקלים פורסמו תחת רישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד, הפצה מחדש ושילוב בתוך מוצרים סגורים. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים וצירוף עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗