GPT
Q

Qwen3.6-27B-Claude-Opus-Reasoning-Distilled-GGUF

קוד פתוח

rico03apache-2.02026-04-23

  • gguf
  • qwen3_5
  • qwen3.6
  • reasoning
  • distillation

גרסת קוונטיזציה של מודל קוד וחשיבה בגודל בינוני, שאומן לחקות את צורת ההסקה המובנית של קלוד. הוא חוסך את החפירות הארוכות שמאפיינות מודלים פתוחים אחרים.

  • 262,144טוקנים בהקשר
  • 135 GBמשקל הקבצים
  • 1,885הורדות בחודש
  • 50לייקים

מה זה

הבסיס כאן הוא מודל בקוטר 27 מיליארד פרמטרים שעבר כוונון עדין על 14 אלף עקבות חשיבה של קלוד אופוס. המטרה העיקרית של המהלך הייתה לטפל במחלה הכרונית של מודלי חשיבה פתוחים, שנוטים להיתקע בלולאות מלל אינסופיות בתגיות החשיבה שלהם. במקום זה, הוא מפרק בעיות לשלבים תמציתיים במשימות פשוטות ומעמיק רק במשימות מורכבות.

מבחינת יכולות טהורות, המודל נשען על בסיס חזק מאוד בקוד ומתמטיקה. לפי המבחנים של מודל הבסיס, הוא מגיע לציון של 77.2 ב־SWE-bench ו־94.1 ב־AIME, מספרים שקרובים מאוד למודלי ענק מסחריים ומראים שהוא מסוגל לפתור באגים תכנותיים אמיתיים ולא רק שאלות ראיון תיאורטיות.

מתאים ל

  • פתרון באגים בקוד

    ציוני המקור ב־SWE-bench מעידים על יכולת פירוק של שגיאות תוכנה מורכבות לקוביות קוד מדויקות.

  • עבודה מקומית ומאובטחת

    פורמט ה־GGUF מאפשר להריץ מנוע חשיבה איכותי על תחנת עבודה סגורה ללא הוצאת נתונים לרשת.

  • חישובים והוכחות

    אימון החשיבה המובנה מתאים מאוד למשימות לוגיות ומתמטיות שדורשות הצגת דרך מפורטת שלב אחרי שלב.

איפה זה נופל

המודל מחייב תהליך חשיבה לפני כל תשובה, מה שיוצר תקורה קבועה בזמני תגובה גם כשמבקשים ממנו משימה טריוויאלית לחלוטין. אם תנסו לעקוף את זה במצב ללא חשיבה, תצטרכו להגדיר קנס נוכחות של 1.5 כדי למנוע חזרות.

בנוסף, כל מבחני הביצועים בעמוד מתייחסים למודל הבסיס של Qwen ולא לגרסה המכווננת הזו עצמה. אין שום תיעוד לביצועים שלו בעברית, כך שכל עבודה מקומית בשפה תדרוש בדיקה ידנית מעמיקה לפני שילוב שלו במערכת.

שאלות
נפוצות

איזו גרסת קוונטיזציה כדאי להוריד?

עבור רוב השימושים מומלץ לבחור בגרסת Q4_K_M שתופסת 16.5 גיגה ודורשת כרטיס עם 20 גיגה זיכרון. היא שומרת על רוב היכולות הלוגיות בלי להכביד על החומרה כמו גרסאות ה־Q8.

האם אפשר להשתמש בו במוצר מסחרי?

הרישיון המוצהר במטא־דאטה הוא Apache 2.0, אבל הכרטיס עצמו נחתם בהערה שהשחרור מיועד למחקר ולשימוש אישי. מעבר לכך, שימוש בדאטה מזוקק מקלוד נמצא באזור אפור מבחינת תנאי השימוש של המודל המקורי.

איך מריצים

בשביל להריץ אותו מקומית תצטרכו כרטיס מסך רציני או זיכרון אחוד רחב. הגרסה המאוזנת ביותר, Q4_K_M, שוקלת 16.5 גיגה ומחייבת כרטיס עם 20 גיגה זיכרון גרפי, כשכרטיס של 24 גיגה נותן מרווח נשימה סביר. אם יש לכם פחות חומרה, קיימות גרסאות דחוסות יותר כמו Q2_K שדורשת 12 גיגה בלבד, או גרסאות איכותיות כמו Q8_0 שדורשת 36 גיגה.

ההרצה מתבצעת ישירות דרך כלי GGUF מוכרים כמו llama.cpp, Ollama או LM Studio. אם אין לכם חומרה מקומית ברמה הזו או שאתם צריכים לפתוח את כל חלון ההקשר המלא, עדיף לפנות לשירותי ענן.

ollama run hf.co/rico03/Qwen3.6-27B-Claude-Opus-Reasoning-Distilled-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הרשמי הוא Apache 2.0 שמאפשר שימוש מסחרי, שינוי והפצה חופשית ללא תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים. יחד עם זאת, היוצר מציין בתחתית הכרטיס שהמודל שוחרר למחקר ולשימוש אישי, ואימון על פלטים של מודל מסחרי כמו קלוד עשוי להפר את תנאי השימוש של ספק הדאטה המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗