GPT
Q

Qwen3.5-2B-Claude-4.6-Opus-Reasoning-Distilled-GGUF

קוד פתוח

Jackrongapache-2.02026-03-03

  • gguf
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

זיקוק תהליכי חשיבה מ־Claude Opus לתוך מודל קטן של שני מיליארד פרמטרים. פתרון קומפקטי למי שחייב הסקת מסקנות מובנית בקוד פתוח ובלי לשלם על שרתים כבדים.

  • 262,144טוקנים בהקשר
  • 7.5 GBמשקל הקבצים
  • 14,295הורדות בחודש
  • 187לייקים

מה זה

הבסיס כאן הוא מודל קטן של שני מיליארד פרמטרים מסדרת Qwen3.5, שעבר אימון ייעודי על דאטה מזוקק מ־Claude 4.6 Opus וגם מ־Qwen3.5-27B. הרעיון המרכזי הוא להכריח את המודל לבצע חשיבה מסודרת בתוך תגיות think לפני שהוא פולט תשובה, תוך הימנעות ממעגלי מחשבה מיותרים שמאפיינים מודלים קטנים.

בכרטיס לא מופיעים מבחני ביצועים מקובלים כמו מדדי שפת תכנות או מתמטיקה, אלא רק נתוני התכנסות של האימון עצמו. ההפסד באימון ירד לאורך שלושה מחזורים מ־0.73 ל־0.18, מה שמעיד טכנית על כך שהרשת למדה לחקות את מבנה החשיבה הנדרש, אבל זה לא מבטיח דיוק עובדתי בעולם האמיתי.

מתאים ל

  • ניתוח לוגי אופליין

    פירוק בעיות מורכבות שלב אחר שלב במחשב מקומי ללא חיבור רשת.

  • בדיקת שרשראות חשיבה

    מעקב שקוף אחרי תגיות החשיבה כדי להבין איך מודל קטן מתכנן צעדים.

  • עזרי מתמטיקה ומדע

    הפקת פתרונות מובנים בתחומים מדויקים שדורשים פירוט צעדים לפני התוצאה.

איפה זה נופל

היוצר מצהיר בפירוש שזו גרסת בדיקה שנועדה למחקר אקדמי ולהדגמה בלבד. בגלל הגודל המצומצם, המודל נוטה להזיות בפרטים ובעובדות אמיתיות כשהוא מנסה לנמק בתוך שלב החשיבה שלו. המודל הוגדר לשפה האנגלית בלבד, וחלון ההקשר באימון עמד על 16,384 טוקנים, כך שאי אפשר להסתמך על חלון ענק בפועל בלי לבדוק ירידה באיכות.

שאלות
נפוצות

האם המודל יתאים למוצר מסחרי מלא?

לא מומלץ בשלב זה. היוצר מדגיש שמדובר בגרסת ניסוי למחקר בלבד, ויש סכנה ממשית להזיות בתוכן העובדתי.

איך המודל מתמודד עם עברית?

הנתונים מציגים תמיכה באנגלית בלבד. לא כדאי להסתמך עליו למשימות חשיבה מורכבות בעברית בלי לבצע בדיקות מקדימות.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־7.5 גיגה בייט בפורמט GGUF, כך שתוכלו להריץ אותו ישירות על מעבד מקומי או על כרטיס מסך ביתי צנוע בעזרת תוכנות תואמות. נפח הזיכרון הנדרש קטן מאוד לעומת מודלים גדולים, מה שהופך אותו לנגיש כמעט בכל מחשב פיתוח מודרני.

אם אתם צריכים רק פתרון מהיר למשימה נקודתית בלי תחזוקה, קריאה לשירות ענן מנוהל תחסוך את הטרחה. הרצה עצמית שווה את המאמץ אם אתם עובדים אופליין או בודקים התנהגות של שרשראות חשיבה מקומיות.

ollama run hf.co/Jackrong/Qwen3.5-2B-Claude-4.6-Opus-Reasoning-Distilled-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי בקוד ובמשקלים, כולל שינוי, הפצה ושילוב במוצרים מסחריים, בכפוף להשארת הודעת זכויות היוצרים המקורית. יחד עם זאת, יוצר המודל כתב בכרטיס שהוא מיועד למחקר אקדמי בלבד, מה שיוצר חוסר בהירות שכדאי לבחון לפני שילוב במוצר ייצורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗