GPT
Q

Qwen3.6-27B-NEO-CODE-Di-IMatrix-MAX-GGUF

קוד פתוח

DavidAUapache-2.02026-04-23

  • transformers
  • gguf
  • benchmarks
  • bfloat16
  • all use cases

גרסת קוונטיזציה מכוילת של מודל קוד וראייה בגודל עשרים ושבעה מיליארד פרמטרים. הוא מיועד למי שרוצה ביצועי פיתוח חזקים בלי לאבד יציבות בשיחות ארוכות.

  • 170 GBמשקל הקבצים
  • 2,387הורדות בחודש
  • 74לייקים

מה זה

מדובר במודל שפת קוד שכולל גם מפענח ראייה מובנה, מבוסס על סדרת הדגמים של צוות קוון ועבר כאן המרה לפורמט מכווץ עם כיול מיוחד. היוצר שילב שני מאגרי נתונים שונים כדי לבנות מטריצת חשיבות כפולה, במטרה למנוע קריסה של ההגיון הפנימי בשאילתות מורכבות. המודל מתמודד עם קריאת תמונות לצד טקסט ומגיע עם חלון הקשר ענקי של מאתיים חמישים ושבעה אלף טוקנים בבסיס.

במדדי ההשוואה מול המודל המקורי בדיוק מלא, הגרסאות הבינוניות שומרות על רמת דיוק מרשימה. גרסת שמונה ביט שומרת על יותר מתשעים ושמונה אחוזים מבחירת המילים המקורית, ואפילו גרסאות ארבעה ביט נשארות באזור התשעים וארבעה אחוזים. המשמעות בשטח היא שמקבלים כושר ניתוח תוכנה ופתרון באגים שקרוב מאוד למקור, בלי לשלם בטעויות חישוב קיצוניות בקצוות.

מתאים ל

  • סוכן תכנות מקומי

    מתאים לעבודה בתוך סביבות פיתוח ומאגרי קוד שלמים, בזכות ציונים גבוהים במבחני פתרון בעיות הנדסיות.

  • ניתוח צילומי מסך וקוד

    מאפשר לשלב בין תמונות ממשק לטקסט ולזהות תקלות ויזואליות בעיצוב אתרים ישירות מהקוד.

  • עבודה עם הקשרים ענקיים

    מסוגל לעבד מסמכי תיעוד ארוכים מאוד בלי לאבד את ההיגיון הפנימי, בזכות חלון הקשר עצום.

איפה זה נופל

היוצר עצמו מציין בעמוד שהמודל הזה כבר נעקף בפער ניכר על ידי גרסה חדשה יותר שלו בשם שבע מאות ואחת עשרה. בנוסף, מדובר במודל שמאומן רשמית על אנגלית וסינית בלבד, כך שאין שום ערובה לעבודה תקינה בעברית. היכולת הוויזואלית תלויה לחלוטין בקובץ עזר חיצוני שאינו מוטמע ישירות בקובץ הראשי.

שאלות
נפוצות

האם המודל יבין הוראות בעברית בצורה חלקה?

הכרטיס מצהיר על תמיכה באנגלית ובסינית בלבד. הוא עשוי לפלוט מילים בעברית, אבל בהחלט לא כדאי לבנות עליו לעיבוד שפה מקומית או למשימות קוד שמנוסחות בעברית.

איזו גרסת קובץ הכי משתלמת להורדה?

גרסת ארבעה ביט מספקת את האיזון הטוב ביותר לכרטיס מסך בודד. היא שומרת על כמעט תשעים וארבעה אחוזים מרמת הדיוק של המודל המקורי, בלי לנפח את דרישות הזיכרון.

איך מריצים

בשביל להריץ את הגרסאות הקלות של ארבעה ביט תצטרכו כרטיס מסך בודד עם עשרים וארבעה גיגה זיכרון, כמו כרטיס מדגם שלושים ותשעים או ארבעים ותשעים. אם תרצו לכוון לגרסאות הכבדות כמו שמונה ביט, תצטרכו כבר שני כרטיסים כאלה או שרת ייעודי כדי שהמודל ייכנס במלואו לזיכרון הגרפי ולא יזחל על המעבד.

אם אתם צריכים לנתח תמונות, חובה להוריד גם קובץ הקרנת ראייה תואם ולהניח אותו באותה תיקייה לצד קובץ המודל. למי שאין לו חומרה מתאימה מקומית, עדיף בהרבה לפנות למודל דרך שירות ענן חיצוני שגובה לפי שימוש, במקום לנסות לדחוף אותו בכוח לזיכרון מחשב רגיל.

ollama run hf.co/DavidAU/Qwen3.6-27B-NEO-CODE-Di-IMatrix-MAX-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון אפאצ'י שתיים אפס. מותר להשתמש בו לצרכים מסחריים, לשנות את הקבצים, להטמיע אותם בתוך מוצר פנימי או שירות שמוכרים ללקוחות, ולהפיץ הלאה. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים שתפיצו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗