GPT
K

Kimi-Dev-72B-GGUF

קוד פתוח

unslothmit2025-06-17

  • gguf
  • code
  • unsloth
  • swebench
  • software

גרסת GGUF למודל קוד פתוח של 72 מיליארד פרמטרים שמתמחה בפתרון תקלות תוכנה. הוא נבנה כדי להתמודד ישירות עם מאגרי קוד אמיתיים ולתקן באגים.

  • 871 GBמשקל הקבצים
  • 24,061הורדות בחודש
  • 63לייקים

מה זה

מדובר במודל שפותח במקור על ידי צוות Kimi והומר לפורמט GGUF על ידי unsloth. המטרה המרכזית שלו היא משימות הנדסת תוכנה מעשיות, בדגש על פתרון בעיות מורכבות מקצה לקצה בתוך מאגרי קוד שלמים.

לפי נתוני הכרטיס, הוא מגיע לתוצאה של 60.4% במבחן SWE-bench Verified, מה שמציב אותו במקום הראשון מבין מודלי הקוד הפתוח שנבדקו שם. הפיתוח שלו כלל למידת חיזוק בסביבות Docker אמיתיות, כשהתגמול ניתן רק אם כל בדיקות התוכנה עברו בהצלחה, מה שאמור לייצר פתרונות יציבים יותר שלא שוברים קוד קיים.

מתאים ל

  • תיקון אוטומטי של תקלות קוד

    הוא אומן להריץ בדיקות במאגרי תוכנה אמיתיים ולספק טלאים שעוברים את כל מבחני היחידה.

  • בדיקת Pull Requests

    התוצאה הגבוהה ב־SWE-bench Verified הופכת אותו למועמד טוב לסריקה ותיקון של שגיאות לפני מיזוג.

  • סביבות פיתוח מבודדות מקומית

    פורמט GGUF מתאים לצוותים שחייבים להריץ כלי פיתוח על שרתים פנימיים ללא גישה לרשת חיצונית.

איפה זה נופל

הכרטיס מדגיש תוצאות מרשימות בפתרון באגים במאגרים קיימים, אבל הדוח הטכני המלא עדיין לא פורסם. אין כרגע פירוט לגבי ביצועים ביצירת פרויקטים מאפס, יכולות בשפות תכנות נידחות, תמיכה בעברית או התנהגות מחוץ למשימות בדיקה קלאסיות של הנדסת תוכנה.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב פיתוח רגיל?

לא באופן מעשי. מודל בגודל 72B דורש עשרות גיגה בייטים של זיכרון עבודה ייעודי במאיצים גרפיים, כך שמחשב נייד סטנדרטי לא יוכל להריץ אותו במהירות סבירה.

מה המשמעות של התוצאה במבחן SWE-bench?

התוצאה מעידה על יכולת לקבל תיאור תקלה ומאגר קוד קיים, לאתר את שורש הבעיה ולכתוב תיקון שעובר את הבדיקות האוטומטיות ב־60.4% מהמקרים שנבדקו.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־871 גיגה בייט שכוללים גרסאות שונות בשיטת Unsloth Dynamic 2.0. כדי להריץ מודל של 72B אפילו בכימות בינוני, תצטרכו לפחות 40 עד 48 גיגה בייט של זיכרון גרפי ייעודי, או שרת עם מספר מאיצים, אחרת הביצועים יזחלו למהירות בלתי שמישה.

אם אין לכם חומרת שרתים מקומית זמינה שמוכנה לעומס כזה, החזקת המודל בעצמכם תהיה יקרה ומסורבלת, ובמקרים כאלה עדיף לשקול שימוש ב־API חיצוני של ספק שמארח אותו.

ollama run hf.co/unsloth/Kimi-Dev-72B-GGUF:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל משוחרר ברישיון MIT. זהו רישיון מתירני מאוד שמאפשר שימוש מסחרי, שינוי הקוד, הפצה והטמעה במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗