GPT
A

agentica-org_DeepCoder-14B-Preview-GGUF

קוד פתוח

bartowskimit2025-04-08

  • gguf
  • text-generation
  • en
  • endpoints_compatible
  • conversational

גרסת קוונטיזציה של מודל קוד עם 14 מיליארד פרמטרים שכולל חשיבה מובנית. מתאים למי שרוצה הרצה מקומית של יצירת קוד בלי לשלוח שורות פנימיות לשרתים חיצוניים.

  • 224 GBמשקל הקבצים
  • 2,636הורדות בחודש
  • 65לייקים

מה זה

מדובר במודל שנועד ליצירת קוד ומשימות טקסט, שעבר המרה לפורמט GGUF בעזרת גרסה b5074 של llama.cpp וטכניקת imatrix לשיפור הדיוק. המקור מגיע מארגון agentica-org וכולל 14 מיליארד פרמטרים. השם שלו כולל את הסיומת Preview, כלומר מדובר בגרסה מוקדמת שמיועדת בעיקר להערכה ובדיקות ולאו דווקא לריצה שקטה בסביבות ייצור קריטיות.

המבנה של הפרומפט חושף תכונה מרכזית. התשובה של המודל נפתחת ישירות בתוך תגית think, מה שאומר שהוא מייצר תהליך מחשבה והסקה לפני שהוא פולט את שורות הקוד עצמן. בכרטיס המודל אין מדדי ביצועים או השוואות למבחני קוד מקובלים, אלא רק בנצ'מרק של ארכיטקטורת מעבד עם מודל אחר לחלוטין שמדגים פריקה דינמית של משקלים, כך שהיכולת התכנותית האמיתית נשענת על בדיקה ישירה שלכם מול המשימות הנדרשות.

מתאים ל

  • עוזר תכנות מקומי

    כתיבת והשלמת פונקציות ישירות במחשב הפיתוח, בלי תלות ברשת ובלי לשלוח קוד רגיש החוצה.

  • ניתוח ואיתור באגים

    הפעלת המודל עם תגית החשיבה המובנית כדי לנתח לוגיקה ולמצוא כשלים בקטעי קוד באנגלית.

  • מחקר על מודלי חשיבה

    בדיקת ההשפעה של שלב הסקה פנימי במודלי קוד בגודל בינוני על גבי חומרה אישית.

איפה זה נופל

השם Preview מסגיר שמדובר במודל ניסיוני, ואין שום התחייבות ליציבות בתוצאות. המודל מוגדר עבור השפה האנגלית בלבד, ולכן הוא אינו מיועד לפרויקטים שדורשים עברית או תיעוד מקומי. מעבר לכך, חובה לעקוב במדויק אחרי תבנית הפרומפט שכוללת תגיות מיוחדות ותגית חשיבה, אחרת המודל עלול להתבלבל, לדלג על שלב הניתוח ולהחזיר קוד שבור.

שאלות
נפוצות

איזה קובץ הכי כדאי להוריד כדי לא להסתבך?

עבור רוב המחשבים, הגרסה המומלצת היא Q4_K_M שדורשת בערך 9 גיגה בייט זיכרון. היא מספקת איזון טוב בין מהירות לאיכות הקוד, ונכנסת בכרטיסי מסך סטנדרטיים של 12 גיגה בייט.

האם המודל יודע לקרוא ולכתוב הערות בעברית?

המודל מוגדר רשמית עבור אנגלית בלבד. הוא לא אומן על עברית, ולכן לא מומלץ להסתמך עליו בתיעוד, הערות או שאלות בעברית.

איך מריצים

המודל מגיע במגוון קבצים, מגרסת מקור בנפח 29.55 גיגה בייט ועד גרסאות מכווצות של 4.7 גיגה בייט. לריצה מהירה על כרטיס מסך, תצטרכו נפח זיכרון גרפי שגדול בגיגה או שניים מגודל הקובץ. הגרסה המאוזנת לרוב המשתמשים היא Q4_K_M ששוקלת 8.99 גיגה בייט ונכנסת מצוין בכרטיס עם 12 או 16 גיגה זיכרון.

אפשר לטעון את הקבצים ישירות בתוכנת LM Studio או להריץ דרך llama.cpp. גרסאות I-quant מתאימות למי שמכוון לפחות מארבעה ביטים ומריץ כרטיסי אנבידיה או AMD, אך במעבד רגיל הן יעבדו לאט יותר.

ollama run hf.co/bartowski/agentica-org_DeepCoder-14B-Preview-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

29 קבצים במאגר, 224 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

המודל מופץ תחת רישיון MIT. מדובר ברישיון קוד פתוח מתירני מאוד, שמאפשר שימוש מסחרי, שינוי הקוד והפצה חופשית בתוך מוצרים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים המקורית והרישיון בכל עותק שתפיצו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗