GPT
J

Jan-code-4b-gguf

קוד פתוח

janhqapache-2.02026-03-02

  • transformers
  • gguf
  • agent
  • text-generation
  • en

מודל קוד קטן שנועד לרוץ מקומית בלי לחנוק את החומרה. הוא מתאים למי שמחפש עובד מהיר למשימות פיתוח מוגדרות או תחליף מקומי למודלים קלים ברשת.

  • 46.8 GBמשקל הקבצים
  • 13,990הורדות בחודש
  • 69לייקים

מה זה

מדובר במודל שעבר התאמה ייעודית לכתיבת קוד על בסיס Jan-v3-4B-base-instruct. המטרה כאן היא לא להתחרות בענקים של מאות מיליארדי פרמטרים, אלא לתת מענה פרקטי ומקומי לעבודה שוטפת: כתיבת פונקציות, עריכה, שכתוב ודיבאגינג מהיר, בלי זמני המתנה ארוכים ובלי לשלוח קוד החוצה.

בסביבות של סוכני תוכנה הוא מיועד לתפקד כמנוע ביצוע משני שמייצר טלאים ובדיקות בזמן שמודל גדול מתכנן את הארכיטקטורה. היוצרים מציעים אותו גם כחלופה מקומית למודל כמו הייקו בתוך תהליכי עבודה של Claude Code, בעיקר עבור משימות קוד תכליתיות שלא דורשות חשיבה מופשטת מורכבת.

מתאים ל

  • סוכן משני לבדיקות וטלאים

    מייצר בדיקות יחידה ותיקונים מהירים מקומית בזמן שמודל ענן מנהל את התכנון.

  • שכתוב ותיקון שגיאות מקומי

    עורך קוד קיים ומאתר באגים ישירות במחשב בלי לחשוף קבצים לרשת.

  • תחליף מקומי להייקו

    משתלב בסביבות עבודה מבוססות סוכנים כדי לחתוך עלויות של מודלים מסחריים קלים.

איפה זה נופל

היוצרים מדגישים שהמודל מיועד למשימות מוגדרות ותחומות היטב, ולא לתכנון רחב היקף. לא כדאי לצפות ממנו לבנות ארכיטקטורה מורכבת של פרויקט שלם או להבין הקשרים עמוקים בבסיס קוד ענקי. בנוסף, המודל אומן באנגלית בלבד, כך שאין לצפות ממנו להבין שאלות, הערות או תיעוד בעברית, וחובה לבדוק את איכות הקוד שהוא מייצר לפני שמשלבים אותו במוצר.

אותה משפחה

Jan-code יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעבודה עם פרויקטים בעברית?

המודל מוגדר לשפה האנגלית בלבד. הוא מסוגל לעבד קוד כרגיל, אבל הערות בקוד, שמות משתנים או הוראות שנכתבו בעברית עלולים לשבש את התוצאות, ולכן מומלץ לעבוד מולו באנגלית בלבד.

איזה מחשב צריך כדי להריץ אותו?

בזכות גודל של 4 מיליארד פרמטרים ופורמט GGUF, המודל דורש מעט מאוד משאבים. כרטיס מסך בסיסי או מחשב נייד מודרני עם שמונה עד שישה עשר גיגה זיכרון יריצו אותו בצורה חלקה דרך אפליקציית Jan או llama.cpp.

איך מריצים

את קבצי ה־GGUF מריצים בקלות דרך llama-server או בתוך אפליקציית Jan Desktop, ויש גם תמיכה בהרצה דרך vLLM עם קריאות לכלים בפורמט הרמס. מודל של 4 מיליארד פרמטרים רץ בנוחות על כרטיס מסך ביתי צנוע או ישירות על המעבד והזיכרון של מחשב נייד מודרני, כך שאין צורך בשרתים ייעודיים.

היוצרים ממליצים על טמפרטורה של 0.7 עם top_p של 0.8 ו־top_k של 20 כדי לקבל איזון יציב. אם המטרה היא לתכנן מערכת שלמה מאפס או לפתור בעיות לוגיות סבוכות במיוחד, עדיף להשתמש ב־API של מודל ענן גדול, כי הגודל הפיזי של המודל הזה מגביל את עומק ההסקה שלו.

ollama run hf.co/janhq/Jan-code-4b-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים בלי לשלם תמלוגים, כל עוד שומרים על הודעת זכויות היוצרים ונוסח הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗