GPT
K

KORMo-10B-sft

קוד פתוח

KORMo-Teamapache-2.02025-10-12

  • transformers
  • safetensors
  • kormo
  • text-generation
  • conversational

מודל פתוח לגמרי של 11 מיליארד פרמטרים שמתמקד בקוריאנית ואנגלית. הוא מציע שקיפות מלאה באימון יחד עם חלון הקשר ענקי של 131 אלף טוקנים.

  • 11Bפרמטרים
  • 131,072טוקנים בהקשר
  • 20.0 GBמשקל הקבצים
  • 557הורדות בחודש

מה זה

הפרויקט הזה מגיע ממעבדת מחקר במוסד KAIST, והמטרה שלו ברורה: לספק חלופה פתוחה לחלוטין למודלים הקוריאניים הקיימים. הצוות שחרר לא רק את המשקלים של שלב הכוונון, אלא גם את נתוני האימון המקדימים בהיקף של כמעט 4 טריליון טוקנים, הקוד והמדריכים. הארכיטקטורה כוללת 40 שכבות ומציעה מצב חשיבה מובנה דרך תבנית השיחה, תכונה שלא רואים בכל מודל בגודל כזה.

במבחנים באנגלית המודל עומד על ממוצע של 63.45 נקודות, תוצאה סבירה לגודל שלו שמשתווה למודלים כמו olmo2 בגרסת 13B. בקוריאנית הוא מגיע לממוצע של 58.15 נקודות במבחנים כמותיים וציון של 8.61 בהערכת שופט, מה שמציב אותו מעל מודלים מערביים מקבילים בגודל דומה, אבל עדיין מתחת לחלק מהמתחרים האסייתיים כמו qwen3 או kanana.

מתאים ל

  • תרגום וניתוח קוריאנית

    הוא נבנה מאפס על טריליוני טוקנים קוריאניים ומתאים במיוחד לעבודה טכנית עם טקסטים בשפה הזו.

  • אימון והתאמה פרטית

    כל נתוני האימון והקוד פתוחים, כך שאפשר לאמן עליו מתאמים ייעודיים בלי נקודות עיוורות בבסיס.

  • עיבוד מסמכים ארוכים

    חלון של 131 אלף טוקנים מאפשר להזין תיעוד שלם או קבצי קוד ארוכים בקריאה יחידה.

איפה זה נופל

הכרטיס מודה בפירוש שהמודל לא עבר יישור העדפות אנושי או התאמות בטיחות. בפועל, במשימות היגיון מורכבות אתם תראו חזרתיות מיותרת בתשובות ואיכות ירודה לפעמים. בנוסף, המודל אומן רק על אנגלית וקוריאנית, כך שאין מה לבנות עליו למשימות בעברית, ולפני כל שימוש מול משתמשי קצה תצטרכו לבנות שכבת סינון משלכם.

אותה משפחה

KORMo יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה לעיבוד טקסטים בעברית?

לא מומלץ בכלל. נתוני האימון התמקדו בקוריאנית ובאנגלית בלבד, ואין לו את הידע או התחביר הדרושים להפקת תוצאות טובות בעברית.

האם הוא מוכן לשימוש ישיר מול לקוחות בצ'אט?

לא מומלץ לחבר אותו ישירות למשתמשי קצה. המפתחים מציינים שהוא לא עבר סינון בטיחות או יישור העדפות, ולכן הוא עלול לפלוט תוכן לא מתאים או להיתקע בלולאות חזרתיות.

איך מריצים

כדי להריץ אותו בפורמט המקורי עם bfloat16 תצטרכו כרטיס מסך עם לפחות 24 גיגה זיכרון, כמו RTX 3090 או כרטיס שרתים מקביל, מאחר שהמשקלים תופסים 20 גיגה נקיים בלי לחשב את זיכרון ההקשר. הטעינה נעשית דרך ספריית transformers הרגילה, אך דורשת הפעלה של trust_remote_code בגלל ארכיטקטורה מותאמת אישית.

אם אתם רוצים רק לשלב אותו במוצר בלי להתעסק בתחזוקת חומרה או אם אין לכם צורך ספציפי בנתוני האימון השקופים, עדיף להשתמש במודל מסחרי דרך ממשק קיים. הריצה המקומית מתאימה רק למי שחייב שליטה מלאה בשרת או רוצה לאמן שכבות התאמה בעצמו על בסיס המחברת שהצוות פרסם.

from transformers import pipeline

pipe = pipeline("text-generation", model="KORMo-Team/KORMo-10B-sft")
print(pipe("שלום"))

הרישיון

המודל משוחרר תחת רישיון Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן אותו מחדש ולחלק אותו בתוך מערכות סגורות, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗