GPT
H

HY-MT1.5-7B

קוד פתוח

tencentרישיון לא דווח2025-12-25

  • transformers
  • safetensors
  • hunyuan_v1_dense
  • text-generation
  • translation

מודל תרגום ייעודי מבית טנסנט בגודל 8 מיליארד פרמטרים, שתומך בעשרות שפות וכולל עברית. הוא מתאים למי שרוצה לשלוט במינוחים ולתרגם טקסטים ארוכים בלי להסתמך על ספקי צד שלישי.

  • 8Bפרמטרים
  • 262,144טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 1,989הורדות בחודש

מה זה

טנסנט בנתה את המודל הזה על בסיס ארכיטקטורת HunYuanDenseV1 במטרה להתחרות ישירות במערכות תרגום מסחריות. הוא לא מודל שיחה כללי שמנסה לתרגם בין היתר, אלא מאומן ספציפית למשימות תרגום בין 33 שפות שונות, לצד ניבים נוספים, כאשר ברשימת השפות הנתמכות מופיעה גם עברית. המודל מתבסס על שדרוג של גרסה קודמת שזכתה בתחרות WMT25, והמיקוד שלו הוא התמודדות עם תרגום מורכב, ביטויים מעורבי שפות, והתאמה להקשר רחב.

היתרון המרכזי כאן מול מודלים כלליים באותו סדר גודל הוא השליטה בפלט. טנסנט הטמיעה בו יכולות מובנות להזרקת מילוני מונחים מראש, שמירה על תגיות עיצוב בתוך הטקסט המתורגם ותרגום בהתבסס על הקשר קודם בלי לתרגם את ההקשר עצמו. חלון ההקשר עומד על 262,144 טוקנים, מה שמאפשר להזין מסמכים שלמים בלי לחתוך אותם למקטעים קטנים, כל עוד משתמשים בפרומפטים המדויקים שהוגדרו עבורו.

מתאים ל

  • תרגום טכני עם מונחון

    הזרקת מילון מונחים ישירות לפרומפט מאפשרת לכפות תרגום אחיד של מונחים מקצועיים.

  • לוקליזציה של קובצי ממשק

    המודל שומר על תגיות עיצוב ומבנה פנימי בתוך הטקסט בלי לשבור את הקוד.

  • תרגום מסמכים פנימי

    הרצה מקומית ומאובטחת בארגון עבור שפות נתמכות, כולל עברית, בלי להוציא מידע החוצה.

איפה זה נופל

המודל הזה רגיש מאוד לתבנית הפנייה. אין לו system prompt ברירת מחדל, ואם לא תשתמשו בדיוק בנוסחי הפרומפט שהוגדרו עבורו, איכות התרגום עלולה לרדת או שהוא יתחיל לייצר הסברים מיותרים במקום פלט נקי. בנוסף, חלון ההקשר העצום דורש זיכרון גרפי עצום בפועל, כך שלא תוכלו לנצל את מלוא האורך על כרטיס בודד. כמו כן, טנסנט כבר הכריזה בעמוד על סדרת Hy-MT2 החדשה יותר, מה שאומר שהגרסה הזו עשויה לא לקבל עדכונים נוספים בעתיד.

אותה משפחה

HY-MT1.5 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מתאים לשימוש כעוזר שיחה כללי?

לא. הארכיטקטורה והאימון שלו מיועדים אך ורק למשימות תרגום. אם תנסו לנהל איתו שיחה, לכתוב קוד או לסכם מאמרים, תקבלו תוצאות ירודות בהרבה ממודל שפה כללי באותו הגודל.

האם יש תמיכה ישירה בעברית?

כן, עברית מופיעה ברשימת השפות הנתמכות של המודל. עם זאת, התבניות הרשמיות מוגדרות בעיקר לתרגום מול אנגלית וסינית, ולכן כדאי לבדוק את איכות התרגום הישיר מול שפות אחרות לפני שילוב במערכת.

איך מריצים

כדי להריץ את המודל בדיוק המקורי של bfloat16 תצטרכו כרטיס מסך עם לפחות 24 גיגה זיכרון, כמו RTX 3090 או A10, שכן המשקולות לבדן תופסות כ־15 גיגה לפני שמחשבים את זיכרון ההקשר. המפתחים שחררו גם גרסאות מכווצות ב־FP8 וב־Int4, שמורידות משמעותית את דרישות החומרה ומאפשרות הרצה על כרטיסים צרכניים זולים יותר.

ההרצה מתבצעת דרך ספריית transformers הרגילה בפייתון, כשטנסנט ממליצים על גרסה 4.56.0. אם אתם צריכים תרגום מזדמן של כמה משפטים ביום, אין טעם להחזיק שרת ייעודי ומוטב לקרוא ל־API חיצוני. ההרצה המקומית משתלמת ברגע שמתעורר צורך בפרטיות מידע מוחלטת, אבטחה פנימית בארגון, או עבודה בעומסים גבוהים שבהם עלות לפי טוקן הופכת ליקרה מדי.

from transformers import pipeline

pipe = pipeline("translation", model="tencent/HY-MT1.5-7B")
print(pipe("שלום"))

הרישיון

הרישיון לא דווח בעמוד המודל. מבחינה משפטית, היעדר רישיון מפורש מונע שימוש מסחרי בטוח או הפצה של המודל בתוך מוצר, שכן כל הזכויות שמורות לטנסנט. עד שהחברה לא תפרסם רישיון ברור, אפשר להשתמש בו בעיקר לבדיקות פנימיות ולמחקר.

הרישיון המלא בעמוד המודל ↗