GPT
H

Hy-MT2-30B-A3B

קוד פתוח

tencentapache-2.02026-05-11

  • transformers
  • safetensors
  • hy_v3
  • text-generation
  • translation

מודל תרגום מבוסס תערובת מומחים עם חלון הקשר עצום, שמכוון לתרגום לפי הוראות מחמירות. הוא מתאים למי שחייב לשמור על מבנה נתונים וטרמינולוגיה מקצועית בלי הזיות מסביב.

  • 30Bפרמטרים
  • 262,144טוקנים בהקשר
  • 56.0 GBמשקל הקבצים
  • 16,558הורדות בחודש

מה זה

מדובר במודל שמיועד למשימות תרגום מורכבות בין 33 שפות, וכולל ארכיטקטורת MoE בגודל כולל של 30 מיליארד פרמטרים. בניגוד למודלי שיחה רחבים שמוסיפים הקדמות והסברים, הוא אומן לפלוט ישירות את התוכן המתורגם בלבד, תוך התחשבות במילוני מונחים, סגנון רצוי והנחיות משתמש מפורטות.

לפי המדידות של טנסנט, בביצועי תרגום מהירים הוא עוקף מודלים פתוחים מוכרים כמו DeepSeek-V4-Pro ו־Kimi K2.6. המשמעות בפועל היא יכולת גבוהה לתרגם מבני נתונים שלמים, קבצי קוד או טקסטים עם מפרידים בלי להרוס את התחביר, לצד תמיכה רשמית בעברית ברשימת השפות.

מתאים ל

  • לוקליזציה של קבצי קוד

    תרגום מחרוזות בתוך מבני נתונים בלי לפגוע במפתחות, בתגיות ובמשתנים המושתלים.

  • תרגום טכני עם מילון מונחים

    שמירה על עקביות מושגים מקצועיים באמצעות תבניות פרומפט ייעודיות לטרמינולוגיה.

  • עיבוד מסמכים ארוכים

    תרגום טקסטים מקיפים במכה אחת בזכות תמיכה בהקשר של 262,144 טוקנים.

איפה זה נופל

המודל הזה מוגדר אך ורק למשימות תרגום. הוא לא מודל צ'אט, אין לו פרומפט מערכת מובנה, והוא לא יספק ניתוחים או יענה על שאלות ידע כללי. בנוסף, חלון ההקשר העצום שלו, מעל 260 אלף טוקנים, תובעני מאוד בזיכרון אם מנסים למלא אותו. תצטרכו לבדוק בעצמכם את איכות התרגום לעברית לפני העלייה לייצור, כי מרבית הדוגמאות והדגשים של המפתחים מתמקדים בציר שבין סינית לאנגלית.

אותה משפחה

Hy-MT2 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בתרגום לעברית וממנה?

כן, עברית מופיעה באופן רשמי ברשימת השפות הנתמכות של המודל. עם זאת, הדגש המרכזי של המפתחים הוא סינית ואנגלית, ולכן כדאי לבחון היטב את איכות הפלט בעברית על דוגמאות מהמוצר שלכם.

איזו חומרה מינימלית נדרשת להרצה מקומית?

המשקולות המקוריות שוקלות 56 גיגה-בייט, כך שדרוש כרטיס מסך של 80 גיגה-בייט זיכרון דוגמת A100 או H100. אם תבחרו להשתמש בגרסת ה־FP8 הרשמית של טנסנט, תוכלו להסתפק בכרטיס עם נפח זיכרון קטן יותר.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־56 גיגה-בייט בפורמט bfloat16, כך שאי אפשר להריץ אותו על כרטיס ביתי פשוט. תצטרכו כרטיס שרת מקצועי עם לפחות 80 גיגה-בייט זיכרון, או לחלופין לפנות לגרסת ה־FP8 שמקצצת בדרישות הזיכרון.

ההרצה הנתמכת דורשת גרסת transformers חדשה, 5.6.0 ומעלה, עם הרשאת trust_remote_code עקב הארכיטקטורה הייעודית. אפשר גם להרים שרת ייעודי דרך vLLM או SGLang ישירות מקוד המקור, אך אם נפח התרגום שלכם נמוך מכדי להצדיק שרת תופח בענן, קריאה לשירות מנוהל תהיה זולה ופשוטה בהרבה.

from transformers import pipeline

pipe = pipeline("translation", model="tencent/Hy-MT2-30B-A3B")
print(pipe("שלום"))

הקבצים

102 קבצים במאגר, 56.0 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד והמשקולות, ואפילו לשלב אותו בתוך מוצר סגור. התנאי היחיד הוא שמירה על הודעות זכויות היוצרים וציון הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗