GPT
H

Hy-MT2-1.8B

קוד פתוח

tencentapache-2.02026-05-11

  • transformers
  • safetensors
  • hunyuan_v1_dense
  • text-generation
  • translation

מודל תרגום קומפקטי שמכוון לביצועים מהירים בעבודה עם שפות מרובות. הוא מתאים למי שרוצה להריץ מנגנון תרגום ישירות על חומרה מקומית או בקצה בלי תלות ברשת.

  • 2Bפרמטרים
  • 262,144טוקנים בהקשר
  • 3.8 GBמשקל הקבצים
  • 22,984הורדות בחודש

מה זה

מדובר במודל שפותח ייעודית למשימות תרגום ותמיכה בהוראות מורכבות, ולא בצ'אטבוט כללי. הוא עובד על ארכיטקטורת HunYuanDenseV1 ותומך בתרגום בין עשרות שפות, כולל עברית שמופיעה ברשימת השפות הנתמכות שלו, למרות שבתגיות המאגר סומנו רק שמונה שפות עיקריות. המטרה כאן היא לתת תרגום נקי בלי שיחות מיותרות מסביב, תוך שמירה על מבני נתונים, מונחים מקצועיים ומפרידים בטקסט.

לפי הנתונים של טנסנט, הגודל הקטן הזה מצליח לעקוף במבחני ביצועים כלליים שירותי תרגום מסחריים מוכרים של חברות כמו מיקרוסופט ודואובאו. זה הישג משמעותי למשקל כזה, בעיקר כי הוא מתוכנן לעקוב אחרי פורמטים קשיחים כמו ג'ייסון או קוד בלי לשבור מפתחות ומשתנים בזמן התרגום.

מתאים ל

  • תרגום ממשקים וקובצי קוד

    הוא יודע לשמר מפתחות, תגיות ומבנה של קובצי JSON בלי לתרגם שמות של משתנים.

  • מנוע תרגום פנימי ומאובטח

    מתאים לשרתים פנימיים בארגון שחייבים לתרגם טקסטים רגישים בלי להוציא מידע ל־API חיצוני.

  • עיבוד תרגום במכשירי קצה

    גרסת ה־GGUF המכווצת שוקלת רק 440 מגה בייט ומתאימה לאפליקציות שרצות מקומית ללא רשת.

איפה זה נופל

הפרומפטים שהמודל הוכשר לפיהם דורשים מבנה קשיח ומפורש, בעיקר בסינית או באנגלית, עם ציון השפות המלאות והוראות מפורשות לא לפלוט הסברים. אם תשלחו אליו בקשות פתוחות או תנסו להשתמש בו למשימות יצירת תוכן שאינן תרגום נטו, התוצאות יהיו לא צפויות. בנוסף, חלון ההקשר עומד על 262,144 טוקנים, אבל תרגום מסמכי ענק בבת אחת עלול לדרוש זיכרון עבודה משמעותי שלא תואם את הריצה המהירה של משקל ה־1.8B.

אותה משפחה

Hy-MT2 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל באמת מבין עברית?

עברית רשומה באופן רשמי בטבלת השפות הנתמכות על ידי צוות הפיתוח, למרות שבתגיות העמוד הראשי של המאגר הופיעו רק שפות בולטות אחרות. כדאי להריץ בדיקות על אוצר המילים הספציפי שלכם לפני פריסה, כי עיקר הדוגמאות וההוראות מתרכזות בציר שבין סינית לאנגלית.

האם אני צריך פרומפט מערכת מיוחד כדי שהוא יתרגם טוב?

היצרן מדגיש שלמודל אין ברירת מחדל של פרומפט מערכת. במקום זה צריך לשלוח את ההוראות ישירות בפרומפט המשתמש לפי התבניות המוגדרות, יחד עם פרמטרים של טמפרטורה 0.7 וחזרתיות 1.05.

איך מריצים

המשקל המקורי עומד על 3.8 ג'יגה בייט בפורמט bfloat16, כך שכרטיס מסך בסיסי או מחשב פיתוח רגיל יריצו אותו בלי מאמץ דרך transformers, vLLM או SGLang. יש לו גרסאות מכווצות בפורמט GGUF שמגיעות עד 1.25 ביט דרך כלי הדחיסה AngelSlim, מה שמוריד את גודל הקובץ ל־440 מגה בייט בלבד ומאפשר דחיפה ישירה למכשירי קצה וטלפונים.

ההרצה דרך transformers מחייבת גרסה 5.6.0 ומעלה ודורשת הרשאת הרצת קוד מרוחק. אם אתם מתכננים נפחי עבודה גדולים בשרת, תצטרכו לקמפל את vLLM או SGLang מהמקור כדי לקבל שרת תרגום מהיר, ובמקרים של עומסים רגעיים קיצוניים שבהם אין לכם תשתית מוכנה, שירותי ענן חיצוניים יחסכו את כאב הראש התפעולי הזה.

from transformers import pipeline

pipe = pipeline("translation", model="tencent/Hy-MT2-1.8B")
print(pipe("שלום"))

הקבצים

51 קבצים במאגר, 3.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט משוחרר ברישיון apache-2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה של המודל במוצרים סגורים בלי עלות, בתנאי ששומרים על הודעות זכויות היוצרים וההצהרה המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗