GPT
H

HY-MT1.5-1.8B-GGUF

קוד פתוח

tencentרישיון לא דווח2025-12-30

  • transformers
  • gguf
  • translation
  • zh
  • en

זהו מודל תרגום ייעודי וקטן של טנסנט בפורמט GGUF, שתומך גם בעברית. הוא מיועד למי שרוצה להריץ תרגום איכותי מקומית על מכשירי קצה בלי לפשוט רגל בחומרה.

  • 4.2 GBמשקל הקבצים
  • 9,493הורדות בחודש
  • 113לייקים

מה זה

מדובר במודל של 1.8 מיליארד פרמטרים שממוקד אך ורק בתרגום בין 33 שפות ועוד חמישה ניבים, כולל עברית. בניגוד למודלי שיחה כלליים בגודל הזה שמגמגמים קשות כשהם מתבקשים לתרגם, כאן כל המשקל מוקדש למשימה אחת. לפי החומר של טנסנט, הוא מגיע לאיכות שמתחרה ישירות בגרסת ה־7B שלהם ועוקפת רוב ממשקי ה־API המסחריים.

היתרון המעשי כאן הוא היכולת לעבוד עם הנחיות ספציפיות שלא תמיד קיימות במודלים קטנים: הזרקת מונחים מוגדרים מראש כדי לשמור על עקביות, תרגום עם הקשר של טקסט קודם, ושמירה על תגיות עיצוב בתוך המחרוזות.

מתאים ל

  • תרגום מקומי על מכשירי קצה

    משקל קטן של 4.2 גיגה שרץ היטב על מעבדים פשוטים בלי חיבור לרשת.

  • לוקליזציה עם מילון מונחים

    תמיכה בהזרקת מונחים קבועים ושמירה על תגיות עיצוב בתוך הטקסט.

  • תרגום שיחות בזמן אמת

    הארכיטקטורה הקלה מאפשרת מהירות תגובה גבוהה ומתאימה לזיהוי ותרגום מהיר.

איפה זה נופל

למרות שעברית מופיעה ברשימת השפות הנתמכות, תבניות הפרומפט הרשמיות של טנסנט נכתבו באנגלית ובסינית, ואין פירוט על איכות התוצאה הספציפית בעברית. מודלים בגודל 1.8B נוטים לפספס משלבים לשוניים מורכבים או סלנג מקומי. בנוסף, הוא כלי תרגום טהור, אז לא כדאי לצפות ממנו לעריכה, שכתוב סגנוני או יצירת תוכן.

אותה משפחה

HY-MT1.5 יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל באמת תומך בעברית כמו שצריך?

עברית רשומה באופן רשמי בין 33 השפות הנתמכות, אך אין בתיעוד דוגמאות או מדדי איכות ספציפיים עבורה. כדאי לבדוק אותו על מדגם טקסטים שלכם לפני שמסתמכים עליו, במיוחד סביב זכר, נקבה וסמיכויות.

במה עדיפה גרסת ה־1.8B הזו על פני גרסת ה־7B?

היא צורכת הרבה פחות זיכרון ורצה משמעותית יותר מהר על חומרה חלשה ומכשירי קצה. טנסנט מדווחים שהביצועים של הגרסה הקטנה קרובים מאוד לגרסת ה־7B, כך שמקבלים איכות טובה במחיר מחשובי נמוך בהרבה.

איך מריצים

המשקל הכולל של הקבצים עומד על 4.2 גיגה־בייט, כך שאפשר להריץ אותו בלי בעיה על מעבד רגיל, לפטופ מודרני או כרטיס מסך בסיסי עם מעט זיכרון. טנסנט מציגים תמיכה ישירה בהרצה דרך llama.cpp או משיכה ישירה לתוך Ollama עם קובץ Modelfile מתאים.

אם אתם צריכים לתרגם פעם ביום כמה פסקאות, עדיף להשתמש ב־API מוכן ולחסוך את ההתעסקות. המודל הזה משתלם כשיש לכם זרימת נתונים מקומית, צורך בזמן אמת על מכשירי קצה, או דרישות פרטיות שלא מאפשרות שליחת מידע החוצה.

ollama run hf.co/tencent/HY-MT1.5-1.8B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

6 קבצים במאגר, 4.2 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון לא דווח בעמוד המודל. המשמעות היא שאין אישור מפורש לשימוש מסחרי, ואי אפשר לדעת אם מותר להפיץ אותו בתוך מוצר סגור. כל עוד המצב המשפטי לא ברור, שילוב שלו במערכת מסחרית כרוך בסיכון.

הרישיון המלא בעמוד המודל ↗