GPT
H

Hy-MT2-1.8B-1.25Bit-GGUF

קוד פתוח

tencentapache-2.02026-05-20

  • gguf
  • endpoints_compatible
  • conversational

מודל תרגום קומפקטי שמכוון להרצה מקומית על מעבדים פשוטים. הוא שוקל פחות מחצי גיגה ותומך בעשרות שפות כולל עברית.

  • 444 MBמשקל הקבצים
  • 5,009הורדות בחודש
  • 45לייקים

מה זה

מדובר בגרסה מכווצת ברמה קיצונית של 1.25 ביט מבית טנסנט, שמתבססת על מודל תרגום של 1.8 מיליארד פרמטרים. הכיווץ הזה מביא את נפח הקבצים לכדי 444 מגה בייט בלבד ומאיץ את ההסקה פי 1.5 בהשוואה למודל המקורי, כשהוא מתמקד בביצועי תרגום מהירים בלי צורך במחשוב כבד.

לפי הנתונים שהחברה מציגה, הגרסה הקלה הזו מציגה רמת תרגום כוללת שמנצחת ממשקים מסחריים מוכרים של מיקרוסופט ודואובאו, ומסוגלת להתמודד עם הנחיות עיצוב, מונחים ייעודיים ושמירה על מבני נתונים. הרשימה שלו כוללת 33 שפות, וביניהן שפות כמו עברית, ערבית ורוסית, לצד השפות הנפוצות במערב ובאסיה.

מתאים ל

  • תרגום במכשיר קצה

    הוא שוקל 444 מגה בלבד ורץ ישירות על מעבדים חלשים בלי חיבור רשת פעיל.

  • לוקליזציה של קבצי מבנה

    הוא יודע להחליף טקסט גלוי תוך הקפדה על שמירת המפתחות והתחביר של הפורמט.

  • תרגום עברית ואנגלית אופליין

    תמיכה ישירה בעברית יחד עם דרישות זיכרון שמתאימות לכל שרת בסיסי.

איפה זה נופל

קוונטיזציה של 1.25 ביט היא דחיסה אגרסיבית מאוד. מודלים ברמות דיוק כאלה נוטים לסבול מאיבוד חדות בניואנסים מורכבים, ולמרות התוצאות שהמפתחים מציגים, חשוב לבדוק את איכות התרגום בעברית לפני שסומכים עליו בייצור. בנוסף, המודל הזה הוכשר כמעט נטו למשימות תרגום, כך שלא תפיקו ממנו שום תועלת כעוזר שיחה כללי או כמנוע כתיבה.

שאלות
נפוצות

האם המודל ירוץ ישר בכל גרסה של llama.cpp?

לא. הקובץ מסתמך על מימוש STQ ספציפי שמופיע ב־PR ייעודי. תצטרכו להוריד את הקוד מהמאגר ולקמפל אותו בעצמכם כדי שהוא יעבוד.

האם הוא מסוגל לתרגם מסמכים תוך שמירה על מונחים מקצועיים?

כן, המודל תוכנן לעקוב אחרי הנחיות תרגום ייעודיות. אפשר להגדיר לו מילון מונחים בפורמט ההנחיה והוא ישלב אותם בטקסט הסופי לפי ההוראות.

איך מריצים

בשביל להריץ אותו דרך llama.cpp, לא מספיק להוריד גרסה רשמית ישנה. ההרצה דורשת בנייה של הקוד ממאגר שכולל את קרנל ה־STQ הייעודי שפותח עבור הקוונטיזציה הזו, כפי שמופיע בהצעת השינוי מספר 22836 בפרויקט.

דרישות החומרה כאן מינימליות לחלוטין. הוא נכנס בקלות לזיכרון של לפטופ סטנדרטי או טלפון ומסוגל לרוץ על המעבד בלבד בלי כרטיס גרפי. אם אין לכם כוח להרכיב סביבות פיתוח מקומיות מאפס, שירות ענן חיצוני פשוט יחסוך את כאב הראש.

ollama run hf.co/tencent/Hy-MT2-1.8B-1.25Bit-GGUF:Hy-MT2-1.8B-1.25Bit

הקבצים

45 קבצים במאגר, 444 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו ולשלב אותו במוצרים סגורים בלי לשלם תמלוגים, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗