GPT
H

Hy-MT1.5-1.8B-1.25bit-GGUF

קוד פתוח

AngelSlimרישיון לא דווח2026-04-28

  • gguf
  • translation
  • hy-mt
  • quant
  • 1.25bit

מודל תרגום קומפקטי שמכוון כולו למכשירי קצה וטלפונים ניידים. הוא נדחס לגודל של פחות מחצי גיגה כדי לפעול מקומית ללא שום חיבור רשת.

  • 448 MBמשקל הקבצים
  • 1,219הורדות בחודש
  • 43לייקים

מה זה

הבסיס כאן הוא מודל ייעודי לתרגום של צוות Hunyuan מבית Tencent, שתומך ב־33 שפות, 5 דיאלקטים ו־1,056 כיווני תרגום. במקום לשמור על גודל המקור שעמד על 3.3 גיגהבייט בפורמט FP16, המפתחים השתמשו באלגוריתם כימות בשם Sherry. השיטה הזו מאפסת משקל אחד מכל ארבעה ושומרת את שלושת האחרים בביט בודד, מה שיוצר ממוצע של 1.25 ביט למשקל ומכווץ את כל החבילה לכ־440 מגהבייט.

לפי המדידות שהוצגו על מבחן Flores-200 לתרגום בין סינית לשפות זרות, המודל מתעלה על מודלים פתוחים כבדים בהרבה כמו Qwen3-32B או Tower-Plus-72B, וגם על שירותי ענן כמו אלה של מיקרוסופט. המשמעות בפועל היא שאיכות התרגום הממוקדת נשמרת ברמה גבוהה מאוד ביחס למשקל הזעיר שלו, מבלי לשלם את המחיר הרגיל של אובדן דיוק בכימות קיצוני.

מתאים ל

  • תרגום אופליין באפליקציות

    משקל של 440 מגהבייט שמאפשר להריץ תרגום שלם על טלפונים ניידים ללא חיבור לאינטרנט.

  • חילוץ ותרגום טקסטים ברקע

    צריכת משאבים מינימלית על המעבד שמתאימה להאזנה להודעות ומיילים ותרגום שלהם בלי להכביד.

  • עיבוד מקומי של מידע רגיש

    המידע נשאר על המכשיר ולא נשלח לשרת חיצוני, מתאים למקרים שבהם הפרטיות היא תנאי סף.

איפה זה נופל

זהו מודל תרגום בלבד ולא מודל שיחה כללי, כך שאין מה לבקש ממנו לסכם, לכתוב קוד או לענות על שאלות. התלות שלו בקרנל STQ בתוך llama.cpp מייצרת נקודת תורפה, כי כל עוד השינוי לא מוזג רשמית לפרויקט המרכזי, אתם כבולים לגרסה מותאמת ידנית. בנוסף, המבחנים שפורסמו מתמקדים בעיקר בתרגום בין סינית לשפות זרות, מה שמחייב בדיקה מעשית של איכות התרגום בשפות אחרות לפני שמשלבים אותו במערכת.

אותה משפחה

Hy-MT1.5-1.8B-1.25bit יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את קובץ ה־GGUF הזה ישירות בכל גרסה של llama.cpp?

לא. המודל דורש קרנל ייעודי בשם STQ1_0 לפענוח הכימות של 1.25 ביט. צריך להוריד את הקוד מענף ה־Pull Request שהם הגישו לפרויקט ולקמפל אותו בעצמכם כדי שהוא יעבוד.

האם המודל מתאים למשימות צ'אט או כתיבה?

לא, מדובר במודל שאומן וכוונן אך ורק למשימות תרגום בין שפות. הוא לא מיועד לנהל שיחות, לענות על ידע כללי או לכתוב טקסטים מאפס.

איך מריצים

בשביל להריץ אותו לא צריך כרטיס גרפי ייעודי. הוא נבדק ועובד על מעבדי מובייל כמו Snapdragon 865 או 888 עם 8 גיגה זיכרון, ורץ כולו על ה־CPU. יחד עם זאת, ההרצה דורשת קרנל ייעודי בשם STQ1_0, ולכן אי אפשר להשתמש בגרסה הראשית של llama.cpp בלי למשוך ולקמפל ידנית את ענף ה־Pull Request הספציפי שהם פתחו.

קיימת גם גרסת 2 ביט ששוקלת 574 מגהבייט למי שרוצה עוד קצת יציבות. אם הפרויקט שלכם יושב בשרת ודורש עומס תרגום מסיבי בלי מגבלת חומרה או פרטיות, עדיף פשוט לפנות לשירות ענן קיים ולחסוך את הקימפול והתחזוקה של סביבת ריצה מותאמת אישית.

ollama run hf.co/AngelSlim/Hy-MT1.5-1.8B-1.25bit-GGUF:Hy-MT1.5-1.8B-1.25bit

הקבצים

5 קבצים במאגר, 448 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון של המודל לא דווח בעמוד שלו. הכרטיס אמנם מפנה לרישיון קוד פתוח של הפרויקט AngelSlim, אבל תנאי השימוש הספציפיים במשקולות המודל והתרגום אינם מוגדרים. המשמעות היא שכרגע אי אפשר להפיץ אותו במוצר מסחרי בלי להסתכן בהפרת זכויות, ומומלץ לבדוק ישירות מול Tencent לפני שימוש מעבר למחקר ולבדיקות פנימיות.

הרישיון המלא בעמוד המודל ↗