GPT
T

translategemma-4b-it-GGUF

קוד פתוח

mradermachergemma2026-01-16

  • transformers
  • gguf
  • en
  • endpoints_compatible
  • conversational

גרסת GGUF מכווצת למודל התרגום של גוגל בסדר גודל של 4 מיליארד פרמטרים. היא מתאימה למי שצריך תרגום מקומי שלא שולח מידע החוצה ורץ על חומרה בסיסית.

  • 34.7 GBמשקל הקבצים
  • 31,851הורדות בחודש
  • 55לייקים

מה זה

המאגר הזה מציע המרות סטטיות של מודל התרגום מבוסס גמה של גוגל בגרסת ההוראות. המפתח ארז את המשקלים בפורמט שמאפשר הרצה מקומית יעילה, כשבפועל מדובר במודל ייעודי למשימות תרגום ולא בעוד מודל שיחה כללי שמנסה לעשות הכל מהתחלה.

המשקלים מגיעים ברמות דיוק שונות, מגרסאות מצומצמות מאוד בנפח של 1.8 גיגה בייט ועד לקובץ המלא בדיוק גבוה של 7.9 גיגה בייט. המאגר כולל גם קובצי תוסף מולטימודליים בנפח של פחות מגיגה בייט, שמרמזים על יכולת שילוב של קלט מעבר לטקסט רגיל, אם כי הדף לא מפרט את אופן ההפעלה שלהם.

היתרון המרכזי כאן הוא ההתמקדות במשימה אחת מוגדרת. במקום לתפוס משאבים של שרת שלם עם מודל שפה ענק של עשרות מיליארדי פרמטרים, מקבלים משקל עבודה נמוך שמתרכז בשפות, מה שמאפשר להריץ אותו בקלות לצד יישומים אחרים.

מתאים ל

  • תרגום מקומי במחשב אישי

    משקלי ארבעה ביט תופסים מעט מאוד זיכרון ומאפשרים לתרגם קבצים ישירות על המכשיר בלי חיבור לאינטרנט.

  • עיבוד מסמכים רגישים

    כל התהליך מתבצע אופליין לחלוטין, כך ששום מידע פנימי לא נשלח לשרתים חיצוניים של חברות צד שלישי.

  • שילוב במכשירי קצה

    גרסאות של שניים עד שלושה גיגה בייט יכולות לרוץ על חומרה צנועה יחסית בלי להכביד על המערכת.

איפה זה נופל

למרות שמדובר במודל תרגום, הדף מצהיר רשמית רק על אנגלית, ואין שום מידע או מבחני ביצועים שמראים איך הוא מתמודד עם עברית או שפות מורכבות אחרות. בנוסף, מדובר בהמרות סטטיות בלבד בלי כיול מתקדם, והמפרסם עצמו מפנה לגרסה נפרדת עם כיול אם מחפשים איכות גבוהה יותר באותם נפחים. חייבים לבדוק מדגמית את איכות הפלט לפני שמחברים אותו לקוד אמיתי.

שאלות
נפוצות

איזו גרסה של הקובץ הכי מומלץ להוריד?

עבור רוב השימושים, הגרסאות המסומנות כארבעה ביט הן נקודת האמצע הנכונה בין גודל של כ־2.6 גיגה בייט לבין שמירה על מהירות ואיכות. אם הזיכרון מאוד מוגבל אפשר לרדת לשלושה ביט, אבל מתחת לזה הפגיעה בתוצאות כבר מורגשת.

האם המודל יודע לתרגם לעברית וממנה?

התיעוד הרשמי מציין אנגלית בלבד, ואין פירוט על שפות נתמכות נוספות בכרטיס המודל. מומלץ להוריד קובץ קטן ולבדוק בעצמכם כמה פסקאות בעברית לפני שמתכננים להסתמך עליו במוצר.

איך מריצים

מורידים קובץ בודד בפורמט המבוקש ומריצים אותו בכל סביבה שתומכת בקובצי llama.cpp. לשימוש שוטף הגרסאות המאוזנות סביב ארבעה ביט דורשות קצת יותר משניים וחצי גיגה בייט של זיכרון עבודה, כך שמעבד גרפי ביתי פשוט או אפילו זיכרון מעבד רגיל יספיקו בהחלט.

אם אתם צריכים תרגום של אלפי מסמכים בדקה או עבודה בהיקפים עצומים, שרת מרוחק או שירות מנוהל ייתנו מהירות גבוהה בהרבה. המודל המקומי מיועד בעיקר למי שרוצה לשמור על פרטיות הנתונים או לעבוד בלי תלות ברשת.

ollama run hf.co/mradermacher/translategemma-4b-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא רישיון גמה הרשמי של גוגל. הוא מאפשר שימוש מסחרי והפצה, אבל דורש עמידה בתנאי השימוש המקוריים שלהם ובמגבלות השימוש ההוגן. אם אתם מוכרים מוצר שמבוסס עליו, ודאו שאתם עומדים בדרישות הרישוי המקוריות של גוגל.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗