GPT
H

helium-1-2b

קוד פתוח

kyutaicc-by-sa-4.02025-04-30

  • transformers
  • safetensors
  • llama
  • text-generation
  • bg

מודל שפה קטן של 2 מיליארד פרמטרים שזוקק מ־Gemma 2 ומתמקד ב־24 השפות הרשמיות של האיחוד האירופי. הוא מיועד להרצה מקומית על מכשירי קצה, אבל מגיע כמודל בסיס ללא יישור להוראות.

  • 2Bפרמטרים
  • 4,096טוקנים בהקשר
  • 3.8 GBמשקל הקבצים
  • 1,615הורדות בחודש

מה זה

מדובר במודל בסיס קומפקטי שנבנה בצרפת ומיועד למכשירי קצה ולטלפונים. הוא זוקק מ־Gemma 2 ואומן על דאטה של Common Crawl שעובד עם ספריית dactory. הייחוד העיקרי שלו הוא התמקדות מפורשת ב־24 השפות הרשמיות של האיחוד האירופי, במקום להתמקד כמעט אך ורק באנגלית כמו רוב המתחרים בקטגוריית הגודל הזו.

במבחני ביצועים רב־לשוניים הוא מציג ממוצע של 43.3 נקודות, ועוקף בקטגוריה הזו את Gemma 2 של 2.6B ואת Llama 3.2 של 3B, בעיקר בזכות ציונים חזקים במבחני הבנה כמו ARC. מנגד, באנגלית בלבד המצב שונה לגמרי. עם ממוצע של 61.1 הוא מפגר בבירור אחרי Qwen 2.5 של 1.5B שמגיע ל־63.6, וגם אחרי Llama 3.2. המשמעות פשוטה, כוחו בשפות אירופיות ולא בהתמודדות עם אנגלית נטו.

מתאים ל

  • אימון מודל קצה אירופי

    בסיס קל משקל לכוונון ייעודי למשימות באחת מ־24 השפות הרשמיות של האיחוד האירופי.

  • השלמת טקסט במכשירים ניידים

    השלמת משפטים מקומית על חומרת קצה ללא צורך בחיבור לרשת או שליחת מידע לשרת חיצוני.

  • מחקר על זיקוק מודלים

    בחינת יכולות של מודל פתוח שזוקק ישירות מ־Gemma 2 על פני מגוון מבחני ביצועים.

איפה זה נופל

זהו מודל בסיס בלבד ולא עבר כוונון להוראות או התאמה להעדפות אנושיות. אם תתנו לו שאלה, הוא ינסה להמשיך את הטקסט ולא בהכרח לענות עליה, והוא עלול לייצר תוכן שגוי, מוטה או לא שימושי. חלון ההקשר עומד על 4,096 טוקנים בלבד, מה שמגביל מאוד ניתוח מסמכים. בנוסף, עברית כלל אינה ברשימת השפות הנתמכות שלו, כך שההרצה שלו בעברית תניב כנראה ג׳יבריש או פלט שבור.

אותה משפחה

helium-1 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל אומן והוגדר רשמית עבור 24 השפות של האיחוד האירופי בלבד, ועברית אינה נכללת בהן. יוצרי המודל מציינים במפורש שאין להשתמש בו בשפות אחרות מעבר לאלו שאומן עליהן.

אפשר להשתמש בו ישירות כבוט שיחה?

לא מומלץ בכלל. המודל לא עבר שום התאמה לשיחה או מילוי הוראות, ולכן יתנהג כמשלים טקסט סטטיסטי ולא כעוזר אישי שמחזיר תשובות ישירות. כדי להפוך אותו לבוט תצטרכו לבצע עליו אימון נוסף.

איך מריצים

המודל שוקל 3.8 גיגה בייט בדיוק של bfloat16, כך שהוא נכנס בקלות לכל כרטיס מסך ביתי מודרני עם 6 או 8 גיגה זיכרון, וגם על מעבדי מחשבים ניידים באמצעות transformers בסיסי של פייתון. אין פה חלוקה מורכבת לגרסאות שונות בכרטיס, והוא רץ ישירות דרך פייפליין טקסט סטנדרטי של Hugging Face.

אם אתם צריכים רק ממשק צ׳אט מהיר באנגלית או תשובות מנוסחות בלי אימון נוסף, אין טעם להרים אותו עצמאית. עדיף לפנות ל־API מסחרי קיים. הרצה מקומית שלו משתלמת רק אם חייבים פרטיות מלאה, עבודה אופליין, או בסיס קל שרוצים לאמן עליו שכבת פקודות ייעודית.

from transformers import pipeline

pipe = pipeline("text-generation", model="kyutai/helium-1-2b")
print(pipe("שלום"))

הקבצים

7 קבצים במאגר, 3.8 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הרשום הוא CC-BY-SA 4.0, שדורש מתן קרדיט ושיתוף תחת אותו רישיון בדיוק אם שיניתם את המודל. בנוסף, מכיוון שהמודל זוקק מ־Gemma 2, הכרטיס מציין מפורשות שהוא כפוף לתנאי השימוש של Gemma מבית גוגל. שילוב התנאים הזה מחייב בדיקה משפטית לפני הפצה במוצר מסחרי סגור.

  • שימוש מסחרי
  • שינוי הקוד
  • חובת שיתוף באותו רישיון

הרישיון המלא בעמוד המודל ↗