GPT
A

Apertus-8B-2509

קוד פתוח

swiss-aiapache-2.02025-09-02

  • transformers
  • safetensors
  • apertus
  • text-generation
  • multilingual

שילוב נדיר של קוד פתוח לחלוטין, תמיכה בריבוי שפות עצום והקשר ארוך. מתאים למי שחייב שקיפות מלאה על נתוני האימון בלי להתפשר על ביצועים מול מודלים סגורים.

  • 8.1Bפרמטרים
  • 65,536טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 18,176הורדות בחודש

מה זה

מדובר במודל שפה בגודל 8.1 מיליארד פרמטרים שאומן על 15 טריליון טוקנים, בדגש על שקיפות מלאה ותאימות לכללי זכויות יוצרים ופרטיות. הוא כולל תמיכה מובנית ב־1,811 שפות, חלון הקשר של 65,536 טוקנים, ויכולת הפעלת כלים חיצוניים כבר ברמת האימון.

במבחני הבנה כלליים המודל מציג ממוצע של 65.8 נקודות, ועוקף בקטגוריה שלו מודלים פתוחים כמו OLMo2-7B שמגיע ל־64.0. הוא מתחרה ראש בראש עם Llama3.1-8B שקיבל 65.4, ואף עוקף אותו במבחן XCOPA עם 66.5 מול 61.8, מה שמצביע על יכולת טובה יותר בהיגיון רב לשוני על אף ההקפדה על דאטה פתוח.

מתאים ל

  • עיבוד מסמכים ארוכים

    חלון הקשר של 65,536 טוקנים מתאים לניתוח דוחות טכניים ותיעוד עמוס בלי לקטוע את הטקסט באמצע.

  • תמיכה במערכות רב לשוניות

    אימון על 1,811 שפות מאפשר לתרגם ולנתח מידע במגוון עצום של שפות מקומיות בלי להחליף מודל.

  • סוכנים מבוססי כלים

    תמיכה מובנית בחיבור לכלים חיצוניים מאפשרת הפעלת פונקציות ואוטומציה ישירות מתשובות המודל.

איפה זה נופל

היוצרים מודים במפורש שהפלט עלול להכיל טעויות עובדתיות, כשלים לוגיים והטיות שמקורן בנתוני הרשת. בנוסף, כרגע אין במודל מנגנון סינון מובנה למידע מזהה אישי. מי שבונה עליו שירות שחשוף למשתמשים חייב להקים בעצמו שכבת ולידציה ובקרת פלט כדי לא לפלוט מידע רגיש.

שאלות
נפוצות

האם המודל דורש התקנה מיוחדת כדי לעבוד?

הוא נשען על ארכיטקטורת ApertusForCausalLM שדורשת transformers מגרסה 4.56.0 ומעלה. אם תנסו לטעון אותו בסביבה ישנה יותר תקבלו שגיאה, לכן חובה לעדכן חבילות לפני ההרצה.

במה הוא עדיף על פני מודלים כמו Llama 3.1?

מבחינת ביצועים יבשים הם קרובים מאוד. היתרון כאן הוא שקיפות מוחלטת של נתוני האימון ותאימות לזכויות יוצרים, מה שמסיר סיכונים משפטיים בארגונים שמקפידים על מקור המידע.

איך מריצים

המשקל הכולל של הקבצים עומד על 15 גיגה בייט בפורמט bfloat16, כך שתצטרכו כרטיס מסך בודד עם לפחות 24 גיגה בייט זיכרון כדי להריץ אותו בהסקה מלאה, או פחות מזה אם מפעילים קוונטיזציה. המודל נתמך ישירות בספריות transformers החל מגרסה 4.56.0, וכן ב־vLLM, SGLang, וב־MLX להרצה מקומית על מחשבי מק.

אם אתם צריכים רק מענה מזדמן לפניות או בדיקות מהירות, עדיף להשתמש בספק שמגיש אותו דרך API כדי לחסוך תחזוקת שרת ייעודי. הרצה עצמית שווה את המאמץ רק כשאתם מעבדים טקסטים ארוכים ברצף או מחויבים לשמור את כל המידע בתוך התשתית המקומית שלכם.

from transformers import pipeline

pipe = pipeline("text-generation", model="swiss-ai/Apertus-8B-2509")
print(pipe("שלום"))

הרישיון

המודל מופץ תחת רישיון apache-2.0. הרישיון מתיר שימוש מסחרי חופשי, שינוי של המשקולות ושילוב במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗