GPT
L

LFM2.5-8B-A1B-Base

קוד פתוח

LiquidAIother2026-05-28

  • transformers
  • safetensors
  • lfm2_moe
  • text-generation
  • liquid

מודל בסיס היברידי שמשלב שכבות קונבולוציה עם מנגנון מומחים, שמפעיל רק מיליארד וחצי פרמטרים בזמן אמת. הוא מיועד למי שרוצה לאמן מודל משלו שירוץ מהר על מחשב מקומי.

  • 8.5Bפרמטרים
  • 128,000טוקנים בהקשר
  • 15.8 GBמשקל הקבצים
  • 2,025הורדות בחודש

מה זה

הארכיטקטורה כאן חריגה בנוף. במקום מודל צפוף רגיל, יש כאן מבנה של 24 שכבות שמערבב 18 שכבות קונבולוציה מסוג LIV עם שש שכבות תשומת לב קלאסיות. בסך הכול יש לו כמעט 8.5 מיליארד פרמטרים, אבל הראוטינג מנתב כל טוקן כך שרק 1.5 מיליארד פרמטרים פעילים בכל רגע נתון. השילוב הזה נותן מהירות תגובה גבוהה מאוד גם על מעבדים רגילים, בלי לאבד את היכולת להחזיק הקשר של 128,000 טוקנים.

המשקולות הנוכחיות הן גרסת בסיס, כלומר מודל שעבר אימון ראשוני על 38 טריליון טוקנים אבל לא עבר התאמה לשיחה. הוא לא יענה לפקודות ישירות כמו צ'אטבוט מוכן מהקופסה. היתרון שלו מול מודלים רגילים באותו משקל הוא תפוקת הטוקנים לשנייה, במיוחד בסביבות מקומיות מוגבלות במשאבים שבהן מודל צפוף של 8 מיליארד פרמטרים מתחיל לזחול.

מתאים ל

  • אימון מודל לתחום צר

    בסיס מהיר וקל משקל לאימון נוסף, למשל עבור ניתוח מסמכים בארגון עם חומרה מוגבלת.

  • סוכן מקומי להפעלת כלים

    מודל קל להרצה על מחשבים אישיים שמפעיל מעט פרמטרים בכל שלב ומחזיר פלט במהירות.

  • תרגום בין שפות נתמכות

    אימון ייעודי על טקסטים מקבילים בשפות שהוגדרו, כמו אנגלית, צרפתית, ספרדית וגרמנית.

איפה זה נופל

זהו מודל בסיס לא מכויל, ולכן הוא נוטה להמשיך טקסט במקום לענות לשאלות, ואי אפשר לסמוך עליו בשיחה חופשית ללא אימון נוסף. היוצרים מציינים במפורש שהארכיטקטורה הזו לא מתאימה למשימות כתיבת קוד כבדות או לשאלות שדורשות שליפת עובדות מורכבות ללא שימוש במנוע חיפוש חיצוני. בנוסף, עברית כלל אינה ברשימת השפות הנתמכות, כך שהבנת השפה ויצירת טקסט עברי יהיו מוגבלות מאוד.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר לשאול אותו שאלות מיד אחרי ההורדה?

לא. זו גרסת בסיס שעברה רק אימון מקדים, והיא תנסה להשלים את המשפט שלכם במקום להחזיר תשובה ישירה. לשימוש ישיר בצ'אט צריך להוריד את הגרסה שעברה כוונון ייעודי.

איך המודל מתמודד עם עברית?

עברית אינה מופיעה ברשימת השפות הרשמיות של המודל, שכוללת שפות כמו ערבית, סינית ואנגלית. סביר מאוד שהוא יתקשה בהבנת טקסטים ארוכים בעברית וייצר שגיאות תחביריות.

איך מריצים

הקבצים שוקלים 15.8 גיגהבייט ודורשים לפחות 16 גיגהבייט זיכרון גרפי בפורמט המקורי, או כרטיס עם 24 גיגהבייט אם רוצים לנצל את מלוא חלון ההקשר. המודל נתמך כבר מההשקה בספריות כמו vLLM לשרתים, MLX למחשבי מק, וספריות llama.cpp עבור גרסאות מכווצות שרצות ישירות על מעבד ומעטפת זיכרון רגילה.

אם כל מה שאתם צריכים זה מודל עובד לשיחה או הפעלת כלים, הורדת גרסת הבסיס הזו היא בזבוז זמן, כי תצטרכו להעביר אותה אימון נוסף בעצמכם. במצב כזה עדיף לקחת את גרסת ההוראות המוכנה או לפנות לשירות ענן שכבר מארח אותה.

from transformers import pipeline

pipe = pipeline("text-generation", model="LiquidAI/LFM2.5-8B-A1B-Base")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כמותאם אישית ולא כרישיון קוד פתוח סטנדרטי. המשמעות היא שחובה לקרוא את התנאים הספציפיים שצירפו המפתחים לפני כל שילוב במוצר מסחרי, ולא להניח שהשימוש חופשי.

הרישיון המלא בעמוד המודל ↗