GPT
L

LFM2.5-2.6B

קוד פתוח

LiquidAIother2026-07-28

  • transformers
  • safetensors
  • lfm2
  • text-generation
  • liquid

מודל קומפקטי שמכוון במיוחד להפעלת כלים וסוכנים מקומית על המכשיר. הוא מציע חלון הקשר עצום ביחס למשקל שלו ורץ במהירות גבוהה גם על מעבדים פשוטים.

  • 2.7Bפרמטרים
  • 131,072טוקנים בהקשר
  • 5.0 GBמשקל הקבצים
  • 116,730הורדות בחודש

מה זה

הארכיטקטורה כאן אינה טרנספורמר טהור, אלא שילוב היברידי של 22 בלוקי קונבולוציה קצרים ורק 8 שכבות של מנגנון קשב מסוג GQA. המבנה הזה מאפשר לו לעבד 131,072 טוקנים בלי לחנוק את החומרה. האימון עבר דרך 34 טריליון טוקנים, כאשר בשלבי הליטוש הסופיים אימנו אותו ישירות מתוך סביבות עבודה של סוכנים כדי שיידע לפעול מול כלים ופרומפטים מורכבים.

התוצאות במבחני הביצועים מראות שהוא עוקף מודלים כבדים ממנו בהרבה במשימות ספציפיות. במבחני שימוש בכלים כמו BFCLv4 הוא מגיע לציון 56.88, מעל מודלים מתחרים של 4 ו־8 מיליארד פרמטרים. במבחן IFStruct למעקב אחרי מבנה הוא מגיע ל־85.49, שזה גבוה משמעותית מהמקבילים. מצד שני, במבחני ידע כללי ומדדי דיוק רחבים המספרים שלו נשארים חד-ספרתיים, מה שמבהיר שזה כלי עבודה ביצועי ולא אנציקלופדיה.

מתאים ל

  • סוכן מקומי לחילוץ מידע

    שליפת נתונים מתוך מסמכים ארוכים בזכות חלון של 128 אלף טוקנים וצריכת זיכרון מזערית.

  • הפעלת פונקציות וכלים

    ייצור קריאות מדויקות בפורמט פייתון או JSON, משימה שהוא אומן עליה מראש בתוך סביבות ייעודיות.

  • עבודה מבוססת RAG במחשב קצה

    סריקה מהירה של מאגרי מידע פרטיים על מחשב נייד בלי להוציא נתונים לרשת ובקצב של מעל 100 טוקנים לשנייה.

איפה זה נופל

היוצרים מציינים בפירוש שהמודל לא מתאים למשימות קידוד אוטונומיות מורכבות ולא למטלות שדורשות ידע עולם עשיר. במבחן AA-Omni-Public הוא השיג דיוק של 8.13 בלבד. המודל פועל כמודל חשיבה שמוסיף תגיות think לפני כל תשובה, מה שעלול לייקר זמני תגובה אם מחפשים פלט מיידי. בנוסף, רשימת השפות הנתמכות אינה כוללת עברית, ולכן ניסיון להפעיל עליו לוגיקה בשפה המקומית צפוי לייצר שיבושים.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה בעברית?

המודל לא הוכרז כתומך בעברית. רשימת השפות כוללת ערבית, סינית, שפות אירופאיות והינדי, אך עברית נעדרת ממנה. סביר להניח שביצועי הפעלת הכלים והחשיבה בעברית יהיו נמוכים משמעותית.

למה המודל כותב תגיות think בתחילת התשובה?

המודל אומן לפעול כמודל חשיבה שמתכנן את הפעולות שלו לפני מתן המענה. תבנית השיחה מוסיפה את התגית הזו באופן אוטומטי, ואחריה המודל פורש את תהליך הפעולה או קריאת הפונקציה.

איך מריצים

המשקל המקורי שוקל 5 גיגה-בייט וצורך פחות מ־2.5 גיגה-בייט זיכרון בעבודה. אפשר להריץ אותו דרך ספריית transformers בגרסה 5 ומעלה, או בפריימוורקים מהירים כמו vLLM ו־SGLang לשרתים עם כרטיסי מסך. למחשבים אישיים יש גרסאות מכווצות בפורמט GGUF עבור llama.cpp, וגרסת MLX מותאמת ישירות לחומרת אפל.

במעבד M5 Max הוא מגיע לקצב של 220 טוקנים לשנייה, ובמעבד AMD Ryzen ל־113 טוקנים לשנייה. LiquidAI מציעים גם מודל טיוטה קטן של 328 מיליון פרמטרים שנקרא DSpark, שמאיץ את התהליך פי 2.6. אם צריך להריץ משימות סוכנים מקומית על מחשב נייד או קצה, אין סיבה לשלם על API חיצוני.

from transformers import pipeline

pipe = pipeline("text-generation", model="LiquidAI/LFM2.5-2.6B")
print(pipe("שלום"))

הרישיון

המודל מסומן תחת רישיון other ולא תחת רישיון קוד פתוח סטנדרטי כמו Apache או MIT. דף המודל לא מפרט את תנאי השימוש המלאים או האם מותר לשלב אותו במוצר מסחרי. לפני שמשלבים את המשקולות בקוד ייצורי, חובה לפנות למסמכים באתר החברה או למחלקה המשפטית כדי להבין את ההגבלות.

הרישיון המלא בעמוד המודל ↗