GPT
L

LFM2-2.6B

קוד פתוח

LiquidAIother2025-09-22

  • transformers
  • safetensors
  • lfm2
  • text-generation
  • liquid

ארכיטקטורה היברידית של קונבולוציות ותשומת לב בגודל 2.6 מיליארד פרמטרים. היא נבנתה לריצה מהירה על מעבדי מכשירי קצה וכוללת תמיכה מובנית בחשיבה והפעלת פונקציות.

  • 2.6Bפרמטרים
  • 128,000טוקנים בהקשר
  • 4.8 GBמשקל הקבצים
  • 6,887הורדות בחודש

מה זה

מדובר במודל שמערבב 22 שכבות של קונבולוציה קצרה ומוכפלת עם 8 שכבות תשומת לב מסוג GQA, במקום להסתמך רק על טרנספורמר רגיל. המבנה הזה נועד להוריד עומס חישובי, והיוצרים מדווחים על פענוח וקריאת קלט במהירות כפולה על גבי מעבד רגיל מול דגמים כמו Qwen3. הוא אומן על 10 טריליון טוקנים, כאשר כרבע מהחומר הוא רב לשוני ורק חמישה אחוזים קוד.

הדגם הספציפי הזה הוא היחיד בסדרה שכולל מנגנון חשיבה דינמי עם תגיות ייעודיות לפתרון בעיות מורכבות, לצד תמיכה בקריאות לפונקציות במבנה פייתון. במבחני ביצועים הוא עוקף את Llama 3.2 3B ברוב המדדים, כמו ציון 64.42 ב־MMLU מול 60.35 ו־82.41 ב־GSM8K לעומת 75.21, אבל עדיין מפסיד למודלים מעט גדולים יותר כמו Qwen3 4B במבחני ידע קשים יותר.

מתאים ל

  • סוכנים אוטונומיים בקצה

    תומך בקריאות פונקציה מובנות ובחשיבה דינמית, ורץ במהירות על חומרת מעבד מקומית.

  • שליפת מידע ו־RAG ממוקד

    מתאים לחילוץ נתונים מטקסט מקומי כאשר מכווננים אותו מראש למשימה ספציפית.

  • שיחה ומענה במכשירים ניידים

    משקל של פחות מחמישה גיגה בייט מאפשר שיחה רב שלבית יעילה על מחשבים אישיים.

איפה זה נופל

היוצרים מבהירים במפורש שהמודל לא מתאים למשימות עתירות ידע כללי או לכתיבת קוד ותכנות, שכן רק 5% מנתוני האימון שלו היו קוד. ציון ה־GPQA שלו נמוך ועומד על 26.57, מה שמראה קושי במענה על שאלות מדעיות מורכבות. בנוסף, חלון ההקשר עומד על 32,768 טוקנים לפי כרטיס המודל. עברית אינה מופיעה ברשימת השפות הנתמכות, שכוללת רק אנגלית, ערבית, סינית, צרפתית, גרמנית, יפנית, קוריאנית וספרדית.

אותה משפחה

LFM2 יצא ב־12 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם המודל מתאים לפיתוח וכתיבת קוד?

לא. נתוני האימון כללו רק חמישה אחוזי קוד, והיוצרים מציינים בפירוש שאינו מיועד למשימות תכנות. למשימות פיתוח עדיף לבחור מודל ייעודי לקוד.

האם אפשר להשתמש בו באפליקציות בעברית?

עברית אינה ברשימת השפות הנתמכות שפורסמה. מומלץ לבדוק את התנהגותו היטב לפני כל שילוב במערכת מקומית, שכן סביר שיעשה שגיאות תחביר והבנה.

איך מריצים

המשקל עומד על 4.8 גיגה בייט בפורמט bfloat16, כך שכרטיס מסך בסיסי או מחשב נייד מודרני מריצים אותו בלי בעיה ישירות בזיכרון הראשי. אפשר להריץ אותו דרך transformers מגרסה 4.55 ומעלה, בסביבת vLLM בגרסה 0.10.2, או דרך llama.cpp באמצעות קובצי GGUF אם רוצים לצמצם עוד יותר את צריכת המשאבים.

אם אתם צריכים רק שאילתות מזדמנות ללא תלות בחומרה מקומית, פנייה ל־API חיצוני עדיפה כדי לחסוך תחזוקה. הרצה עצמית כאן משתלמת רק כשחייבים זמן תגובה מהיר על המכשיר עצמו, כמו מחשבים מקומיים, רובוטיקה או התקני קצה ללא חיבור רציף לרשת.

from transformers import pipeline

pipe = pipeline("text-generation", model="LiquidAI/LFM2-2.6B")
print(pipe("שלום"))

הרישיון

הרישיון מוגדר כ־LFM Open License v1.0, ומסומן במאגר כ־other. זה אינו רישיון קוד פתוח סטנדרטי מסוג MIT או Apache. מי שמתכנן להפיץ את המשקלים במוצר מסחרי חייב לקרוא את תנאי הרישיון המקוריים של Liquid AI כדי לוודא שאין הגבלות שימוש, דרישות תמלוגים או חובות דיווח.

הרישיון המלא בעמוד המודל ↗