GPT
L

LFM2.5-350M-GGUF

קוד פתוח

LiquidAIother2026-03-25

  • gguf
  • liquid
  • lfm2
  • edge
  • llama.cpp

גרסת GGUF מכווצת של מודל היברידי קטן במיוחד, שנבנה לריצה מקומית על מכשירי קצה. הוא שוקל מעט מאוד ומתאים למי שחייב ביצועים מהירים בלי לגעת בענן.

  • 2.8 GBמשקל הקבצים
  • 84,145הורדות בחודש
  • 98לייקים

מה זה

מודל שנוצר בארכיטקטורה היברידית ומיועד לייצור טקסט ישירות על חומרת קצה מוגבלת. הוא מכוון ליעילות בזיכרון ולמהירות עבודה גבוהה, כשהמטרה היא לחסוך את הצורך בשרתים כבדים עבור משימות טקסט פשוטות. המאגר כולל קובצי GGUF במשקל כולל של 2.8 גיגה בייט שמחולקים לכמה גרסאות, כולל גרסה שעברה זיקוק מודע לכימות ברמת Q4_0 במקום סתם כיווץ רגיל אחרי אימון.

רשימת השפות הנתמכת כוללת אנגלית, ערבית, סינית, צרפתית, גרמנית, יפנית, קוריאנית וספרדית. אין כאן אזכור לתמיכה בעברית, ולכן עבור מפתחים ישראלים שמחפשים מענה מקומי בשפת האם, הוא כנראה לא יספק את הסחורה מהקופסה.

מתאים ל

  • מענה טקסטואלי במכשירי קצה

    צריכת משאבים מינימלית מאפשרת לו לרוץ ישירות על חומרה חלשה בלי חיבור קבוע לרשת.

  • בוטים פשוטים לשפות זרות

    מתאים למשימות ניתוב והפקה קצרות בשפות הנתמכות כמו אנגלית או ספרדית.

  • ניסויי הרצה ב־llama.cpp

    הקבצים מוכנים מראש לטעינה נוחה ומהירה בסביבות פיתוח מבוססות מעבד.

איפה זה נופל

גודל של 350 מיליון פרמטרים מגיע עם מגבלות חריפות ביכולת ההבנה וההסקה, ואי אפשר לצפות ממנו לתשובות מעמיקות. מעבר לזה, עברית בכלל לא מופיעה ברשימת השפות הרשמית שלו, כך שסביר מאוד שהוא יגמגם או ייצר פלט שבור לחלוטין בניסיון לעבוד איתה. כרטיס המודל גם לא חושף מבחני ביצועים מפורטים, ולכן תצטרכו לבדוק בעצמכם אם איכות הפלט מספיקה למקרה המבחן שלכם לפני שילוב שלו במערכת.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם המודל תומך בעבודה בעברית?

עברית אינה מופיעה ברשימת השפות שנתמכות במודל הזה. אם תנסו לתשאל אותו בעברית, קרוב לוודאי שתקבלו הזיות או תחביר לא תקין, ולכן הוא לא מתאים למוצרים שמיועדים לקהל מקומי בלבד.

מה המשמעות של גרסת ה־QAD מול כימות רגיל?

במקום לכווץ את המשקלים בסיום האימון ולספוג ירידה באיכות, גרסת ה־QAD עברה אימון מיוחד שמכין את המודל לפורמט Q4_0 מראש. בפועל זה מאפשר לקבל קובץ קל ומהיר של llama.cpp בלי לאבד חלק ניכר מהדיוק.

איך מריצים

את המודל מריצים ישירות באמצעות כלי llama.cpp בפקודת שורה פשוטה, תוך משיכה ישירה מיוזר המקור. בגלל הגודל הזעיר, אין שום צורך במעבד גרפי ייעודי ואפשר להריץ אותו בנוחות על מעבד רגיל של מחשב נייד או חומרת IoT.

המפתחים הוסיפו גרסת QAD מיוחדת בפורמט Q4_0, שאמורה לשמור על איכות טובה יותר מכימות סטנדרטי. אם המטרה שלכם היא להריץ משימות מורכבות של ניתוח עמוק, אין טעם להתעקש על הגודל הזה ועדיף לפנות ל־API של מודל גדול ומרוחק.

ollama run hf.co/LiquidAI/LFM2.5-350M-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כרגע תחת other בלבד, ללא פירוט פתוח של תנאי שימוש חופשיים כמו MIT או אפאצ'י. זה אומר שמבחינה משפטית אי אפשר להניח שמותר לשלב אותו במוצר מסחרי, וכל צוות פיתוח יצטרך לבדוק את הרישיון המקורי של החברה באתר שלה לפני שמשחררים קוד ללקוחות.

הרישיון המלא בעמוד המודל ↗