GPT
L

LFM2.5-1.2B-Thinking-GGUF

קוד פתוח

LiquidAIother2026-01-16

  • gguf
  • liquid
  • lfm2.5
  • edge
  • llama.cpp

גרסה מכווצת של מודל היברידי קטן עם יכולות חשיבה, שמיועדת לריצה מקומית. הוא פונה למי שמחפש פתרון קל משקל למכשירים מקומיים בלי לשלם על שרתים כבדים.

  • 8.5 GBמשקל הקבצים
  • 12,598הורדות בחודש
  • 117לייקים

מה זה

מדובר במודל שפה קטן במיוחד, עם 1.2 מיליארד פרמטרים, שמבוסס על ארכיטקטורה היברידית של חברת LiquidAI. היוצרים שלו אימנו אותו באימון מקדים מורחב וחיזקו אותו בלמידת חיזוק כדי לתת לו יכולות ניתוח וחשיבה, למרות הממדים הצנועים שלו. הפורמט הנוכחי מותאם ישירות להרצה מקומית ומחולק לקבצי GGUF, כך שהוא חוסך זיכרון ומאפשר עבודה מהירה גם על חומרה יומיומית.

המודל תומך בשמונה שפות שונות, ביניהן אנגלית, ערבית, צרפתית, גרמנית, ספרדית, יפנית, קוריאנית וסינית. הוא תוכנן במיוחד לעבודה בקצה, במחשבים אישיים או מכשירים מוטמעים, במקום להסתמך על תשתיות ענן יקרות. הרעיון כאן הוא לקבל תשובות שדורשות צעדי חשיבה בסיסיים ישירות מהחומרה המקומית, בלי השהיות רשת ובעלויות אפסיות של תחזוקת שרתים.

מתאים ל

  • עוזר מקומי למחשב נייד

    הוא רץ על מעבד רגיל בלי צורך בשרת חיצוני או חיבור אינטרנט.

  • בוט לוגי פנימי באנגלית

    הוא מתאים למשימות ניתוב והסקה פשוטות בשפות הנתמכות.

  • הטמעה במכשירי קצה

    משקלו הקטן מאפשר להפעיל אותו ישירות בחומרה מוגבלת משאבים.

איפה זה נופל

עברית לא מופיעה ברשימת השפות הרשמיות של המודל, ולכן כל ניסיון לעבוד איתו בעברית צפוי להיכשל או להניב פלט משובש. בנוסף, מודל של 1.2 מיליארד פרמטרים נוטה להזיות ברגע שהשאלות נעשות מורכבות מדי, ויכולות החשיבה שלו מוגבלות מאוד ביחס למודלים בגודל מלא. הכרטיס כמעט אינו מספק מדדים כמותיים, כך שחובה לבדוק אותו עצמאית לפני שמשלבים אותו במוצר.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם המודל תומך בעבודה שוטפת בעברית?

לא. רשימת השפות הנתמכות כוללת אנגלית, ערבית ושפות מרכזיות נוספות, אך עברית אינה נכללת בהן.

מה נדרש כדי להריץ את המודל על המחשב?

צריך התקנה של llama.cpp ומחשב עם זיכרון שמסוגל להכיל את משקל הקבצים, ללא צורך בכרטיס מסך מיוחד.

איך מריצים

את המודל מריצים ישירות דרך כלי llama.cpp באמצעות הפקודה הפשוטה שמופיעה בתיעוד. מכיוון שמדובר בקבצי GGUF במשקל כולל של כ־8.5 ג'יגה־בייט שמחולקים ל־14 קבצים, אפשר לטעון אותו בקלות על מעבד רגיל או כרטיס גרפי בסיסי מאוד בלי להזדקק למאיצים ייעודיים.

ההרצה המקומית מתאימה במיוחד לפיתוח פנימי, בדיקות על מכשיר הקצה וסביבות מנותקות רשת. אם יש לכם צורך בסקייל רחב לאלפי משתמשים בו זמנית או שאתם מחפשים מענה למשימות שדורשות הבנה עמוקה ומורכבת, עדיף לפנות ל־API של מודל ענן גדול במקום לתחזק אשכולות של חומרה מקומית.

ollama run hf.co/LiquidAI/LFM2.5-1.2B-Thinking-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other, מה שאומר שהוא לא מופץ תחת רישיון קוד פתוח סטנדרטי וחופשי. תנאי השימוש המסחריים אינם מפורטים בכרטיס המודל, וייתכן שיש מגבלות שימוש או צורך בהסדר מול החברה, כך שלא כדאי לשלב אותו במוצר מסחרי לפני בדיקת החוזה המקורי.

הרישיון המלא בעמוד המודל ↗