GPT
L

LFM2.5-230M-GGUF

קוד פתוח

LiquidAIother2026-06-11

  • gguf
  • liquid
  • lfm2.5
  • llama.cpp
  • text-generation

מודל שפה קומפקטי שמיועד לריצה מקומית על מכשירי קצה וחסכון בחומרה. הפורמט מתאים למי שרוצה ביצועים מהירים בלי לתחזק שרתים יקרים.

  • 1.8 GBמשקל הקבצים
  • 480,288הורדות בחודש
  • 98לייקים

מה זה

מדובר במודל שנוצר כדי לעבוד על ברזל מקומי, כזה שנכנס בקלות לתוך מכשירי קצה ורכיבים חלשים בלי להזדקק למעבדים גרפיים כבדים. Liquid AI בנו כאן ארכיטקטורה היברידית קטנה מאוד, שמתמקדת בניצול זיכרון נמוך ובמהירות תגובה גבוהה, ומגיעה ארוזה מראש בקבצים שמיועדים להרצה מהירה.

המודל מגיע עם תמיכה בשמונה שפות שונות, ביניהן אנגלית, ערבית, צרפתית, גרמנית, ספרדית, יפנית, קוריאנית וסינית. הוא לא מציג תוצאות מבחנים רשמיות בכרטיס הנוכחי, אבל המטרה שלו ברורה לגמרי. הוא מנסה לתת פתרון למשימות טקסט בסיסיות על חומרה יומיומית, במקומות שבהם מודלים של מיליארדי פרמטרים פשוט יקרסו מחוסר זיכרון.

מתאים ל

  • ריצה מקומית על מכשירי קצה

    מתאים למכשירים קטנים שצריכים עיבוד טקסט פשוט בלי תלות ברשת.

  • השלמת טקסט מהירה

    עובד מעולה כשיש צורך בתגובה מידית במעבד רגיל ובלי כרטיס גרפי.

  • משימות ניתוב פשוטות

    מספיק טוב כדי לסווג פקודות קצרות בשפות הנתמכות כמו אנגלית או ערבית.

איפה זה נופל

עם גודל כזה, הוא לא מתאים להסברים עמוקים, יצירת קוד מסובך או הבנה של הקשרים ארוכים ומפותלים. הוא גם לא כולל תמיכה מובנית בעברית, ולכן ניסיון לכתוב איתו בשפה הזו צפוי להניב תוצאות שבורות. בנוסף, חסרים בכרטיס פרטים טכניים על מגבלות אבטחה או הזיות, מה שמחייב אתכם לבדוק את התשובות שלו ידנית לפני שאתם מחברים אותו לפעולה אוטומטית.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה לעבודה בעברית?

לא. רשימת השפות הנתמכות לא כוללת עברית, והיא ממוקדת באנגלית, ערבית, שפות אירופאיות ושפות ממזרח אסיה. שימוש בעברית יוביל לתוצאות גרועות או לטקסט מקוטע.

מה ההבדל בין גרסת QAD לגרסה הרגילה?

גרסת QAD עברה אימון זיקוק שמביא בחשבון את הכימות מראש, במקום לחתוך את הדיוק רק לאחר האימון. זה אמור לשמור על איכות הפלט של המודל למרות הנפח הנמוך.

איך מריצים

אתם מריצים אותו ישירות מול כלי שורת הפקודה של llama-cpp, בלי סביבות פיתוח מנופחות או ספריות ענקיות. כל מה שצריך זה מחשב רגיל, מעבד סביר וכמה מאות מגה בייטים פנויים של זיכרון עבודה כדי להחזיק את הקובץ פתוח.

המפתחים הוציאו גם גרסה שעברה זיקוק מודע לכימות, שנקראת QAD Q4_0, לצד הגרסה המכומתת הרגילה. אם אתם צריכים רק מדי פעם מענה על שאילתות מורכבות או ניתוח עמוק, אין שום סיבה לתחזק הרצה מקומית ועדיף לקרוא לשרת חיצוני.

ollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כמותאם אישית ולא כרישיון קוד פתוח סטנדרטי. המשמעות היא שאתם חייבים לבדוק את התנאים בעמוד המקורי של החברה כדי לדעת אם מותר לשלב אותו במוצר מסחרי.

הרישיון המלא בעמוד המודל ↗