GPT
L

LFM2-350M-GGUF

קוד פתוח

LiquidAIother2025-07-12

  • gguf
  • liquid
  • lfm2
  • edge
  • llama.cpp

מודל קטן במיוחד שנועד לרוץ ישירות על מכשירי קצה וטלפונים. הוא מעניין בעיקר למי שמחפש פתרון קומפקטי שלא דורש שרתים מנופחים.

  • 2.2 GBמשקל הקבצים
  • 5,521הורדות בחודש
  • 62לייקים

מה זה

מדובר במודל היברידי קטן מאוד, 350 מיליון פרמטרים בלבד, שפותח במטרה לספק ביצועים סבירים בצריכת זיכרון מינימלית. לפי המפתחים הוא מכוון למשימות יצירת טקסט מקומיות שלא מצדיקות פנייה לענן, וכולל תמיכה במספר שפות כמו אנגלית, ערבית, ספרדית, צרפתית, גרמנית, יפנית, קוריאנית וסינית.

המשקל הכולל של הקבצים עומד על 2.2 גיגה בייט בפורמט מותאם לעיבוד מקומי. בניגוד למודלים ענקיים שדורשים חוות שרתים, המבנה שלו מנסה לחסוך במשאבים בלי להתרסק לחלוטין באיכות הפלט, אם כי בגודל כזה ברור שיש פשרות משמעותיות ביכולות ההבנה העמוקות.

מתאים ל

  • עיבוד טקסט על מכשירי קצה

    הוא שוקל מעט מאוד ומסוגל לרוץ מקומית על מחשבים פשוטים או טלפונים בלי ענן.

  • סיווג טקסט פשוט בלולאה

    מתאים למיון והשלמת פקודות קצרות בשפות הנתמכות בצורה מהירה ובזול.

  • עבודה במצב לא מקוון

    מאפשר לייצר טקסט בסיסי במערכות סגורות שאין להן חיבור זמין לרשת.

איפה זה נופל

המודל הזה זעיר, וזה מגיע עם מחיר כבד. הוא לא מיועד למשימות מורכבות, ניתוח מסמכים ארוכים או חשיבה מרובת שלבים. בנוסף, עברית בכלל לא מופיעה ברשימת השפות הנתמכות שלו, כך שאי אפשר לבנות עליו לפרויקטים מקומיים בשפה שלנו בלי לבדוק היטב אם הוא בכלל מחזיר פלט הגיוני.

אותה משפחה

LFM2 יצא ב־12 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר להשתמש בו ליישומים בעברית?

עברית אינה מופיעה ברשימת השפות הרשמית של המודל. סביר מאוד שהוא יתקשה מאוד לייצר פלט תקין או הגיוני בעברית, ולכן לא מומלץ לבנות עליו למשימות בשפה הזו.

איזה מחשב צריך בשביל להריץ אותו?

המודל שוקל כ־2.2 גיגה בייט בלבד ומיועד להרצה קלה דרך llama.cpp. כל מעבד מודרני במחשב נייד רגיל יספיק כדי להריץ אותו במהירות טובה, בלי שום צורך בכרטיס מסך מיוחד.

איך מריצים

ההרצה פשוטה מאוד ומתבססת על llama.cpp ישירות דרך שורת הפקודה, באמצעות llama-cli מול המאגר. כל מעבד מודרני ממוצע יכול להריץ אותו בלי להזיע, ואפילו אין חובה במעבד גרפי ייעודי כדי לקבל תגובה מהירה.

עם זאת, אם אתם צריכים הבנה של הקשרים מורכבים, ניתוח לוגי או יצירת טקסטים ארוכים ומדויקים, עדיף לפנות ל־API חיצוני של מודל גדול בהרבה. הריצה המקומית כאן משתלמת רק כשחייבים פרטיות מלאה או עבודה ללא רשת.

ollama run hf.co/LiquidAI/LFM2-350M-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other ולא כרישיון קוד פתוח סטנדרטי ומוכר. זה אומר שאי אפשר להניח שמותר להשתמש בו במוצר מסחרי, וצריך לבדוק לעומק את תנאי השימוש של החברה או ליצור קשר עם אנשי המכירות שלהם לפני שמפיצים אותו ללקוחות.

הרישיון המלא בעמוד המודל ↗