GPT
L

LFM2-700M-GGUF

קוד פתוח

LiquidAIother2025-07-12

  • gguf
  • liquid
  • lfm2
  • edge
  • llama.cpp

גרסת GGUF קלה במיוחד של מודל היברידי קומפקטי, שמכוונת להרצה מקומית על מעבדים פשוטים ומכשירי קצה ללא צורך בשרתים כבדים.

  • 4.5 GBמשקל הקבצים
  • 10,156הורדות בחודש
  • 54לייקים

מה זה

מדובר במודל שנוצר כדי לעבוד ישירות על מכשירי קצה ומשאבים מוגבלים. הוא שייך למשפחת מודלים היברידיים שמטרתם לתת מהירות תגובה גבוהה וצריכת זיכרון נמוכה בהרבה ממודלי שנאי רגילים באותו סדר גודל. בכרטיס המודל לא מופיעים מבחני ביצועים מספריים, כך שקשה לדעת מראש איך הוא מתמודד מול מודלים מתחרים בלי להוריד ולבדוק בפועל.

הוא מיועד ליצירת טקסט ומגיע עם תמיכה מוצהרת במספר שפות מרכזיות כמו אנגלית, ערבית, צרפתית, ספרדית, גרמנית, סינית, יפנית וקוריאנית. עברית אינה מופיעה ברשימת השפות הרשמיות של הפרויקט, ולכן אם המטרה היא טקסט מקומי בעברית, צפויה עבודה פחות יציבה.

מתאים ל

  • סיווג טקסט מקומי

    מתאים למיון מהיר של טקסטים באנגלית על מחשב אישי או מכשיר קצה ללא עלויות שרת.

  • בוט פקודות פשוט

    יעיל להבנת פקודות קצרות ומוגדרות מראש כשהמשאבים מוגבלים והתגובה חייבת להיות מיידית.

  • מערכות ללא אינטרנט

    פתרון טוב לעיבוד מקומי במכשירים מנותקי רשת שדורשים שימוש בסיסי בשפות הנתמכות.

איפה זה נופל

מודל בגודל 700 מיליון פרמטרים מוגבל מאוד בהבנה עמוקה, ביכולות היקש ובמשימות מורכבות. הוא עלול להמציא דברים בקלות ולאבד עקביות מהר. בנוסף, עברית לא נתמכת רשמית ברשימת השפות, מה שהופך אותו ללא מתאים ליישומים שדורשים שפה מקומית טבעית. אסור להכניס אותו למערכת מבלי לבדוק ביסודיות את רמת הדיוק שלו על משימות ספציפיות.

אותה משפחה

LFM2 יצא ב־12 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם המודל תומך בעברית?

השפה העברית אינה מופיעה ברשימת השפות שפורסמו עבור המודל. אפשר לנסות להזין לו עברית, אבל סביר להניח שהפלט יהיה משובש או לא מדויק. אם המוצר שלכם פונה לשוק המקומי, עדיף לחפש חלופה אחרת.

האם צריך כרטיס מסך מיוחד כדי להפעיל אותו?

לא. משקל המודל נמוך והוא מותאם ספציפית לעבודה עם llama.cpp, מה שמאפשר לו לרוץ בקלות על גבי מעבד רגיל של מחשב נייד או מכשיר קצה.

איך מריצים

מריצים אותו ישירות דרך כלי כמו llama.cpp באמצעות הפקודה llama-cli, יחד עם הגדרות הדגימה שממליצים עליהן המפתחים. סך כל הקבצים שוקל כארבעה וחצי גיגה בייט ומחולק לכמה קבצים, כך שכל מעבד מודרני ממוצע עם מעט זיכרון עבודה יספיק פה בלי להזדקק לכרטיס מסך ייעודי.

אם אתם צריכים לוגיקה מורכבת, קוד ארוך או עיבוד טקסטים עמוקים, אין טעם להריץ מודל במשקל שבע מאות מיליון פרמטרים על המחשב. במקרים כאלה עדיף לפנות ל־API של מודל גדול בהרבה.

ollama run hf.co/LiquidAI/LFM2-700M-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר בתור רישיון מותאם אישית שאינו חופשי ואינו מפורט במלואו בעמוד. המשמעות היא שאסור לשלב אותו במוצר מסחרי לפני בדיקת תנאי השימוש המלאים במסמכי החברה.

הרישיון המלא בעמוד המודל ↗