GPT
L

LFM2.5-8B-A1B-GGUF

קוד פתוח

LiquidAIother2026-05-24

  • gguf
  • liquid
  • lfm2
  • edge
  • llama.cpp

גרסת GGUF של מודל היברידי בגודל שמונה מיליארד פרמטרים שפותחה לעבודה מקומית ויעילה. מיועדת למי שרוצה ביצועים טובים על חומרה עצמאית בלי לצרוך זיכרון כמו מודלים רגילים.

  • 61.4 GBמשקל הקבצים
  • 430,147הורדות בחודש
  • 295לייקים

מה זה

מדובר במודל היברידי מסדרת LFM2 שפותח ישירות לעבודה בקצה ובמכשירים מקומיים. המטרה של מבנה כזה היא להציע שילוב מוצלח יותר בין איכות הפלט, מהירות היצירה וניצול הזיכרון בהשוואה למודלי שפה סטנדרטיים בגודל שמונה מיליארד פרמטרים. המודל מיועד למשימות יצירת טקסט ומגיע בגרסת קבצים דחוסה שמוכנה לעבודה ישירה במחשב האישי או בשרת עצמאי.

הוא מאומן על שפות מרכזיות כמו אנגלית, ערבית, סינית, צרפתית, גרמנית, יפנית, קוריאנית וספרדית. אין כאן תמיכה רשמית בעברית, ולכן לא הייתי בונה עליו לטקסטים מורכבים בשפה המקומית. המפרסמים לא כללו בכרטיס טבלאות מבחנים ומספרים ספציפיים, אלא הפנו לדף המקורי, כך שצריך לבדוק אותו בפועל מול עומסי עבודה אמיתיים כדי לוודא שהוא אכן מנצל פחות משאבים ממודלים מקבילים.

מתאים ל

  • עוזר מקומי למחשב אישי

    רץ ישירות על החומרה המקומית ללא חיבור רשת ומאפשר לעבד טקסטים באנגלית ובשפות נוספות.

  • יישומי קצה ומכשירים חלשים

    מתאים לשרתים קטנים בזכות מבנה היברידי שנועד לחסוך צריכת זיכרון.

  • עיבוד טקסט רב לשוני

    עובד עם שפות כמו ערבית, צרפתית וספרדית שמופיעות ברשימת השפות הנתמכות.

איפה זה נופל

הכרטיס מציג מעט מאוד פרטים טכניים ולא מפרט מגבלות ספציפיות, הזיות נפוצות או נקודות כשל ידועות. עברית נעדרת לחלוטין מרשימת השפות הנתמכות, וסביר להניח שהפלט בעברית יהיה שבור או עילג. לא הייתי משלב אותו במוצר בלי לבדוק קודם איך המבנה ההיברידי מתמודד עם הוראות מורכבות.

אותה משפחה

LFM2.5 יצא ב־15 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

איך המודל מתמודד עם עברית?

עברית אינה מופיעה ברשימת השפות הרשמיות של המודל. סביר להניח שהתוצאות יהיו ברמה נמוכה, עם טעויות תחביר או חוסר הבנה של הקשר, ולכן הוא לא מתאים לפרויקטים בעברית.

האם חייבים להוריד את כל 61 הגיגה בייט?

לא. המשקל הכולל כולל מספר קבצי כימות שונים, וצריך להוריד רק את הקובץ הספציפי שמתאים לנפח הזיכרון ולדיוק שאתם צריכים.

איך מריצים

מריצים את המודל ישירות דרך כלי llama-cli באמצעות פקודה שמפנה למאגר שלו, עם פרמטרים של טמפרטורה נמוכה יחסית ברמה של 0.2 וקנס חזרתיות מתון. הפורמט הזה עובד ישירות על מעבדים וכרטיסים גרפיים ביתיים בלי צורך בהתקנות מסובכות של סביבות פיתוח ענקיות.

כלל הקבצים שוקלים יחד 61.4 גיגה בייט ומחולקים לעשרה קבצים שונים, אך בפועל מורידים רק את קובץ הכימות המתאים להיקף הזיכרון שלכם. למודל בגודל שמונה מיליארד פרמטרים מספיק כרטיס מסך עם שמונה עד שישה עשר גיגה זיכרון כדי לעבוד חלק.

ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר בתור רישיון אחר ואינו קוד פתוח מוכר וסטנדרטי. כדי להשתמש בו במוצר מסחרי צריך לקרוא את תנאי השימוש המדויקים באתר של המפתחת, כי ייתכנו הגבלות הפצה, הגבלות שימוש או איסור על מסחור ישיר.

הרישיון המלא בעמוד המודל ↗