GPT
L

LFM2-2.6B-Exp-GGUF

קוד פתוח

LiquidAIother2025-12-25

  • gguf
  • liquid
  • lfm2
  • edge
  • llama.cpp

גרסת GGUF ניסיונית למודל קומפקטי שמכוון ישירות לעבודה מקומית על מכשירי קצה. הוא מעניין אם אתם מחפשים מהירות ויעילות זיכרון במחשב בלי מאיץ גרפי כבד.

  • 14.6 GBמשקל הקבצים
  • 4,419הורדות בחודש
  • 67לייקים

מה זה

מדובר במודל היברידי קטן של 2.6 מיליארד פרמטרים שמיועד ליצירת טקסט, כשהמטרה המוצהרת שלו היא ריצה יעילה במיוחד על חומרה חלשה. הארכיטקטורה שלו מנסה לחסוך בזיכרון ולהאיץ את קצב העבודה, ולכן המפתחים כיוונו אותו לעבודה על מכשירי קצה ולא לשרתי ענק. הוא תומך ברשימה של שמונה שפות, כולל אנגלית, ערבית, סינית, צרפתית, גרמנית, יפנית, קוריאנית וספרדית.

בכרטיס לא פורסמו תוצאות מדידה או מבחני ביצועים, כך שקשה לדעת מראש איך הוא עומד מול חלופות מוכרות באותו סדר גודל. מה שכן ברור זה שמדובר בגרסה ניסיונית לחלוטין. ההבדל בינו לבין מודלים סטנדרטיים טמון בעיקר במבנה ההיברידי ובאריזה בפורמט שמיועד לטעינה ישירה בכלים קלים, אבל בלי נתונים מספריים על איכות הפלט תצטרכו לבדוק את התשובות בעצמכם כדי לראות אם הוא בכלל עונה על הצרכים שלכם.

מתאים ל

  • ריצה מקומית על מחשב נייד

    הפורמט מותאם לטעינה מהירה בזיכרון צנוע ובלי צורך בכרטיס מסך ייעודי.

  • עיבוד טקסט ללא חיבור רשת

    מתאים לתרחישים שדורשים יצירת טקסט על מכשיר הקצה באופן עצמאי לחלוטין.

  • ניסויים בארכיטקטורה היברידית

    בדיקת ההתנהגות של מודל קטן מהסדרה החדשה על משימות פשוטות בשפות נתמכות.

איפה זה נופל

המודל מוגדר כניסיוני, ובכרטיס שלו אין שום תיעוד על מגבלות בטיחות, שיעורי הזיות או איכות הקוד שהוא מייצר. עברית בכלל לא מופיעה ברשימת השפות הנתמכות, כך שאי אפשר להסתמך עליו למשימות בשפה המקומית בלי לצפות לשיבושים קשים. לפני שמכניסים אותו לתהליך עבודה, חובה לבדוק ידנית את איכות הפלט בכל שפה שמעניינת אתכם, כי היוצרים לא סיפקו שום התחייבות או מדד השוואתי.

אותה משפחה

LFM2-2.6B-Exp יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר לעבוד עם המודל הזה בעברית?

המודל תומך רשמית בשמונה שפות אחרות, ועברית אינה אחת מהן. הוא עשוי לפלוט מילים בודדות, אבל היעדר התמיכה הרשמית יגרום כנראה לשגיאות ולחוסר קוהרנטיות. אם אתם צריכים עיבוד בעברית, עדיף לחפש חלופה אחרת.

האם כדאי לשלב אותו כבר עכשיו במוצר בייצור?

לא מומלץ. השם שלו כולל במפורש את התיוג Exp, המעיד על גרסה ניסיונית, ואין פרטים מלאים על ביצועים או רישיון מסחרי ברור. הוא מתאים בעיקר לבדיקות ביצועים ולניסויי היתכנות מקומיים.

איך מריצים

המודל מגיע בפורמט GGUF, מה שאומר שאתם מריצים אותו ישירות דרך כלי כמו llama.cpp עם פקודה פשוטה שמושכת את המשקלים. גודל כלל הקבצים מגיע ל־14.6 גיגה־בייט שמחולקים בין הגרסאות, כך שקובץ בודד ידרוש מעט מאוד זיכרון עבודה וירוץ בלי בעיה על מעבד רגיל של מחשב נייד או כרטיס מסך בסיסי.

אם אתם צריכים רק לבדוק תגובות מהירות או לפתח פיצ'ר שלא דורש התקנה מקומית, עדיף להשתמש בסביבת הבדיקה המקוונת שהמפתחים מציעים או ב־API חיצוני. הרצה מקומית משתלמת כאן בעיקר אם המטרה היא לפעול אופליין לגמרי או לחסוך עלויות תשתית במכשירים מבוזרים.

ollama run hf.co/LiquidAI/LFM2-2.6B-Exp-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כרגע תחת הסיווג other, בלי פירוט של תנאי השימוש המדויקים בתוך כרטיס המודל. המשמעות היא שאין אישור מפורש לשימוש מסחרי חופשי או להפצה במוצר שלכם. מי שמתכנן לשלב אותו בקוד מסחרי חייב להיכנס לתיעוד החיצוני של החברה ולבדוק מה המגבלות המשפטיות שהם קבעו לפני שנוגעים בו.

הרישיון המלא בעמוד המודל ↗