GPT
L

LFM2.5-Audio-1.5B-GGUF

קוד פתוח

LiquidAIother2026-01-06

  • gguf
  • liquid
  • lfm2.5
  • edge
  • llama.cpp

מודל שמע קומפקטי שיודע לתמלל, להקריא ולנהל שיחה קולית מלאה מקצה לקצה. הוא רץ מקומית בפורמט מכווץ וחוסך שרשור של כמה מערכות נפרדות.

  • 5.8 GBמשקל הקבצים
  • 39,595הורדות בחודש
  • 126לייקים

מה זה

מדובר במודל שמע שמשלב שלוש יכולות מרכזיות בחבילה אחת קטנה: תמלול דיבור לטקסט, הקראת טקסט לקול, ומענה משולב שמקבל קול ומחזיר גם טקסט וגם אודיו. במקום להחזיק מודל נפרד לזיהוי דיבור, מודל שפה לתשובה ועוד מודל להקראה, הוא עושה את כל המסלול בעצמו על בסיס ארכיטקטורה קומפקטית.

היתרון הגדול שלו הוא המשקל. קבצי הריצה המכווצים בפורמט הנוכחי מאפשרים להרים צינור עיבוד קולי שלם בלי להזדקק לחוות שרתים, וזה שימושי במיוחד אם רוצים תגובה מהירה ואינטראקציה קולית ישירה על חומרה מקומית סבירה.

מתאים ל

  • תמלול אודיו באנגלית

    המרה ישירה של קבצי קול לטקסט מקומית בלי לשלוח שום מידע החוצה לענן.

  • הקראת טקסט מקומית

    יצירת קבצי קול מתוך טקסט כתוב באמצעות ווקודר מובנה ובמשאבי זיכרון נמוכים.

  • סייען קולי שלם

    קבלת שאלות בקול ומענה ישיר בדיבור ובטקסט באותו תהליך ריצה.

איפה זה נופל

הקוד להרצה מבוסס על פול ריקווסט שעדיין נמצא בעבודה מול llama.cpp, מה שאומר שהתמיכה עדיין לא נכנסה לקוד המרכזי והיציב של הפרויקט. תצטרכו להשתמש בקבצי ההרצה הייעודיים של LiquidAI ולא בכלים הסטנדרטיים שאתם רגילים אליהם.

בנוסף, הכרטיס מציין תמיכה באנגלית בלבד. אם תנסו לתמלל או להקריא עברית, זה כנראה ייכשל לחלוטין או יישמע משובש מאוד, כך שהוא לא מתאים למוצרים שפונים לקהל ישראלי בשפת המקור.

אותה משפחה

LFM2.5-Audio יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ את המודל ישירות בגרסה הרגילה של llama.cpp?

לא כרגע. התמיכה במודל נשענת על פול ריקווסט שנמצא עדיין בפיתוח ולא מוזג לגרסה הראשית. צריך להשתמש בקבצי ההרצה הייעודיים שפורסמו איתו.

האם המודל מבין ומדבר עברית?

לא. לפי הנתונים המודל מאומן ותומך באנגלית בלבד. שימוש בעברית לא יעבוד בצורה תקינה.

איך מריצים

כדי להריץ אותו צריך כלי הרצה ייעודיים שנבנו סביב llama.cpp, ולא את הבינארי הרגיל של המערכת. הפקודות דורשות טעינה במקביל של כמה קבצים: משקלי המודל המכוונים, מודול המולטימודל, ווקודר ייעודי וקובץ טוקנייזר לקול. אפשר להריץ אותו דרך שורת הפקודה או להרים שרת מקומי ולדבר איתו דרך סקריפט פייתון שמצורף לריפו.

מבחינת חומרה, דגם של מיליארד וחצי פרמטרים בכימות של ארבעה ביט לא דורש מפלצת חישוב ויכול לרוץ בנוחות על כרטיס מסך ביתי או על מעבד מודרני עם זיכרון מספק. אם אתם לא רוצים להסתבך עם קומפילציה של גרסאות פיתוח ספציפיות, אפשר לבדוק אותו תחילה בגרסת הרשת שהמפתחים מציעים.

ollama run hf.co/LiquidAI/LFM2.5-Audio-1.5B-GGUF:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר כ־other ולא כרישיון קוד פתוח סטנדרטי כמו אפאצ'י או MIT. המשמעות היא שחייבים לפנות לתיעוד המקורי של LiquidAI כדי לראות אם מותר להשתמש בו במוצר מסחרי, מה ההגבלות על הפצה ומה התנאים המשפטיים לפני שמשלבים אותו בקוד שלכם.

הרישיון המלא בעמוד המודל ↗