GPT
G

gemma-2b-it-GGUF

קוד פתוח

lmstudio-aiother2024-02-21

  • gguf
  • endpoints_compatible

גרסה מכווצת למודל ההוראות הקטן של גוגל, שנכנסת בקלות לזיכרון של מחשב רגיל. פתרון מתאים למי שרוצה הרצה מקומית קלה ומהירה בלי לגעת בענן.

  • 3.9 GBמשקל הקבצים
  • 18,434הורדות בחודש
  • 73לייקים

מה זה

מדובר בהמרה לפורמט GGUF של המודל gemma-2b-it מבית גוגל, שהועלתה על ידי lmstudio-ai. הוא מאומן לפעולות של מעקב אחרי הוראות ושיחה, אבל בנפח קטן מאוד של שני מיליארד פרמטרים. כל המשקל שלו מסתכם ב־3.9 גיגה-בייט שמחולקים לחמישה קבצים, מה שהופך אותו לאחד הכלים הכי נגישים להורדה.

היתרון המרכזי כאן הוא היכולת לבצע משימות טקסט בסיסיות על חומרה חלשה בלי להסתבך. הוא לא מנסה להתחרות בענקים של שבעים מיליארד פרמטרים, אלא לתת מענה מקומי מיידי למשימות נקודתיות שדורשות צריכת משאבים מינימלית.

מתאים ל

  • בוט מקומי על מחשב נייד

    שוקל מעט מאוד ומאפשר מענה על שאלות פשוטות בלי חיבור לרשת ובלי צורך במעבד גרפי.

  • מיון טקסטים מהיר

    מתאים לביצוע משימות קצרות וסיווג משפטים מקומי בלי לשלם על קריאות שרת.

  • פיתוח ובדיקות על החומרה

    מאפשר לבדוק אינטגרציה של קוד מול ממשקי שפה מקומיים בלי להעמיס על המחשב.

איפה זה נופל

עם שני מיליארד פרמטרים בלבד, יכולת ההסקה הלוגית שלו מוגבלת מאוד בהשוואה למודלים מלאים. הוא עלול לטעות בקלות בעובדות, להתבלבל בהוראות מורכבות שמכילות כמה שלבים, ולא לספק תוצאות טובות בעברית בלי התאמות מיוחדות. אל תבנו עליו למשימות של ניתוח קוד מסובך או כתיבה יצירתית עמוקה.

שאלות
נפוצות

אפשר להריץ אותו על לפטופ רגיל בלי כרטיס מסך?

כן. כל הקבצים ביחד שוקלים 3.9 גיגה-בייט, כך שמעבד רגיל וכמה גיגות של זיכרון ראם יספיקו בהחלט כדי לעבוד איתו בצורה חלקה.

הוא מתאים לעבודה שוטפת בעברית?

זה מודל קטן מאוד של שני מיליארד פרמטרים שאומן בעיקר באנגלית. עדיף לא להסתמך עליו לעברית טבעית או משימות תרגום מורכבות בלי לבדוק אותו קודם על דוגמאות שלכם.

איך מריצים

את הקבצים האלה אפשר לפתוח ישירות בתוכנות שתומכות בפורמט כמו LM Studio או llama.cpp. בגלל המשקל הכולל של 3.9 גיגה-בייט, אין שום צורך בכרטיס מסך מפלצתי או במעבד גרפי ייעודי, ואפשר להריץ אותו ישירות על מעבד של מחשב נייד ממוצע עם מעט זיכרון פנימי.

אם אתם צריכים רק בדיקה מהירה או עיבוד מקומי פשוט, שווה להוריד אותו למחשב. אם אתם מתכננים לבנות עליו שירות שלם עם עומס משתמשים כבד או משימות חשיבה מסובכות, עדיף להשתמש ב־API של מודלים גדולים יותר.

ollama run hf.co/lmstudio-ai/gemma-2b-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

5 קבצים במאגר, 3.9 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון מוגדר בתור other ומפנה לתנאי השימוש הרשמיים של Google Gemma. זה אומר שלא מדובר ברישיון קוד פתוח חופשי לגמרי כמו אפאצ'י, אלא בהסכם שימוש ייעודי של גוגל שמטיל הגבלות שונות. לפני שאתם משלבים אותו במוצר מסחרי, אתם חייבים לקרוא את התנאים של גוגל ולוודא שהשימוש שלכם מותר.

הרישיון המלא בעמוד המודל ↗