GPT
G

lmstudio-community/gemma-3-27b-it-GGUF

קוד פתוח

lmstudio-communitygemma2025-03-12

  • gguf
  • image-text-to-text
  • endpoints_compatible
  • conversational

גרסה מכווצת של גוגל למשימות משולבות של טקסט ותמונה, שמתאימה למי שרוצה ביצועים חזקים מקומית עם חלון עבודה גדול.

  • 77.1 GBמשקל הקבצים
  • 7,705הורדות בחודש
  • 51לייקים

מה זה

מדובר במודל שפותח במקור על ידי גוגל ומספק מענה לשילוב בין טקסט לתמונות. הוא יודע לקבל תמונות ברזולוציה שעוברת התאמה ל־896 על 896 פיקסלים, לצד יכולות כתיבה, סיכום, מענה לשאלות והסקה לוגית. היתרון המשמעותי כאן הוא השילוב בין גודל של 27 מיליארד פרמטרים לבין חלון הקשר של 128 אלף טוקנים, שמאפשר להזין מסמכים ארוכים או שיחות ממושכות בלי לאבד את ההקשר.

המשקל הכולל של הקבצים בעמוד מגיע ל־77.1 ג'יגה בייט ב־7 קבצים שונים, שהוכנו באמצעות llama.cpp על ידי המשתמש bartowski. ההמרה הזו מיועדת למי שמחפש מודל רב-מודאלי שמסוגל לעבד גם קלט ויזואלי וגם טקסט מורכב בלי להיות תלוי בשרתים מרוחקים של חברות ענק.

מתאים ל

  • ניתוח מסמכים עם תרשימים

    הוא מטפל בו-זמנית בטקסט ובתמונות, עם חלון הקשר ענק של 128 אלף טוקנים.

  • מענה מבוסס תמונות

    מתאים לזיהוי והסקה על גבי תמונות ברזולוציה מותאמת ישירות מהחומרה שלכם.

  • סיכום טקסטים ארוכים

    תומך בפלט של עד 8,192 טוקנים, מה שמאפשר כתיבת ניתוחים מעמיקים ומלאים.

איפה זה נופל

המודל דורש גרסת בטא חדשה של llama.cpp, מה שאומר שאתם עלולים להיתקל בבעיות יציבות או תאימות בהרצה. בנוסף, עיבוד התמונות מוגבל לרזולוציה של 896 על 896 בלבד, כך שתמונות מפורטות יותר עוברות התאמה שעלולה לפגוע בזיהוי פרטים קטנים. LM Studio עצמם מבהירים שהם לא בודקים את אמינות התוכן, והמודל עלול לייצר מידע מטעה, פוגעני או לא מדויק.

אותה משפחה

gemma-3 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל ירוץ על מחשב נייד סטנדרטי?

לא. מודל של 27 מיליארד פרמטרים ששוקל עשרות ג'יגה בייטים ידרוש זיכרון RAM ו־VRAM משמעותיים מאוד שלא קיימים במחשב רגיל. ללא כרטיס מסך חזק, המודל יעבוד לאט מדי או יקרוס מחוסר זיכרון.

האם אפשר להזין תמונות ברזולוציה גבוהה?

המודל מנרמל תמונות לרזולוציה של 896 על 896 פיקסלים. אם תזינו תמונה גדולה יותר היא תוקטן, מה שעלול להקשות עליו לקרוא טקסט זעיר או פרטים טכניים דקים.

איך מריצים

כדי להריץ אותו תצטרכו סביבת llama.cpp בגרסה v1.19.0 לפחות, שמוגדרת כרגע בגרסת בטא. מודל בגודל 27 מיליארד פרמטרים דורש כרטיס מסך חזק מאוד עם זיכרון וידאו נרחב, או חלוקה בין זיכרון המחשב לכרטיס המסך, מה שעלול להאט את קצב יצירת הטוקנים באופן מורגש.

אם אין לכם חומרה ייעודית עם מספיק זיכרון לתמוך בקבצים הגדולים ובחלון הקשר מלא, עדיף להשתמש ב־API מנוהל של המודל המקורי במקום להיאבק בהרצה מקומית אטית שלא תספק תוצאות בזמן סביר.

ollama run hf.co/lmstudio-community/gemma-3-27b-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא gemma. מדובר ברישיון הייעודי של גוגל למשפחת המודלים הזו, שאינו קוד פתוח מלא אלא רישיון שימוש מותנה. הוא מאפשר שימוש מסחרי תחת הגבלות שימוש מקובלות של גוגל, אך מחייב בדיקה של תנאי הרישיון המדויקים לפני שמשלבים אותו במוצר מסחרי פעיל.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗