GPT
M

moondream-2b-2025-04-14-4bit

קוד פתוח

moondreamapache-2.02025-05-20

  • safetensors
  • gguf
  • moondream1
  • image-text-to-text
  • custom_code

גרסה מכווצת בארבעה ביטים של מודל ראייה קטן עם 1.3 מיליארד פרמטרים. הוא מיועד למי שרוצה לפענח תמונות מקומית בלי לטחון זיכרון גרפי יקר.

  • 1.3Bפרמטרים
  • 5.4 GBמשקל הקבצים
  • 6,683הורדות בחודש
  • 69לייקים

מה זה

מדובר במודל שמשלב תמונה וטקסט כדי לענות על שאלות או לחלץ מידע ויזואלי. המפתחים אימנו אותו מראש תוך התחשבות בכימות לארבעה ביטים, מה שהוריד 42 אחוז מצריכת הזיכרון שלו במחיר של פגיעה זניחה של 0.6 אחוז בלבד בדיוק לפי הנתונים שלהם.

בגודל כזה של מיליארד ושלוש מאות מיליון פרמטרים, המטרה היא מהירות ויעילות מקסימלית על חומרה קצה או על כרטיסים צנועים. הוא לא מנסה להתחרות בענקי ראייה כבדים בניתוח מסמכים סבוכים, אלא לתת מענה מהיר מאוד למשימות זיהוי ותיאור ישירות.

מתאים ל

  • תיאור תמונות מהיר

    קצב של 184 תווים לשנייה מאפשר לייצר טקסט חלופי ותיאור קצר לעשרות תמונות בזמן קצר מאוד.

  • עיבוד על מכשירי קצה

    צריכה של פחות משניים וחצי גיגה זיכרון גרפי מתאימה למחשבים מקומיים ולכרטיסי מסך בסיסיים.

  • סינון תוכן חזותי פנימי

    מענה על שאלות בסיסיות לגבי מה מופיע בתמונה בלי להוציא את המידע לשרתים חיצוניים.

איפה זה נופל

למרות הכימות המוצלח, מודל של 1.3 מיליארד פרמטרים מוגבל מובנית בהבנה של סצנות מורכבות, קריאת טקסט צפוף או פיענוח יחסים עדינים בין עצמים בתמונה. כרטיס המודל לא מציג נתונים לגבי תמיכה בשפות שאינן אנגלית, ולכן הנחת העבודה צריכה להיות שעברית לא תעבוד כאן טוב בלי בדיקה קפדנית.

שאלות
נפוצות

כמה זיכרון גרפי צריך כדי להריץ את המודל הזה בפועל?

המודל דורש 2,450 מגה בייט של זיכרון וידאו לפי הבדיקות של המפתחים על כרטיס RTX 3090. זה אומר שהוא נכנס בנוחות כמעט בכל כרטיס גרפי מודרני, גם כזה עם שישה או שמונה גיגה זיכרון.

האם כדאי להשתמש בגרסה הזו במקום בגרסה הרגילה?

הגרסה הזו חוסכת 42 אחוז בזיכרון תמורת ירידה מדווחת של פחות מאחוז בדיוק. אם הזיכרון שלכם מוגבל או שאתם צריכים להריץ תהליכים נוספים במקביל על אותו כרטיס, זו הבחירה ההגיונית.

איך מריצים

כדי להריץ אותו צריך להתקין את הספריות pillow ו torchao. על כרטיס Nvidia RTX 3090 הוא צורך 2,450 מגה בייט בלבד של זיכרון וידאו, ומגיע לקצב עבודה של 184 תווים לשנייה. מדובר בדרישות זיכרון קלות שאפשר לספק גם עם חומרה ביתית פשוטה יחסית.

אם יש לכם צורך בעיבוד מקומי מהיר בלי לשלוח תמונות של משתמשים לרשת, ההרצה העצמית הזו משתלמת מיד. לעומת זאת, אם התשתית שלכם כולה בענן ואין לכם שרת GPU דולק ממילא, קריאה לשירות מנוהל תחסוך את עלות התחזוקה.

ollama run hf.co/moondream/moondream-2b-2025-04-14-4bit:F16

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו ולשלב אותו בקוד סגור, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי. אין כאן הגבלות מיוחדות על הפצה במוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗