GPT
L

Llama3-OpenBioLLM-8B

קוד פתוח

aadityallama32024-04-20

  • transformers
  • pytorch
  • llama
  • text-generation
  • llama-3

מודל שפה רפואי מבוסס לאמה 3 שמכוון לתחום הביולוגי ומדעי החיים. הוא עוקף מודלים גדולים בהרבה במבחנים רפואיים, ועדיין רץ בנוחות על כרטיס מסך בודד.

  • 8,192טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 3,021הורדות בחודש
  • 250לייקים

מה זה

מדובר בהתאמה של לאמה 3 בגודל שמונה מיליארד פרמטרים שנעשתה במעבדות סאמה, בעזרת אימון על שאלות רפואיות ואופטימיזציית העדפות עם מאגר נקטר. הוא מכוון ישירות לעולם הביומד, ומיועד להבין מינוחים מקצועיים, ניתוח נתונים קליניים וספרות מדעית באנגלית.

במבחני בנצ׳מרק מול תשעה מאגרי שאלות רפואיים הוא השיג ממוצע של 72.5 אחוזים. בפועל זה אומר שבמבחנים כמו גנטיקה רפואית ושאלות פאבמד הוא עוקף מודלים כמו ג׳מיני 1.0 ומיסטרל 7B, ואפילו מודלים ייעודיים עצומים כמו מדיטרון 70B. הוא עדיין מפסיד למודל ה־70B של אותה סדרה ול־GPT-4, אבל ביחס לגודל שלו הוא עונה ברמת דיוק מרשימה.

מתאים ל

  • מענה על שאלות מחקר

    שליפת תשובות ממאמרים רפואיים בזכות ציון של 74.12 במבחן פאבמד.

  • סיווג טקסטים ביולוגיים

    מיון מאמרים ומסמכים מדעיים באנגלית לפי תחומים ונושאים.

  • ניתוח מושגים גנטיים

    התמודדות עם מונחים תורשתיים מורכבים שבהם המודל השיג 86.1 אחוז דיוק.

איפה זה נופל

הכרטיס מזהיר במפורש לא להשתמש במודל להחלטות קליניות או לטיפול ישיר בחולים. הוא לא נבדק בניסויים מבוקרים, מייצר לפעמים תשובות ארוכות מדי ועלול להכיל הטיות או מידע שגוי. מעבר לכך, המודל אומן ותומך רק בשפה האנגלית, ולכן אינו מתאים לניתוח תיקים רפואיים בעברית. רוב הדוגמאות המרשימות של חילוץ ישויות וסיווג בכרטיס המודל הוצגו על גרסת ה־70B ולא עליו.

אותה משפחה

Llama3-OpenBioLLM יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש במודל כדי לקבל אבחון לחולים?

לא. המפתחים מדגישים שהמודל מיועד למחקר ופיתוח בלבד ולא נבדק בסביבה קלינית אמיתית. יש בו סכנת הזיות וטעויות שעלולות לסכן מטופלים.

האם המודל יודע לקרוא סיכומי מחלה בעברית?

המודל מוגדר רשמית לאנגלית בלבד. אימון ההמשך התמקד בדאטה רפואי באנגלית, ולכן לא מומלץ להסתמך עליו בעיבוד טקסטים קליניים מקומיים.

איך מריצים

המשקל הכולל של הקבצים עומד על 15 ג׳יגה בפורמט bfloat16, מה שאומר שכרטיס מסך יחיד עם 24 ג׳יגה זיכרון מריץ אותו בלי מאמץ דרך טרנספורמרס. יש גם גרסאות מקוונטות מסוג GGUF שמאפשרות לרדת לחומרה חלשה בהרבה ואפילו למעבדים רגילים.

חובה להשתמש בתבנית השיחה המדויקת של לאמה 3 אינסטראקט, אחרת מקבלים נפילה חדה באיכות הפלט. היוצרים ממליצים לקבוע טמפרטורה לאפס כדי להקטין פטפוט מיותר. אין לו API רשמי מנוהל מהיוצר, כך שאם לא רוצים להרים שרת עצמאי, צריך לחפש ספקי ענן צד שלישי שמאפשרים פריסה של משקלי המודל.

from transformers import pipeline

pipe = pipeline("text-generation", model="aaditya/Llama3-OpenBioLLM-8B")
print(pipe("שלום"))

הרישיון

המודל כפוף לרישיון לאמה 3 של מטא. מותר להשתמש בו לצרכים מחקריים ומסחריים, בתנאי שלא עוברים 700 מיליון משתמשים פעילים בחודש, שאז נדרש אישור פרטני ממטא. חלות גם הגבלות השימוש והבטיחות הסטנדרטיות של מטא.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗