GPT
F

Falcon3-7B-Instruct

קוד פתוח

tiiuaeother2024-11-29

  • transformers
  • safetensors
  • llama
  • text-generation
  • falcon3

מודל שיחה פתוח בגודל 7.5 מיליארד פרמטרים שמתמחה במתמטיקה והסקה מורכבת. הוא מביא ביצועים חזקים במיוחד לקטגוריה הזו, בתנאי שלא צריכים עברית.

  • 7.5Bפרמטרים
  • 32,768טוקנים בהקשר
  • 13.9 GBמשקל הקבצים
  • 15,500הורדות בחודש

מה זה

המכון לחדשנות טכנולוגית באבו דאבי אימן כאן מודל על 14 טריליון טוקנים, כולל דגש חזק על תחומי הנדסה ומדעים. התוצאה בולטת ישירות במבחנים הקשים. במבחן MATH ברמה 5 הוא משיג 31.87 נקודות, בזמן שמתחרים ישירים כמו לאמה 3.1 מגיעים לפחות מעשרים נקודות, וגם בבדיקות הסקה כמו BBH ו־MUSR הוא עוקף את המתחרים המובילים בגודל שלו.

מצד שני, במשימות כלליות יותר של הבנת שפה ועמידה בהוראות הוא לא מוביל. במבחני MMLU-PRO או IFEval מודלים מקבילים עדיין עוקפים אותו או משתווים אליו. הוא בנוי על ארכיטקטורת דקודר עם מנגנון תשומת לב מקובץ שנועד להאיץ את הריצה, וכולל אוצר מילים של 131 אלף מילים שמסייע להתמודדות עם טקסטים ארוכים.

מתאים ל

  • פתרון בעיות מתמטיות

    הוא מציג תוצאות גבוהות משמעותית ממתחריו במבחני MATH ברמה הגבוהה ביותר.

  • הסקה לוגית ומדעית באנגלית

    ציונים מובילים במבחני GPQA ו־MUSR הופכים אותו למתאים לעיבוד שאלות מדעיות מורכבות.

  • עיבוד מסמכים ארוכים בלועזית

    תמיכה מובנית ב־32 אלף טוקנים מאפשרת לקרוא קבצים שלמים בארבע השפות הנתמכות.

איפה זה נופל

החיסרון המרכזי למשתמש הישראלי הוא השפות. הוא הוגדר ותוכנן לתמוך בארבע שפות בלבד: אנגלית, צרפתית, ספרדית ופורטוגזית. עברית פשוט לא קיימת שם באופן רשמי. בנוסף, במבחני הפעלת כלים וקריאות פונקציה הוא קיבל 89.5 נקודות, ציון נמוך במעט מהמתחרים שלו, מה שאומר שכדאי לבדוק טוב את האמינות שלו לפני שמחברים אותו למערכות אוטומטיות.

אותה משפחה

Falcon3 יצא ב־5 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יודע לעבוד בעברית?

האימון והבדיקות הוגבלו לארבע שפות בלבד: אנגלית, צרפתית, ספרדית ופורטוגזית. עברית לא נכללת ברשימת השפות הנתמכות, ולכן הוא לא יתאים למשימות מקומיות.

איזו חומרה מינימלית צריך כדי להריץ אותו?

הקבצים שוקלים כמעט 14 גיגה בייט בדיוק המקורי. כרטיס מסך מודרני עם 24 גיגה בייט זיכרון יספיק להרצה מקומית, אך שימוש בכל 32 אלף הטוקנים ידרוש יותר זיכרון.

איך מריצים

המשקל הכולל של הקבצים עומד על כמעט 14 גיגה בייט בדיוק של bfloat16. כדי לטעון אותו ולהריץ עליו שאילתות בלי להיתקע בחוסר זיכרון, תצטרכו כרטיס מסך בודד עם 24 גיגה בייט VRAM כמו RTX 3090, RTX 4090 או כרטיס שרת מקביל. אם מתכננים לנצל את כל חלון ההקשר של 32 אלף טוקנים, דרישת הזיכרון תעלה מעבר לזה.

אם אין לכם כרטיס כזה זמין בענן או במשרד, הפעלת שרת ייעודי בשבילו תדרוש תחזוקה שלא תמיד מצדיקה את עצמה לעומת שימוש ב־API חיצוני של מודלים מוכנים.

from transformers import pipeline

pipe = pipeline("text-generation", model="tiiuae/Falcon3-7B-Instruct")
print(pipe("שלום"))

הרישיון

הוא מופץ תחת רישיון ייעודי של המפתח בשם TII Falcon-LLM License 2.0. זה אינו רישיון קוד פתוח סטנדרטי מסוג אפאצ'י או MIT. לפני שילוב שלו במוצר מסחרי, חובה לפתוח את תנאי הרישיון המדויקים ולוודא שהשימוש המיועד והפצת התוצרים עומדים בהגבלות שהם הגדירו.

הרישיון המלא בעמוד המודל ↗