GPT
F

falcon-7b

קוד פתוח

tiiuaeapache-2.02023-04-24

  • transformers
  • pytorch
  • safetensors
  • falcon
  • text-generation

מודל בסיס פתוח שמתאים לאימון עצמי, עם ארכיטקטורה מותאמת להסקה מהירה שמציגה ביצועים טובים יותר ממקביליו באותו גודל.

  • 7.2Bפרמטרים
  • 26.9 GBמשקל הקבצים
  • 361,610הורדות בחודש
  • 1,105לייקים

מה זה

מדובר במודל שפה מסוג דקודר בלבד עם 7.2 מיליארד פרמטרים, שאומן על 1,500 מיליארד טוקנים. מרבית המידע מגיע ממאגר רשת מסונן היטב בשם RefinedWeb, לצד תוספות של ספרים, שיחות וקוד. הוא נבנה כמודל גולמי שנועד לחזות את המילה הבאה, ולא אומן מראש לשיחה או למענה ישיר לפקודות.

הייחוד שלו לעומת חלופות באותו סדר גודל טמון בארכיטקטורה. הוא משלב מנגנון multiquery ושימוש ב־FlashAttention יחד עם בלוקים מקבילים של שכבות, מה שמפחית את צוואר הבקבוק החישובי בזמן יצירת הטקסט. במבחני OpenLLM Leaderboard הוא הציג תוצאות גבוהות יותר מדגמים מתחרים כמו MPT-7B ו־StableLM, מה שהופך אותו לנקודת מוצא חזקה במיוחד להתאמה אישית.

מתאים ל

  • אימון מודל לתחום צר

    נקודת פתיחה מצוינת לכוונון עדין על דאטה פנים־ארגוני באנגלית בזכות ארכיטקטורה יעילה.

  • השלמת טקסט וקוד

    מתאים למערכות אוטומציה שמייצרות המשך טבעי לפסקאות או קטעי קוד קצרים.

  • מחקר וניסויי שפה

    פלטפורמה פתוחה לחלוטין לבדיקת שיטות דחיסה, כיול וארכיטקטורת שכבות בלי מגבלות קנייניות.

איפה זה נופל

המודל אומן בעיקר באנגלית ובצרפתית, עם מעט מאוד דאטה בשפות אירופיות נוספות. עברית הוא לא מכיר ברמה סבירה, ולכן אי אפשר להשתמש בו ליישומים מקומיים ללא אימון מסיבי מראש. מעבר לכך, מדובר במודל בסיס שנוטה להמשיך טקסטים בצורה עיוורת ולא מתוכנת לציית לבקשות, כך שפרומפטים רגילים ייכשלו. הדאטה שלו מבוסס על סריקת רשת פתוחה, ולכן הוא מייצר הטיות וסטריאוטיפים שדורשים שכבת סינון ובקרה לפני כל חשיפה למשתמשי קצה.

אותה משפחה

falcon יצא ב־7 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל הזה עובד בעברית?

לא. המודל אומן בעיקר על אנגלית ומעט צרפתית. הוא לא כולל אימון על עברית ולא יפיק תוצאות שמישות בשפה הזו בלי אימון ייעודי נרחב.

אפשר להשתמש בו בתור צ'אטבוט?

לא מומלץ ישירות. זהו מודל בסיס שמשלים טקסט ולא עבר התאמה לשיחות. למטרות צ'אט עדיף להוריד ישירות את גרסת Falcon-7B-Instruct.

איך מריצים

כדי להריץ אותו להסקה צריך כרטיס מסך עם 16 גיגה־בייט זיכרון לפחות, לצד PyTorch 2.0 וספריית transformers של Hugging Face. המודל שוקל קרוב ל־27 גיגה־בייט בקבצי bfloat16, כך שתצטרכו תשתית ענן רצינית או שרת ייעודי כדי לעבוד איתו בצורה חלקה.

אם אתם צריכים צ'אטבוט או ממשק שעונה להוראות ישר מהקופסה, הגרסה הזו לא בשבילכם ותצטרכו לקחת את Falcon-7B-Instruct. להקמת שירות מהיר בלי לנהל שרתים וזיכרון וידאו, פשוט עדיף להתחבר ל־API מוכן או להשתמש במנוע כמו Text Generation Inference.

from transformers import pipeline

pipe = pipeline("text-generation", model="tiiuae/falcon-7b")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 פתוח ומאפשר שימוש מסחרי מלא. אתם יכולים לשלב אותו במוצרים, להפיץ אותו, להריץ עליו כוונון עדין ולמכור שירותים שמבוססים עליו, בלי לשלם תמלוגים ובלי הגבלות מיוחדות, כל עוד אתם שומרים על הודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗