GPT
F

Foundation-Sec-8B

קוד פתוח

fdtn-aiapache-2.02025-04-26

  • transformers
  • safetensors
  • llama
  • text-generation
  • security

מודל בסיס פתוח של סיסקו שעבר אימון ייעודי על נתוני אבטחת מידע, ומאפשר להריץ ניתוחי איומים מקומית בלי לשלוח מידע רגיש לענן.

  • 8Bפרמטרים
  • 131,072טוקנים בהקשר
  • 15.0 GBמשקל הקבצים
  • 7,555הורדות בחודש

מה זה

מדובר במודל שפותח על בסיס Llama 3.1 8B ועבר אימון המשך על כחמישה נקודה אחד מיליארד טוקנים של תוכן אבטחה, כולל דוחות מודיעין, מאגרי חולשות ונהלי תגובה לתקריות. הוא נועד לנתח התראות אבטחה, למפות טכניקות תקיפה, לסווג חולשות ולסייע לחוקרים ולצוותי הגנה. המודל מתמקד באנגלית בלבד ותומך בחלון הקשר של מאה שלושים ואחד אלף טוקנים, אם כי רצף האימון שלו עצמו הוגדר לארבעת אלפים ותשעים ושבעה טוקנים.

בבדיקות מול מודלים אחרים, הוא עוקף את מודל הבסיס הרגיל באותו סדר גודל ומציג תוצאות שמתחרות אפילו במודלים גדולים בהרבה. במבחן CTI-MCQA הוא הגיע לציון של שישים ושבע נקודה שלושים ותשע, ובמבחן מיפוי גורמי שורש של חולשות לקטגוריות CWE השיג שבעים וחמש נקודה עשרים ושש, תוצאה שעוברת גם את דגם השבעים מיליארד פרמטרים של מטא. בפועל, המשמעות היא הבנה טכנית עמוקה ומדויקת יותר של מבנה חולשות והתאמתן לסיווגים מקובלים בתעשייה.

מתאים ל

  • תחקור התראות במרכז בקרה

    ניתוח לוגים וסיכום הערות אנליסטים לתוך דוחות אירוע מובנים.

  • מיפוי פעולות לתקיפה

    זיהוי וסיווג טכניקות לפי מסגרת MITRE ATT&CK מתוך טקסט טכני.

  • סיווג חולשות אבטחה

    קישור בין מספרי CVE לקטגוריות CWE כדי לתעדף תיקונים.

איפה זה נופל

זהו מודל בסיס ולא מודל שעבר כוונון להוראות, כך שהוא פחות מתאים לשיחה חופשית ודורש הנחיות מובנות או כוונון עדין נוסף. תאריך חיתוך המידע שלו הוא עשרה באפריל 2025, ולכן הוא עיוור לחולשות ולשיטות תקיפה חדשות יותר. הוא נוטה להתקשות בהבנת הקשר רחב ומורכב בין מערכות שונות, עלול להיכשל בזיהוי דפוסי תקיפה שטרם נראו, ולא מסוגל לאמת עצמאית עובדות או לגשת למערכות חיצוניות.

אותה משפחה

Foundation-Sec יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות כצ'אטבוט לאנליסטים?

לא מומלץ בלי התאמה מוקדמת. המודל שוחרר כמודל בסיס לטקסט ולא כוונן לשיחה או למענה ישיר לשאלות, ולכן כדאי להגדיר לו פרומפטים מדויקים או לאמן אותו תחילה על דוגמאות שיחה.

האם הוא יכול להחליף מנוע סריקת חולשות ברשת?

ממש לא. אין לו גישה למערכות חיות, הוא לא מבצע סריקות בפועל, והידע שלו מוגבל למידע שהיה זמין באינטרנט עד אפריל 2025.

איך מריצים

המשקל הכולל של הקבצים עומד על חמישה עשר ג'יגה בייט בדיוק bfloat16, כך שכדי להריץ אותו כמו שהוא צריך כרטיס מסך בודד עם עשרים וארבעה ג'יגה זיכרון גרפי, כמו RTX 3090 או כרטיס שרת מקביל. הרצה ישירה מתבצעת דרך ספריית transformers הרגילה בפייתון, והוא מתאים לשרתים פנימיים שבהם מדיניות האבטחה או החוק אוסרים על הוצאת לוגים החוצה.

אם סביבת העבודה מאפשרת שליחת נתונים החוצה, קריאה ל־API ענן של מודל ענק כללי תחסוך את עלויות החומרה והתחזוקה. עם זאת, במקרים שבהם המידע כולל תעבורת רשת רגישה, שמות שרתים או דוחות אירוע חסויים, החזקת המודל על שרת מקומי היא הדרך היחידה לעבוד.

from transformers import pipeline

pipe = pipeline("text-generation", model="fdtn-ai/Foundation-Sec-8B")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי קוד, הפצה והטמעה במוצרים פרטיים ללא תמלוגים, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗