GPT
C

command-a-plus-05-2026-bf16

קוד פתוח

CohereLabsapache-2.02026-05-11

  • transformers
  • safetensors
  • cohere2_vision
  • image-text-to-text
  • conversational

מודל ענק בקוד פתוח שמשלב ראייה ממוחשבת, הפעלת כלים והסקה לוגית. הוא מפעיל רק חלק קטן מהמשקולות בכל טוקן, ומיועד למערכות ארגוניות מורכבות.

  • 219Bפרמטרים
  • 200,000טוקנים בהקשר
  • 407 GBמשקל הקבצים
  • 31,456הורדות בחודש

מה זה

מדובר במודל מסוג תערובת מומחים דלילה עם מאתיים ותשעה עשר מיליארד פרמטרים בסך הכול, כאשר בפועל פעילים עשרים וחמישה מיליארד בכל שלב. הוא כולל מאה עשרים ושמונה מומחים, שמתוכם שמונה נבחרים לכל טוקן לצד מומחה אחד משותף. המבנה הזה נועד לאפשר איכות תגובה של מודל ענק בלי לשלם את מלוא מחיר החישוב בזמן אמת, בשילוב תמיכה בקלט משולב של טקסט ותמונות ויצירת פלט טקסטואלי בלבד.

הייחוד כאן מגיע מההתמקדות בעבודה סוכנותית וקישור לכלים חיצוניים. הוא תומך בהפעלת פונקציות מובנית לפי תבניות ג'ייסון, מציג את שלבי החשיבה בתגיות ייעודיות, ומסוגל להחזיר ציטוטים מדויקים שמקשרים כל פיסת מידע למקור שממנו נשלפה במאגר או ב־API. המודל אומן על ארבעים ושמונה שפות, כולל עברית וערבית, ומטפל בהקשר נרחב של עד מאה עשרים ושמונה אלף טוקנים לקלט ושישים וארבעה אלף לפלט.

מתאים ל

  • סוכן חכם עם קריאות API

    הוא מתוכנן מראש לחברות שצריכות הפעלת פונקציות חיצוניות, תוך ציטוט מקורות מדויק לתשובות עסקיות.

  • ניתוח מסמכים רב לשוני

    שילוב יכולות ראייה, הקשר ארוך ותמיכה בארבעים ושמונה שפות כולל עברית וערבית מתאים לעיבוד דוחות מורכבים.

  • הסקה לוגית בשרת פנימי

    הוא מפרט את שלבי המחשבה לפני המענה ומתאים למשימות ניתוח מעמיקות ברשתות מאובטחות.

איפה זה נופל

גודל הקבצים הופך את גרסת המשקל המלא לחסרת הגיון כלכלי עבור רוב הפרויקטים, במיוחד כשיש גרסאות מכווצות שלא מאבדות איכות ניכרת. בנוסף, חלון ההקשר מוגבל למאה עשרים ושמונה אלף טוקנים בקלט, וההפעלת תכונות כמו ציטוטים ועיבוד תגובות מחייבת ספריות חיצוניות ספציפיות כמו melody והגדרות מדויקות, כך ששילוב במערכת קיימת דורש בדיקה מקיפה של תאימות.

אותה משפחה

command-a-plus-05-2026 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם כדאי להוריד דווקא את גרסת ה־BF16?

ברוב המקרים לא. הקבצים שוקלים מעל ארבע מאות גיגה בייט ומחייבים לפחות שמונה מעבדי H100 רק בשביל לעלות לאוויר. היוצרים ממליצים להשתמש בגרסת ה־W4A4 שמציגה אותה רמת ביצועים בחצי מכמות החומרה.

האם המודל יודע לקרוא עברית?

כן, עברית מופיעה ברשימת ארבעים ושמונה השפות שהמודל אומן עליהן. מאחר שהוא כולל גם יכולות תמונה וגם חלון הקשר רחב, הוא מסוגל לקרוא מסמכים וטקסטים ארוכים בעברית ולשלב אותם בניתוח.

איך מריצים

משקלי ה־BF16 שוקלים ארבע מאות ושבעה גיגה בייט, וזה דורש מערך חומרה עצום של שמונה כרטיסי H100 או ארבעה כרטיסי B200 כדי לטעון אותם לזיכרון. המפרסמים עצמם ממליצים במפורש להשתמש בגרסת W4A4 במקום הגרסה הזו, ומציינים שההבדל במבחני הביצועים זניח בעוד שדרישות החומרה נחתכות בחצי או ברבע ומאפשרות ריצה על שרת קטן בהרבה.

אפשר להריץ אותו דרך ספריית הטרנספורמרס ישירות מהקוד, או להרים שרת באמצעות vLLM מגרסה עשרים ואחת ומעלה יחד עם ספריית melody של החברה. אלא אם כן אתם מחזיקים אשכול שרתים ייעודי ומחויבים לפרטיות מלאה שמונעת יציאת מידע, החזקת תשתית מקומית לקבצים האלה יקרה ומסורבלת מאוד ביחס לצריכת המודל דרך נקודת קצה מנוהלת.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="CohereLabs/command-a-plus-05-2026-bf16")
print(pipe("שלום"))

הרישיון

המודל משוחרר תחת רישיון אפאצ'י שתיים, שמתיר שימוש מסחרי חופשי, שינוי של המשקולות והפצה שלהן בתוך מוצרים. אין כאן הגבלות על היקף ההכנסות או חובת פתיחת קוד של המערכת שעוטפת אותו, כל עוד שומרים על הודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗