GPT
A

Apodex-1.1-mini

קוד פתוח

apodexapache-2.02026-08-17

  • transformers
  • safetensors
  • qwen3_5_moe
  • image-text-to-text
  • agent

מודל מבוסס תערובת מומחים שמתוכנן להרצת סוכנים אוטונומיים, עם תמיכה מובנית בחלון הקשר ענק וקריאות לפונקציות שמיועדות לפתרון משימות מחקר ופיננסים מורכבות.

  • 36Bפרמטרים
  • 262,144טוקנים בהקשר
  • 67.0 GBמשקל הקבצים
  • 7,868הורדות בחודש

מה זה

מדובר במודל MoE עם 36 מיליארד פרמטרים שמבוסס על ארכיטקטורת Qwen3.5, אבל הוא לא מיועד לצ'אט רגיל. הדגש כאן הוא על תהליכי עבודה ארוכים שדורשים הפעלת כלים, כתיבת קוד ואימות עובדות מול מסמכים. הוא תומך בחלון הקשר של 262,144 טוקנים, מה שמאפשר להזין אליו כמויות גדולות של נתונים, קבצים או ספריית קוד שלמה בבת אחת.

במבחני ביצועים של עבודה מרובת שלבים, הוא מוביל במשימות פיננסיות עם ציון של 50.2 ב FrontierFinance ומגיע ל 27.7 ב APEX-Agent. המספרים האלה מראים שהוא מחזיק קו חשיבה טוב יותר ממודלים בגודל דומה כשהוא נדרש לפרק משימה לתתי משימות, להריץ כלים במקביל ולתקן את עצמו במקרה של שגיאה.

מתאים ל

  • ניתוח דוחות פיננסיים

    המודל קיבל ציונים גבוהים במיוחד בבנצ'מרק הפיננסי ויודע להצליב נתונים מתוך גיליונות וקבצים ארוכים.

  • סוכן אוטונומי להרצת קוד

    הוא כולל תמיכה מובנית בחשיבה מרובת שלבים, שימוש בכלים ותיקון שגיאות תוך כדי ריצה.

  • מחקר על מסמכים עתירי טקסט

    חלון ההקשר של 262 אלף טוקנים מאפשר להטמיע מאמרים שלמים ולבצע שאילתות מורכבות בלי לחתוך מידע.

איפה זה נופל

המודל אומן רשמית רק על אנגלית וסינית, כך שאין מה לבנות עליו לעיבוד מסמכים בעברית או לשיחה שוטפת בשפה המקומית. בנוסף, כל המבנה שלו מותאם לתבנית שיחה וקריאת כלים ספציפית של Qwen3.5. אם תשנו את תבנית הפרומפט, תוותרו על המפענחים המומלצים או תנסו להכניס הוראות כלים ישירות לתוך הפרומפט הראשי, שרשרת קריאת הפונקציות פשוט תישבר.

שאלות
נפוצות

האם המודל יפעל טוב בעברית?

החומר הרשמי מציין תמיכה באנגלית ובסינית בלבד. הוא עשוי לפלוט מילים בעברית, אבל בהיעדר אימון ייעודי הוא יתקשה מאוד במשימות חשיבה וניתוח טקסטים מקומיים.

איזו חומרה נדרשת כדי להרים אותו?

הקבצים שוקלים 67 גיגה בייט. תצטרכו שרת עם מספר מאיצים גרפיים, כשההמלצה של הצוות היא הגדרת שמונה כרטיסים לעבודה שוטפת בהקשר המלא שלו.

איך מריצים

המשקל הכולל של הקבצים עומד על 67 גיגה בייט, כך שאי אפשר להריץ אותו על מחשב ביתי ממוצע. כדי לשרת אותו דרך vLLM או SGLang בחלון ההקשר המלא שלו, המפתחים ממליצים על שמונה מאיצים גרפיים במקביל. מי שרוצה לחבר אותו ישירות לקוד צריך להגדיר מפענחי tool-call ו reasoning ייעודיים של Qwen3 כדי לחלץ את הקריאות לפונקציות בצורה תקינה.

אם אין לכם אשכול שרתים ייעודי עם מספיק זיכרון VRAM להחזקת הקבצים וההקשר הארוך, אין טעם לנסות להריץ אותו מקומית. עדיף לפנות ל API שהמפתחים מציעים בענן ולחסוך את כאב הראש של ניהול החומרה.

from transformers import pipeline

pipe = pipeline("text-generation", model="apodex/Apodex-1.1-mini")
print(pipe("שלום"))

הרישיון

המודל משוחרר תחת רישיון Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהטמיע אותו במוצרים פנימיים או חיצוניים בלי לשלם תמלוגים, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗