GPT
H

Holo-3.1-35B-A3B

קוד פתוח

Hcompanyapache-2.02026-05-29

  • transformers
  • safetensors
  • qwen3_5_moe
  • image-text-to-text
  • multimodal

מודל ראייה ושפה שמיועד להפעלת מחשב, דפדפן ומובייל באופן עצמאי. הוא מביא יכולות סוכן ואוטומציה של ממשקים עם תמיכה מובנית בקריאת פונקציות.

  • 35Bפרמטרים
  • 262,144טוקנים בהקשר
  • 65.4 GBמשקל הקבצים
  • 1,391הורדות בחודש

מה זה

במקום מודל שיחה כללי, כאן מדובר במודל ראייה ושפה שנבנה סביב משימה אחת מוגדרת: הבנה ותפעול של ממשקי משתמש. הוא מתבסס על ארכיטקטורת תערובת מומחים של Qwen 3.5 עם 35 מיליארד פרמטרים, ומציע הקשר עצום של מעל מאתיים ושישים אלף טוקנים. זה אומר שהוא מסוגל להחזיק רצף ארוך מאוד של צילומי מסך, היסטוריית פעולות ופקודות בלי לאבד את הידיים והרגליים באמצע תהליך עבודה מורכב.

הייחוד שלו מול מודלים אחרים במשקל הזה הוא התמיכה המובנית בקריאת פונקציות והרחבת האוטומציה מעבר לדפדפן ולשולחן העבודה גם למכשירי מובייל. המפתחים מכוונים אותו לביצועים חזקים במיוחד בזיהוי אלמנטים על המסך, תרגום הוראות לפעולות לחיצה והקלדה, וניהול תהליכים עסקיים שלמים בלי להסתמך על שירותי ענן חיצוניים.

מתאים ל

  • אוטומציית בדיקות ממשק

    ניווט אוטונומי באפליקציות ווב ומובייל לצורך בדיקות קצה לקצה דרך צילומי מסך.

  • ביצוע תהליכים בארגון

    מילוי טפסים והעברת נתונים בין תוכנות ישנות ללא צורך בממשקי API ייעודיים.

  • סוכן תפעול מקומי ומאובטח

    הפעלת מחשב ודפדפן על גבי חומרה פנימית בלי להוציא צילומי מסך רגישים לרשת.

איפה זה נופל

המודל אומן ותועד באנגלית בלבד. אם הממשקים שלכם כוללים כפתורים בעברית, טפסים מימין לשמאל או שמות שדות מקומיים, סביר מאוד שהוא יתקשה לזהות אלמנטים או יטעה בפענוח הטקסט שמופיע עליהם. בנוסף, אף שהמפתחים מדברים על ביצועים גבוהים, כרטיס המודל לא חושף את המספרים המדויקים מתוך טבלאות המבחנים, מה שמחייב אתכם לבדוק בעצמכם את אחוזי ההצלחה במשימות מורכבות לפני שמפקידים בידיו פעולות רגישות במערכות אמיתיות.

אותה משפחה

Holo-3.1 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל יסתדר עם מערכות בעברית?

התיעוד מגדיר תמיכה באנגלית בלבד. הוא עשוי לזהות מבנה כללי של חלונות, אבל בממשקים עם כפתורים, תפריטים או טקסט בעברית צפויות שגיאות זיהוי והקלדה. עדיף להגביל אותו למערכות שהממשק שלהן באנגלית.

מה המשמעות של ארכיטקטורת המומחים עבור ההרצה?

למרות שיש לו 35 מיליארד פרמטרים על הנייר, רק חלק מהם מופעל בכל צעד של חישוב. זה מקצר את זמני התגובה ומפחית את עומס החישוב, אבל עדיין תצטרכו מספיק זיכרון וידאו כדי לאחסן את כל המשקולות שלו ברקע.

האם חייבים כרטיס מסך מפלצתי בשביל לעבוד איתו?

לא חובה להתחיל משרת יקר. הודות לקובצי Q4 GGUF ופורמטים מכווצים של NVFP4 ו־FP8, אפשר לחתוך את נפח הזיכרון הנדרש ולהריץ אותו גם על תחנות עבודה חזקות או שרתים קטנים בהרבה.

איך מריצים

המשקל המלא עומד על 65.4 ג'יגה בייט בפורמט BF16, כך שתצטרכו שרת עם כרטיסי A100 או H100 כדי להעלות אותו בלי כיווץ. המודל זמין גם בגרסאות מכווצות כמו FP8, NVFP4 וקובצי Q4 GGUF, מה שמאפשר לדחוף אותו לחומרה צנועה יותר או להרצה מקומית על כרטיסי מסך בודדים עם זיכרון וידאו מוגבל.

אם כל מה שאתם צריכים זה ניסוי קצר או אוטומציה פשוטה שרצה פעם ביום, החזקה של חומרה כזו עולה יותר מדי ולא מצדיקה את המאמץ. הקמה עצמית שווה את זה רק כשאתם חייבים שליטה מוחלטת בפרטיות של צילומי המסך, או כשהיקף הפעולות של הסוכן כבד מספיק כדי להפוך קריאות API לחשבון חודשי מנופח.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="Hcompany/Holo-3.1-35B-A3B")
print(pipe("שלום"))

הרישיון

הוא מופץ תחת רישיון Apache 2.0 מלא. זה אומר שמותר להשתמש בו לצרכים מסחריים, לשנות אותו, להטמיע אותו במוצר שלכם או להריץ אותו מאחורי שירות סגור, בלי לשלם תמלוגים. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקוד או בהפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗