GPT
Q

Qwen3.5-9B-Base

קוד פתוח

Qwenapache-2.02026-02-26

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • conversational

יש כאן גם סקירה על Qwen עצמו.

מודל בסיס מולטימודלי של 9.7 מיליארד פרמטרים שמחבר ראייה וטקסט. הוא מיועד למי שרוצה בסיס לאימון או כוונון עדין עם חלון הקשר ענק.

  • 9.7Bפרמטרים
  • 262,144טוקנים בהקשר
  • 18.0 GBמשקל הקבצים
  • 407,993הורדות בחודש

מה זה

מדובר במודל בסיס שמקבל תמונה וטקסט ופולט טקסט, ולא במודל שיחה מוכן לשימוש יומיומי. המבנה הפנימי שלו משלב שכבות מסוג Gated DeltaNet יחד עם מנגנון קשב, במטרה לספק היסק מהיר עם השהיה נמוכה. הוא מגיע עם תמיכה מובנית ב־201 שפות ודיאלקטים, שכוללת גם מילון מורחב של מעל 248 אלף טוקנים.

ההבדל העיקרי מול מודלים קודמים במשקל הזה הוא שילוב מוקדם של טוקנים חזותיים וטקסטואליים כבר משלב האימון המקדים. החומר מצהיר על ביצועים טובים יותר ממודלי ראייה קודמים בסדרה במשימות חשיבה, כתיבת קוד והבנת תמונה. חלון ההקשר עומד על 262,144 טוקנים באופן טבעי, עם יכולת הרחבה עד 1,010,000 טוקנים.

מתאים ל

  • אימון והתאמה אישית

    טוקני הבקרה המובנים בו מאפשרים לבצע כוונון מסוג LoRA בלי לאמן מחדש את שכבת ההטמעות הגדולה.

  • ניתוח מסמכים ארוכים

    חלון טבעי של 262,144 טוקנים מאפשר להזין יחד כרכים גדולים של טקסט משולב בתמונות.

  • מחקר על סוכנים חזותיים

    הארכיטקטורה משלבת ראייה וטקסט יחד ומיועדת לעבודה בסביבות מרובות סוכנים.

איפה זה נופל

זהו מודל בסיס שעבר רק אימון מקדים ואינו מיועד לאינטראקציה ישירה או לצ'אט בלי מעטפת מתאימה. הוא לא עבר התאמה של מענה להוראות, ולכן פנייה אליו כאל עוזר תוביל להשלמת טקסט עיוורת ולא לתשובות מסודרות. מעבר לכך, ניצול חלון ההקשר המלא של מאות אלפי טוקנים ידרוש משאבי זיכרון כבדים מאוד.

אותה משפחה

Qwen3.5 יצא ב־20 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות כבוט שיחה?

לא. זהו מודל בסיס ללא כוונון שיחה, והוא מיועד להשלמת טקסט, אימון או ניסויים. לשיחה ישירה צריך מודל שעבר התאמה ייעודית להוראות.

מה המשמעות של טוקני הבקרה שקיימים במודל הבסיס?

הטוקנים נועדו לאפשר כוונון עדין יעיל בשיטות כמו LoRA לפי תבנית השיחה הרשמית. זה מונע את הצורך לאמן את כל טבלת ההטמעות, שהיא גדולה במיוחד במודל הזה.

איך מריצים

המשקל הכולל של הקבצים עומד על 18.0 גיגהבייט והם מגיעים בתבנית של ספריית transformers. כדי לטעון אותו ולהריץ היסק דרוש כרטיס גרפי עם זיכרון ייעודי שמסוגל להחזיק את כל המשקלים האלה בזיכרון, מעבר למקום שדורש הניהול של ההקשר הארוך. המודל נתמך גם בכלים כמו vLLM ו־SGLang שמתאימים לשרתי היסק.

אם אתם לא מתכננים לאמן אותו בעצמכם או לבצע כוונון על דאטה ייעודי, אין סיבה טכנית להריץ דווקא את גרסת הבסיס הזו מקומית. עבור צ'אט או שימוש ישיר בתמונות, עדיף להשתמש בגרסת שיחה מכווננת או לגשת אליה דרך ממשק קיים.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="Qwen/Qwen3.5-9B-Base")
print(pipe("שלום"))

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי, כולל שימוש מסחרי מלא, שינוי של הקוד והמשקלים והפצה שלהם בתוך מוצרים. התנאי המרכזי הוא שמירה על הודעת זכויות היוצרים וציון הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗