GPT
Q

Qwen3.5-2B-Base

קוד פתוח

Qwenapache-2.02026-02-28

  • transformers
  • safetensors
  • qwen3_5
  • image-text-to-text
  • conversational

יש כאן גם סקירה על Qwen עצמו.

מודל בסיס רב מודלי קומפקטי שמקבל טקסט ותמונות. הוא מיועד למי שרוצה לאמן מודל משלו על חומרה צנועה בלי להתחיל מאפס.

  • 2.3Bפרמטרים
  • 262,144טוקנים בהקשר
  • 4.3 GBמשקל הקבצים
  • 892,422הורדות בחודש

מה זה

מדובר במודל בסיס שמשלב ראייה ממוחשבת וטקסט מהרגע הראשון, ולא בשכבה שהודבקה אחר כך מעל מודל קיים. הארכיטקטורה שלו מערבבת שכבות של Gated DeltaNet יחד עם מנגנון קשב רגיל, פריסה שנועדה לאפשר הסקת מסקנות מהירה וחסכונית במיוחד.

הוא מאומן מראש על פני 201 שפות וניבים, ומסוגל לקלוט חלון הקשר עצום של 262,144 טוקנים כבר בהגדרה המקורית, עם אפשרות הרחבה מעבר למיליון. הוא לא מגיע מחומם לצ'אט, אבל טוקני השליטה כבר מוכנים בפנים כדי שאימון LoRA יעבוד בצורה נקייה בלי לגעת בכל משקלי ה־embeddings.

מתאים ל

  • אימון LoRA למשימות ראייה

    טוקני השליטה כבר מאומנים מראש, מה שחוסך התעסקות עם שכבת ה־embeddings העצומה.

  • ניתוח מסמכים ארוכים ותמונות

    חלון של 262,144 טוקנים בתוך מודל זעיר מתאים לעיבוד קבצים כבדים בלי להחזיק שרת יקר.

  • הטמעה במכשירי קצה

    משקל של 4.3 ג'יגה בייט מאפשר לו לרוץ בקלות על חומרה מקומית או מחשבים ניידים פשוטים.

איפה זה נופל

זה מודל בסיס, ולכן הוא לא עונה לשאלות כמו צ'אטבוט אלא רק משלים טקסט. מי שינסה לדבר איתו ישר מהקופסה יקבל המשכים לא קוהרנטיים או חזרות. בנוסף, חלון הקשר של מאות אלפי טוקנים ידרוש זיכרון וידאו עצום אם באמת תנצלו את כולו, למרות שהמודל עצמו שוקל מעט.

אותה משפחה

Qwen3.5 יצא ב־20 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן, והשאר בעמוד המפרסם.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות לצ'אט עם משתמשים?

לא. מדובר בגרסת Base בלבד ולא במודל שעבר כוונון שיחה, ולכן הוא פשוט ישלים טקסט במקום לענות. כדי לקבל צ'אטבוט תצטרכו לאמן אותו קודם באמצעות LoRA או לבחור בגרסת Instruct.

האם צריך כרטיס מסך תעשייתי כדי להריץ אותו?

ממש לא. כל המשקלים יושבים ב־4.3 ג'יגה בייט, כך שכרטיס מסך ביתי מודרני מספיק בהחלט לעבודה רגילה. הזיכרון יתחיל להיחנק רק אם תנסו לדחוף פנימה רבע מיליון טוקנים בבת אחת.

איך מריצים

המשקל הכולל של הקבצים עומד על 4.3 ג'יגה בייט, כך שאפשר לטעון ולהריץ אותו מקומית על כרטיס מסך בודד עם 8 עד 12 ג'יגה בייט זיכרון בלי מאמץ מיוחד. הוא נתמך ישירות בספריות כמו transformers, vLLM ו־SGLang.

אם אתם רק מחפשים בוט מוכן שמחזיר תשובות בשיחה, עדיף להשתמש ב־API או בגרסת Instruct. המודל הזה דורש אימון או פרומפטים מותאמים, ולכן הרצה עצמית שווה את זה רק כשאתם בונים התאמה ספציפית למשימה משלכם.

from transformers import pipeline

pipe = pipeline("image-text-to-text", model="Qwen/Qwen3.5-2B-Base")
print(pipe("שלום"))

הרישיון

הקוד והמשקלים שוחררו ברישיון apache-2.0. הרישיון מאפשר שימוש מסחרי מלא, שינוי הקוד והפצה מחדש במוצרים סגורים, כל עוד שומרים על תנאי הקרדיט וההודעה המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗