GPT
Q

Qwen3-VL-30B-A3B-Thinking-GGUF

קוד פתוח

unslothapache-2.02025-10-30

  • gguf
  • unsloth
  • qwen
  • qwen3_vl_moe
  • image-text-to-text

זה מודל ראייה ושפה שמשלב יכולת חשיבה והסקה עמוקה מול תמונות ווידאו. מקבלים כאן גרסת קוונטיזציה של Unsloth שמתאימה למי שרוצה להריץ מקומית בלי לאבד את שכבת הניתוח המורכבת.

  • 476 GBמשקל הקבצים
  • 26,883הורדות בחודש
  • 43לייקים

מה זה

הגרסה הזו מתבססת על שילוב של מודל מרובה מומחים עם שלושים מיליארד פרמטרים שרק חלקם פעיל, יחד עם מצב חשיבה ייעודי. הוא מעבד תמונות, קטעי וידאו ארוכים וטקסט, ומחזיר שרשרת הסקה לוגית מפורטת בנושאי מדע, מתמטיקה וקוד ויזואלי.

המודל מטפל בצירי זמן של וידאו ברמת השנייה הבודדת, מזהה ממשקי משתמש של מחשב ונייד כדי להפעיל כלים, ותומך בחלון הקשר של 256 אלף טוקנים שניתן להרחבה עד מיליון. המבנה הארכיטקטוני שלו כולל מיפוי מיקום רב ממדי לתמונה וזמן, לצד מנגנון שמחבר כמה שכבות ראייה כדי לקלוט פרטים קטנים.

בנוסף לניתוח ויזואלי, הוא מכיל יכולות זיהוי טקסט מתמונה בשלושים ושתיים שפות, ומתמודד עם תנאי צילום קשים כמו טשטוש או זווית עקומה. המטרה כאן היא לתת ביצועי טקסט ברמה של מודל שפה טהור יחד עם תפיסה מרחבית דו ממדית ותלת ממדית.

מתאים ל

  • אוטומציה של ממשקי משתמש

    זיהוי אלמנטים במסכי מחשב ונייד, הבנת התפקיד שלהם והפעלת כלים לפי צילומי מסך.

  • תחקור מסמכים וטקסט סרוק

    חילוץ וניתוח מבנה ממסמכים מצולמים, כולל טקסט מטושטש או בזוויות צילום בעייתיות.

  • פתרון בעיות טכניות מתמונה

    הסקה לוגית ומתמטית מול תרשימים, משוואות וקוד ויזואלי דרך מנגנון החשיבה המובנה.

איפה זה נופל

הכרטיס מדגיש יכולות גבוהות אך מציג תמונות בלבד של טבלאות המבחנים בלי לפרט את המספרים בטקסט עצמו. דגמי חשיבה נוטים להאריך בתשובות ולהוסיף שלבי הסקה פנימיים, מה שמייצר זמני תגובה ארוכים בהרבה ממודלי שיחה רגילים. בנוסף, אף שהוכרזה תמיכה בשלושים ושתיים שפות לזיהוי טקסט, לא מצוין אילו שפות נתמכות בדיוק ואיך איכות התוצאה בעברית מורכבת.

אותה משפחה

Qwen3-VL יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם צריך להוריד את כל 476 הגיגה בייט כדי להריץ את המודל?

לא. המאגר כולל עשרות קבצים שמייצגים רמות כיווץ שונות של אותו מודל. בוחרים את קובץ ה־GGUF שמתאים לגודל הזיכרון של כרטיס המסך שלכם ומורידים רק אותו.

מה שונה בגרסת Thinking לעומת גרסת שיחה רגילה?

המודל מייצר שלבי מחשבה והסקה פנימיים לפני שהוא עונה. זה נותן פתרונות מדויקים יותר בבעיות היגיון, מתמטיקה ותכנות מתוך תמונות, אבל זמן הפלט הכולל ארוך יותר.

איך מריצים

הריפו כולל קובצי GGUF בנפח כולל של 476 גיגה בייט שמחולקים לפורמטים שונים של Unsloth Dynamic. מורידים רק את הקובץ או הקבצים של רמת הקוונטיזציה הרצויה, ולא את כל המאגר.

כדי להריץ אותו מקומית צריך זיכרון וידאו שמחזיק לפחות את המשקל המכווץ הנבחר יחד עם זיכרון להקשר, כאשר לגרסאות הקלות מספיק כרטיס חזק אחד ולגרסאות המלאות יותר נדרש מערך כרטיסים. אם אין לכם חומרה כזו זמינה, קריאה לשרת מרוחק עדיפה בהרבה על ניסיון דחיפה לכרטיס צר מדי.

ollama run hf.co/unsloth/Qwen3-VL-30B-A3B-Thinking-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

34 קבצים במאגר, 476 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש במודל לצרכים מסחריים ופרטיים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗