GPT
Q

Qwopus3.6-27B-v2-GGUF

קוד פתוח

Jackrongapache-2.02026-05-16

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסה מכווננת של מודל עשרים ושבעה מיליארד פרמטרים שמתמקדת בהסקה לוגית יעילה. הוא פותר שאלות בפחות מלל ומציע שילוב תמונה וטקסט להרצה עצמאית.

  • 93.8 GBמשקל הקבצים
  • 1,659הורדות בחודש
  • 251לייקים

מה זה

מדובר בכיוונון של מודל הבסיס מבית עליבאבא שנעשה באמצעות חילוץ שרשראות חשיבה מפורטות מנתוני מודלים מסחריים. במקום להסתמך על תקצירי חשיבה דחוסים שלעתים קוטעים את הרצף הלוגי, תהליך האימון שיחזר צעדי הסקה מלאים בעזרת מערכי נתונים ייעודיים כדי למנוע דילוגים שגויים במסקנות.

בבדיקה על שלוש מאות וחמישים שאלות בסגנון מדד הידע הכללי, התוצאות מראות שיפור מובהק ביעילות הייצור. בתשובות נכונות הוא צורך תשע מאות ושמונה עשרה נקודה שבעה טוקנים בממוצע, ירידה של כמעט שלושים ושש אחוזים לעומת מודל המקור. בנוסף, גרסת חיזוי הטוקנים המרובה מגיעה למהירות גבוהה פי אחד נקודה שישים ושש.

מתאים ל

  • פתרון בעיות לוגיות

    הוא מפיק נימוקים מלאים תוך חיסכון של עשרות אחוזים בכמות המילים בדרך לתשובה.

  • ניתוח מסמכים חזותיים

    הוספת קובץ המקרן הנלווה מאפשרת לשלב עיבוד תמונה יחד עם הבנת טקסט באותה ריצה.

  • אימון משך בלמידת חיזוק

    תגיות החשיבה שלו עוצבו במבנה אחיד שמתאים לסבבי שיפור והסקה מבוקרי פורמט.

איפה זה נופל

היוצר מציין במפורש שמדובר בגרסה ניסיונית של הקהילה שלא עברה בדיקות בטיחות מלאות או מבחני ביצועים תקניים. אם המוצר שלכם פונה למשתמשי קצה, אתם לוקחים סיכון של תגובות בלתי צפויות או חוסר יציבות. מעבר לכך, התמיכה בשפה העברית לא נכללת ברשימת השפות המדווחות שנבדקו, שכוללת רק אנגלית, סינית, ספרדית, רוסית ויפנית, ולכן חובה לבדוק איכות פלט באופן עצמאי.

אותה משפחה

Qwopus3.6 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איך מפעילים את יכולות התמונה במודל הזה?

צריך להוריד ידנית את קובץ ההקרנה החזותית מדף המשקלים ולשמור אותו באותה התיקייה עם קובץ המודל הראשי. ללא הקובץ הזה, הטעינה תתבצע במצב טקסטואלי בלבד.

האם כדאי להטמיע אותו במערכת ייצור ארגונית?

לא מומלץ לעשות זאת ישירות. היות והיוצר מצהיר שלא נעשו מבדקי בטיחות מסודרים, כדאי להגביל את השימוש למחקר או להוסיף מנגנוני סינון ובדיקה קפדניים.

איך מריצים

המשקל הכולל של הקבצים מגיע לתשעים ושלושה נקודה שמונה גיגה בייט המחולקים לשמונה חלקים. כדי להריץ משקל כזה בפורמט הנוכחי תצטרכו שרת עם זיכרון גרפי נרחב מאוד או שילוב של זיכרון מערכת מהיר עם חלוקת שכבות. אם אתם צריכים תמיכה בניתוח תמונות, חובה להוריד בנפרד את קובץ המקרן הגרפי ולהניח אותו באותה התיקייה.

אם אין לכם תחנת עבודה חזקה או שרת ייעודי, עדיף לפנות לממשקי ענן שמגישים מודלים דומים. תצורת ההרצה המקומית הגיונית רק אם אתם חייבים פרטיות מלאה של המידע או עובדים בסביבה מנותקת רשת.

ollama run hf.co/Jackrong/Qwopus3.6-27B-v2-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא אפאצ׳י שתיים נקודה אפס. זהו רישיון קוד פתוח מתירני שמאפשר להשתמש בקוד ובמשקלים גם לצרכים מסחריים, לשנות אותם ולהפיץ אותם בתוך תוכנה סגורה, בתנאי ששומרים על הודעות זכויות היוצרים וההסתייגות מאחריות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗