GPT
Q

Qwopus3.6-27B-v1-preview-GGUF

קוד פתוח

Jackrongapache-2.02026-04-23

  • transformers
  • gguf
  • llama.cpp
  • image-text-to-text
  • vision

גרסת ניסוי של 27B שמבוססת על Qwen3.6 ומכוונת להסקה יציבה יותר בלי לברוח לסגנונות משונים בתשובות ארוכות. היא מתאימה למי שרוצה הרצה מקומית בלי ליווי ענן.

  • 81.4 GBמשקל הקבצים
  • 318,932הורדות בחודש
  • 125לייקים

מה זה

מדובר בכיוונון עדין מונחה על בסיס Qwen3.6-27B, שנעשה בעזרת Unsloth על מאגר של כ־12 אלף דוגמאות הסקה שזוקקו ממקורות שונים כמו Claude, GLM, Kimi ו־Qwen. הרעיון כאן הוא ליישר את אופן החשיבה של המודל, כדי שתקבלו מבנה תשובה עקבי ופחות סטיות סגנוניות כשהתשובה מתארכת.

דף המודל מציג הערכה ראשונית של 16 פרומפטים בלבד שנבדקו מול מודל הבסיס על תחנת עבודה בודדת עם RTX 5090. הבדיקה נגעה בסוכני הסקה, קוד פרונטאנד ומשימות קנבס או WebGL, אך מדובר במדגם זעיר שמעיד על כיוון ראשוני ולא על שיפור מוכח ברמת הפקה רחבה.

מתאים ל

  • פיתוח ממשקי WebGL

    האימון והבדיקות הראשוניות התמקדו בקוד פרונטאנד מורכב ובקנבס גרפי.

  • הסקה מקומית במערכות סוכן

    הוא נועד לשמור על רצף מחשבתי מובנה בתהליכים רב־שלביים בלי תלות ברשת.

  • בדיקת זיקוק נתונים

    מתאים למחקר של שילוב דאטהסטים מספקים שונים על גבי בסיס 27B.

איפה זה נופל

זהו צ'קפוינט מוקדם מאוד שמוגדר במפורש כתצוגה מקדימה, בזמן שאימון מלא ורחב יותר עדיין מתבצע. ההערכה שפורסמה כוללת רק 16 דוגמאות, כך שאין שום ודאות לגבי היכולת שלו להתמודד עם מקרים מורכבים. בנוסף, רשימת השפות כוללת אנגלית, סינית, יפנית, קוריאנית, ספרדית ורוסית בלבד, ולכן לא הייתי בונה עליו למשימות בעברית.

אותה משפחה

Qwopus3.6 יצא ב־6 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם המודל מוכן להטמעה בסביבת ייצור?

לא. מדובר בגרסת preview ראשונית שאומנה על 12 אלף דוגמאות בלבד, והמפתחים עצמם מציינים שאימון מלא עדיין בעבודה. עדיף להמתין לגרסה יציבה יותר לפני שבונים עליו מוצר.

האם הוא יעבוד טוב בעברית?

הכרטיס מפרט שפות נתמכות ספציפיות ועברית אינה מופיעה ביניהן. הוא מסוגל לקרוא אותיות עבריות מכוח מודל הבסיס, אך הביצועים וההבנה הלשונית לא יהיו ברמה הנדרשת לעבודה שוטפת.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־81.4 גיגה־בייט בפורמט GGUF, כך שאתם צריכים מחשב ייעודי כדי להתעסק איתו. ההרצה נעשית דרך llama.cpp, vLLM או ספריות דומות, וכדי להריץ אותו בנוחות בלי קוונטיזציה כבדה תצטרכו כרטיס חזק כמו RTX 5090 או מערך זיכרון גרפי נדיב במיוחד.

אם אין לכם תחנת עבודה ייעודית עם מספיק VRAM פנוי, עדיף להשתמש ב־API של מודל הבסיס או בשרת ענן שכור. אין טעם להילחם עם קבצים בגודל כזה במחשב פיתוח רגיל רק כדי לבדוק גרסת תצוגה מקדימה.

ollama run hf.co/Jackrong/Qwopus3.6-27B-v1-preview-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא Apache 2.0. הרישיון הזה מתיר שימוש מסחרי, שינוי של המשקלים והפצה חופשית שלהם, כל עוד שומרים על הודעות זכויות היוצרים ומצרפים עותק של תנאי הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗