GPT
O

OmniCoder-Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF

קוד פתוח

Ngixdevapache-2.02026-03-26

  • gguf
  • qwen3_5
  • unsloth
  • qwen
  • qwen3.5

מיזוג לא מצונזר של שלושה מודלים מבוססי קוון בנפח 9 מיליארד פרמטרים. המטרה כאן היא לקבל ניתוח קוד וחשיבה לוגית בלי סירובים ותוך קיצור שרשרת המחשבה.

  • 262,144טוקנים בהקשר
  • 6.1 GBמשקל הקבצים
  • 6,905הורדות בחודש
  • 45לייקים

מה זה

מדובר בשעטנז שנוצר ממיזוג של שלושה מודלים שונים על בסיס קוון בגרסת 9 מיליארד פרמטרים. היוצר שילב מודל לא מצונזר של HauhauCS, מודל של Jackrong שעבר זיכוך חשיבה מדאטהסטים שמחקים את קלוד, ואת OmniCoder של Tesslate. רק המשקלים שעברו אימון מדויק בעזרת Unsloth שונו במהלך המיזוג ברמת דיוק של float32.

הייחוד בגרסה הזו מתמקד בניסיון לייעל את שרשרת המחשבה. לפי המדידות בכרטיס המודל, אורך המחשבה הפנימית התקצר ביותר מעשרים אחוזים ביחס למודל הבסיס. במבחני קוד של HumanEval וגרסת הבדיקות המחמירה HumanEval פלוס, המודל הציג שיפור בדיוק לצד פחות תווים של חשיבה מבוזבזת, מה שמתרגם למהירות תגובה גבוהה יותר במשימות פיתוח.

מתאים ל

  • פתרון בעיות קוד מקומי

    מריץ חשיבה קצרה יותר ומציג ציונים טובים במבחני קידוד בלי לצרוך זיכרון של מודלי ענק.

  • ניתוח לוגי ללא חסימות

    מתאים לתרחישים שבהם מודלים מסחריים מסרבים לעבד טקסטים מורכבים או נתונים רגישים.

  • סוכנים אוטונומיים קלים

    צמצום שלבי החשיבה המיותרים מקצר את זמני הריצה בלולאות של כלי עבודה אוטומטיים.

איפה זה נופל

המודל מבוסס על מיזוג קהילתי ולא על הכשרה מסודרת אחת, ולכן יש סיכון להזיות בפרטים עובדתיים במהלך שרשרת המחשבה. בנוסף, המפתח מודה במפורש שההתמקדות בזיכוך דאטהסט של 14 אלף דוגמאות פגעה ביכולות כלליות רחבות של המודל. היות שמדובר במודל לא מצונזר לחלוטין ללא מנגנוני סירוב, הוא לא מתאים להטמעה ישירה מול לקוחות קצה בלי שכבת סינון ובקרה חיצונית.

שאלות
נפוצות

האם המודל תומך בעברית לפי נתוני היצרן?

השפות המדווחות רשמית במפרט הן אנגלית, סינית וקוריאנית בלבד. המודל עשוי להבין עברית בסיסית בגלל בסיס האימון המקורי של קוון, אך הוא לא אומן או נבדק לשפה הזו ולא כדאי לבנות עליו לפרויקטים בעברית.

האם חובה להשתמש בפרומפט המערכת הספציפי?

לפי כרטיס המודל, מומלץ מאוד לפתוח את הנחיית המערכת בהצהרה שהמודל הוא קוון של עליבאבא. היוצר ציין כי ללא שורה זו המודל מציג ביצועים נמוכים יותר.

איך מריצים

הקבצים שוקלים 6.1 גיגה בייט בפורמט GGUF, מה שאומר שאפשר להריץ אותו מקומית על כרטיס מסך ביתי עם 8 עד 12 גיגה בייט זיכרון גרפי, או ישירות בזיכרון של מחשבי מק. היוצר ממליץ על הרצה בתוכנת LM Studio עם ערכי טמפרטורה 0.7, טופ קיי 20, טופ פי 0.8 ועונש נוכחות של 1.5.

קריאה לשרת ענן חיצוני תתאים אם אתם צריכים שירות יציב שרץ בלי תלות במחשב שלכם, במיוחד כשרוצים לנצל הקשרים ארוכים שמעמיסים על הזיכרון המקומי. שימו לב שהיוצר מציין במפורש שהמודל מתפקד פחות טוב אם לא מגדירים בהנחיית המערכת את המשפט שמצהיר שהוא קוון שפותח על ידי עליבאבא.

ollama run hf.co/Ngixdev/OmniCoder-Qwen3.5-9B-Claude-4.6-Opus-Uncensored-v2-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המדווח הוא אפאצ׳י 2.0 שמתיר שימוש מסחרי חופשי, שינוי קוד והפצה, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. עם זאת, היוצר מציין בטקסט שמדובר בגרסת בדיקה לצורכי מחקר ולמידה בלבד, כך שיש סתירה מסוימת בין הצהרת הרישיון לבין הייעוד המוצהר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗