GPT
T

Tiel-Coder-35B-A3B-GGUF

קוד פתוח

peculiar-ragdollmit2026-08-19

  • gguf
  • llama.cpp
  • qwen35moe
  • moe
  • imatrix

גרסת GGUF שעברה כיול מיוחד לכתיבת קוד ומנהלת שיחות ארוכות ביעילות. היא מיועדת למי שרוצה ביצועי תיקון באגים גבוהים בלי לצרוך משאבי עתק של מודלים צפופים.

  • 189 GBמשקל הקבצים
  • 282,068הורדות בחודש
  • 249לייקים

מה זה

המודל מבוסס על Ornith-1.5 בארכיטקטורת תערובת מומחים עם 256 מומחים שמפעילה 8 בכל טוקן. היוצרים שלו יצרו מטריצת חשיבות ייעודית שרובה קוד, והכניסו תבנית שיחה שמקצרת תשובות וממוקדת במשימות פיתוח. הוא כולל מקרן ראייה נפרד שמסוגל לקרוא צילומי מסך של שגיאות ובדיקות שנכשלו.

במדד SWE-bench-Live הוא פתר 12 מתוך 25 בעיות, תוצאה שמשתווה לגרסת המדיום של Opus 4.6 ועוקפת את מודל הבסיס שלו בארבע פתרונות. בזמני הריצה הוא רשם חציון של 8.6 דקות לניסיון, עם זמנים יציבים בלי זנב ארוך של משימות שנתקעות. במבחני שיחה מרובת שלבים הוא קיבל ציון של 67.2, בעיקר בזכות תשובות ישירות יותר.

מתאים ל

  • סוכן לתיקון באגים

    פותר בעיות קוד מורכבות ומחזיק חלון הקשר ארוך ביציבות.

  • ניתוח ויזואלי של תקלות

    מקבל צילום מסך של לוג או דוח בדיקות ומציע פתרון מיידי.

  • עבודה מקומית על 24GB

    רץ ברמת 4 ביט על כרטיס בודד בלי לחנוק את זיכרון ההקשר.

איפה זה נופל

המחיר של תבנית השיחה המהירה הוא ירידה בידע כללי. במבחן MMLU-Pro הוא קיבל 73.7 בלבד, יותר מעשר נקודות מתחת למודל מקביל מאותה משפחה, כך שהוא לא מתאים לשאלות ידע או למבחנים עיוניים. הוא גם נוטה לפעול מיד ולא שואל שאלות הבהרה על בקשות עמומות, מה שעלול לייצר קוד לא נכון אם לא הגדרתם את המשימה במדויק. בנוסף, הוא תומך רק באנגלית ובסינית, כך שאי אפשר לבנות עליו לפיתוח בשפה העברית.

שאלות
נפוצות

איזו גרסת קובץ כדאי להוריד למחשב עם 24 גיגה זיכרון?

הגרסה המאוזנת ביותר היא Q4_K_XL שנבדקה במבחנים, אבל היא יושבת על הקצה של כרטיסי 24 גיגה. אם אתם צריכים חלון הקשר רחב במיוחד, קחו את IQ4_XS שמשאירה יותר מקום פנוי בזיכרון בלי לפגוע באיכות הקידוד.

האם אפשר לשלוח אליו צילומי מסך של שגיאות?

כן. המודל משתמש במקרן ראייה נפרד מקובץ mmproj-BF16 ששוקל 903 מגה. מורידים את הקובץ בנוסף לקובץ המשקלים הראשי, ומעבירים אותו לפקודת ההרצה כדי לנתח תמונות לצד טקסט.

למה המודל הזה לא כולל את מנגנון הניבוי המרובה?

בגרסה המקורית השכבה הזו לא אומנה כראוי והוסיפה משקל מיותר לקובץ. היוצרים בחרו להשמיט אותה כאן כדי לחסוך קרוב לגיגה בזיכרון, ואם מערכת ההרצה שלכם תומכת בפיצ'ר הזה יש להם מאגר נפרד עבורו.

איך מריצים

הקבצים נעים מגרסת שתי ביט במשקל 12.3 גיגה ועד שמונה ביט במשקל 38.5 גיגה. נקודת הפתיחה המומלצת היא גרסת Q4_K_XL שתופסת 22.4 גיגה. בגלל מבנה המומחים, שמירת ההקשר בזיכרון קטנה יחסית ולוקחת פחות מחמישה גיגה גם בהקשר מלא, כך שכרטיס של 24 גיגה או שילוב זיכרון מערכת וכרטיס מסך של 32 גיגה יריצו אותו בנוחות עם שרת llama-server.

אם אין לכם לפחות 16 גיגה של זיכרון משולב פנוי, או שאתם לא צריכים שילוב תמונות בתוך משימות קוד מקומיות, עדיף להשתמש ב־API חיצוני של מודל ענן ולא לנסות לדחוס את גרסת שתי הביט שעובדת רע בסוכני קוד.

ollama run hf.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF:Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מופץ תחת רישיון MIT, בדיוק כמו מודל הבסיס שלו. הרישיון מתיר שימוש מסחרי, שינוי קוד, הפצה והטמעה במוצרים סגורים בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים והרישיון המקורי בקבצים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗