GPT
F

FINAL-Bench_Darwin-36B-Opus-GGUF

קוד פתוח

bartowskiapache-2.02026-04-25

  • gguf
  • darwin
  • darwin-v7
  • evolutionary-merge
  • reasoning

גרסת GGUF מכווצת של Darwin בנפח 36 מיליארד פרמטרים שמתאימה להרצה מקומית. היא מציעה יכולות חשיבה מעמיקות למפתחים שמחפשים ביצועים חזקים בלי לצאת לענן.

  • 530 GBמשקל הקבצים
  • 2,219הורדות בחודש
  • 52לייקים

מה זה

המאגר הזה מכיל המרות imatrix לקובצי GGUF עבור Darwin-36B-Opus, שנוצרו באמצעות llama.cpp. הדגם מיועד למשימות יצירת טקסט ותומך בשפות כמו אנגלית, סינית, ספרדית, צרפתית, גרמנית, יפנית, קוריאנית ורוסית. פורמט הפרומפט המובנה כולל תגית חשיבה מפורשת, מה שמכוון אותו לייצור שלבי הסקה לפני הפלט הסופי.

המשקלים עברו אופטימיזציה במגוון רחב של רמות דיוק, החל ממשקל מלא בפורמט bf16 ועד רמות קיצוניות של שתי סיביות. בחלק מהגרסאות, כמו Q4_K_L, שכבות הפלט וההטמעה נשמרו ברמת שמונה סיביות כדי לשמור על יציבות התוכן למרות הדחיסה.

מתאים ל

  • הסקה מקומית על כרטיס 24GB

    גרסת Q4_K_M שוקלת 21.39GB ונכנסת בשלמותה לזיכרון של כרטיס יחיד כדי לקבל מהירות טובה בלי ענן.

  • פיתוח עם תהליכי חשיבה

    התמיכה המובנית בתגית think מתאימה למשימות ניתוח שמחייבות פירוק שלבי חשיבה לפני קבלת התשובה.

  • עיבוד טקסט רב לשוני

    הוא בנוי לעבודה שוטפת מול שפות נתמכות כמו אנגלית, גרמנית, ספרדית, צרפתית, רוסית וסינית.

איפה זה נופל

המודל לא מפרט תמיכה בעברית ברשימת השפות הרשמית שלו, ולכן סביר להניח שפלט מקומי בעברית יסבול מטעויות תחביר או חוסר יציבות. מעבר לזה, רמות הכיווץ הנמוכות מתחת לארבע סיביות מאבדות דיוק במהירות. הכרטיס מזהיר במפורש שגרסאות ה־Q2 וה־Q3 הנמוכות מציגות איכות ירודה, והן לא מתאימות למשימות קריטיות.

שאלות
נפוצות

איזה קובץ הכי כדאי להוריד לעבודה יומיומית?

עבור רוב המשתמשים קובץ Q4_K_M הוא הבחירה המאוזנת ביותר. הוא תופס 21.39GB ומספק איכות טקסט טובה בלי לפוצץ את דרישות החומרה. אם הזיכרון לחוץ, גרסת IQ4_XS תחסוך עוד קצת מקום בביצועים קרובים.

מה המשמעות של גרסאות עם תוספת L כמו Q4_K_L?

בגרסאות האלה שכבות הקלט והפלט נשמרות ברמת דיוק גבוהה יותר של שמונה סיביות במקום כיווץ מלא. זה מוסיף כמה מאות מגה־בייט למשקל הכולל של הקובץ, אבל מונע פגיעה בדיוק הניסוח וההבנה של הדגם.

איך מריצים

כדי להריץ אותו בקצב נורמלי צריך לפחות כרטיס מסך עם 24GB של זיכרון ייעודי עבור קובצי ה־Q4, ששוקלים כ־21GB. אם המטרה היא להריץ את הגרסאות הכבדות יותר כמו Q8_0 או bf16 שנפחן מעל 36GB, תצטרכו שני כרטיסים חזקים או שילוב של זיכרון המערכת, מה שיפגע במהירות הריצה.

הקבצים עובדים ישירות בסביבות כמו LM Studio, llama.cpp, koboldcpp ו־Jan AI. מי שלא מחזיק בחומרה כזו יגלה שהרצה מקומית של דגם 36B פשוט איטית מדי לעבודה שוטפת, ושם שווה לבדוק גישה דרך שרת מרוחק.

ollama run hf.co/bartowski/FINAL-Bench_Darwin-36B-Opus-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

31 קבצים במאגר, 530 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מופץ תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו הלאה, בתנאי ששומרים על הודעת זכויות היוצרים ומצרפים עותק של הרישיון המקורי בכל הפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗