GPT
D

dots.llm1.base

קוד פתוח

dots-studiomit2025-05-14

  • transformers
  • safetensors
  • dots1
  • text-generation
  • conversational

מודל בסיס פתוח בארכיטקטורת תערובת מומחים עם מאה ארבעים ושניים מיליארד פרמטרים. הוא מיועד למי שרוצה ביצועים של מודל ענק עם עלות חישוב של ארבעה עשר מיליארד פרמטרים בלבד בזמן ריצה.

  • 143Bפרמטרים
  • 32,768טוקנים בהקשר
  • 266 GBמשקל הקבצים
  • 9,594הורדות בחודש

מה זה

המודל הזה הוא גרסת הבסיס של סדרת dots.llm1, שנבנתה בתצורת תערובת מומחים עם מאה עשרים ושמונה מומחים מנותבים ועוד שני מומחים משותפים. בכל טוקן המערכת מפעילה שישה מומחים בלבד, מה שמביא את מספר הפרמטרים הפעילים לארבעה עשר מיליארד. לפי הדוח הטכני, אימון הבסיס נעשה על דאטה מקורי ללא שימוש בנתונים סינתטיים.

היוצרים מדווחים על ביצועים שמקבילים ל־Qwen2.5-72B, כשהרעיון המרכזי הוא קבלת יכולות של מודל דחוס ועמוק בלי לסחוב את עלויות החישוב הכבדות של כל המשקלים בכל צעד. מעבר לזה, המפתחים שחררו צ'קפוינטים מכל שלבי האימון, מה שמאפשר לנתח את הדינמיקה של תהליך הלמידה לאורך זמן.

מתאים ל

  • המשך אימון ואימון ייעודי

    בסיס רחב ללא נתונים סינתטיים שמתאים לכוונון על דאטה ארגוני פנימי.

  • חקר התכנסות של מודלים

    היוצרים שחררו נקודות ביניים מהאימון, מה שמאפשר לחקור התנהגות שכבות.

  • מערכות השלמת טקסט באנגלית

    הפעלת מומחים חסכונית שמאפשרת תגובה מהירה ביחס למודלים מונוליטיים.

איפה זה נופל

זהו מודל בסיס בלבד ולא מודל שעבר כוונון לשיחה או מילוי הוראות, כך שהוא לא יענה ישירות על שאלות אלא רק ישלים טקסט קיים. לשיחות צריך לקחת את גרסת ה־inst או לאמן אותו לבד. בנוסף, המודל אומן מראש על אנגלית וסינית בלבד. אין תיעוד לתמיכה בעברית, ולכן ניסיון לעבוד איתו בעברית יגרור כנראה פליטת הברות משובשות או תרגום לקוי. חלון ההקשר עומד על שלושים ושניים אלף טוקנים, שזה סביר אבל קצר מול הסטנדרטים הנוכחיים של מאה אלף ויותר.

שאלות
נפוצות

האם המודל יודע לענות על שאלות בצ'אט?

לא ישירות. מדובר בגרסת הבסיס שמיועדת להשלמת טקסט, ועבור צ'אט והוראות צריך להשתמש בגרסת dots.llm1.inst.

אפשר להריץ אותו על שרת עם כרטיס מסך אחד?

לא. הקבצים עצמם שוקלים מאתיים שישים ושישה גיגה בייט, והיוצרים מגדירים תצורה של שמונה כרטיסי מסך במקביל כדי לטעון ולהריץ אותו.

האם הוא תומך בעבודה בעברית?

החומר הרשמי מגדיר תמיכה באנגלית ובסינית בלבד, כך שלא כדאי לבנות עליו לעיבוד או הפקה של טקסט בעברית.

איך מריצים

המשקלים תופסים מאתיים שישים ושישה גיגה בייט ומחולקים לשמונים וארבעה קבצים, מה שאומר שחובה שרת עם כמה מאיצים גרפיים רק כדי לטעון אותם לזיכרון. הדוגמאות הרשמיות של הפרויקט דורשות שרת עם מקביליות של שמונה כרטיסים באמצעות vLLM או SGLang, עם תמיכה בהרצה דרך דוקר ייעודי.

אם אין לכם קלאסטר של שמונה כרטיסי שרת עם מספיק זיכרון וידאו, חבל על המאמץ להוריד את המשקלים למכונה בודדת. המודל דורש הפעלת קוד מרוחק ומיועד לסביבות ענן רציניות, ובמקרים של תקציב מוגבל עדיף לחפש ספק חיצוני שמגיש אותו או את גרסת ההוראות כשירות מנוהל.

from transformers import pipeline

pipe = pipeline("text-generation", model="dots-studio/dots.llm1.base")
print(pipe("שלום"))

הקבצים

84 קבצים במאגר, 266 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט משוחרר תחת רישיון MIT. הרישיון הזה מתיר שימוש מסחרי חופשי, שינוי קוד, הפצה ושילוב במוצרים פרטיים בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הצהרת זכויות היוצרים של היוצרים המקוריים בקוד או בהפצה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗