GPT
D

DeepSeek-V3.1

קוד פתוח

deepseek-aimit2025-08-21

  • transformers
  • safetensors
  • deepseek_v3
  • text-generation
  • conversational

שדרוג מסיבי שמשלב באותו משקל מצב חשיבה עמוק ומצב שיחה מהיר, עם קפיצה משמעותית בסוכני קוד וקריאות לכלים. מתאים למי שרוצה ביצועים בלי לנהל שני מודלים נפרדים.

  • 685Bפרמטרים
  • 163,840טוקנים בהקשר
  • 641 GBמשקל הקבצים
  • 229,363הורדות בחודש

מה זה

מדובר במודל ענק של 685 מיליארד פרמטרים, שמפעיל 37 מיליארד בכל טוקן, ומביא יכולת מעבר בין מצב עבודה מהיר למצב חשיבה אנליטי רק באמצעות שינוי תבנית השיחה. הבסיס שלו עבר הרחבת הקשר משמעותית שכללה אימון על מאות מיליארדי טוקנים במסמכים ארוכים, מה שנותן לו חלון עבודה רחב ויציב יותר בהשוואה לגרסה הקודמת.

במבחני ביצועים ההבדל ניכר בעיקר במשימות תכנות ובסוכנים. במצב שיחה רגיל הוא משיג 66 אחוזים במבחן SWE Verified לעומת 45.4 בגרסה הקודמת, ובמצב חשיבה הוא מגיע לציון 2091 ב־Codeforces ו־93.1 אחוזים ב־AIME 2024. הוא עוקף את R1 המקורי בחלק מהמדדים ועונה מהר יותר, מה שהופך אותו לבחירה חזקה לפתרון בעיות הנדסיות מורכבות.

מתאים ל

  • סוכני תכנות אוטונומיים

    מציג 66 אחוזים בפתרון באגים מורכבים ב־SWE Verified, שיפור עצום לעומת הגרסה הקודמת.

  • פתרון בעיות מתמטיות קשות

    מצב החשיבה מגיע ל־93.1 אחוזים ב־AIME 2024 ומספק תשובות מהר יותר מדגמי הדור הקודם.

  • מערכות משולבות שיחה וניתוח

    מאפשר לעבור מתשובות קצרות וקריאות לכלים לחשיבה עמוקה באותו שירות, רק באמצעות שינוי פרומפט.

איפה זה נופל

במצב חשיבה המודל עדיין מקבל רק 15.9 אחוזים במבחן הקשה Humanity's Last Exam, תוצאה נמוכה מעט מ־R1 הוותיק. בנוסף, כל הנתונים המרשימים בסוכני חיפוש וסוכני קוד נמדדו באמצעות מערכות פנימיות של החברה שכוללות מנועי חיפוש מסחריים וסינון עמודים, כך שבלי לבנות מעטפת מורכבת בעצמכם לא תקבלו את אותם הביצועים. משימות כלי עבודה נתמכות כרגע רק במצב ללא חשיבה, אלא אם מממשים את הפורמט הייעודי לחיפוש.

אותה משפחה

DeepSeek יצא ב־8 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איך מחליפים בין מצב חשיבה למצב רגיל בהרצה?

השליטה נעשית דרך ה־Chat Template בלבד. הוספת תגית הסגירה לסבב השיחה מפעילה מצב ישיר ומהיר, בעוד שהשארת תגית הפתיחה גורמת למודל להפיק שלבי חשיבה לפני המענה.

האם אפשר להפעיל קריאות לכלים במצב חשיבה?

התבנית הכללית של קריאה לפונקציות מוגדרת כרגע למצב הרגיל בלבד. למצב חשיבה קיים מבנה ייעודי ונפרד שמתאים בעיקר לסוכני חיפוש חיצוניים.

איך מריצים

כדי להריץ 641 ג'יגה־בייט של קבצים צריך קלאסטר רציני של שרתי GPU עם מאות ג'יגה־בייט של זיכרון גרפי, תמיכה בפורמט UE8M0 FP8 והקפדה על טעינת משקלי התיקון ב־FP32. אם אין לכם חומרה ייעודית של עשרות אלפי דולרים בענן, אין סיבה להוריד אותו פיזית.

לרוב הפרויקטים עדיף לצרוך אותו דרך ספק API חיצוני. זה חוסך את התחזוקה של שרתים מורכבים, ומאפשר לקבל את היכולות של המודל בלי להתעסק בחלוקת שכבות על פני כרטיסים.

from transformers import pipeline

pipe = pipeline("text-generation", model="deepseek-ai/DeepSeek-V3.1")
print(pipe("שלום"))

הקבצים

177 קבצים במאגר, 641 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הקוד והמשקלים שוחררו תחת רישיון MIT. מותר להשתמש בהם לכל מטרה, כולל מוצרים מסחריים, שינויים והפצה מחדש, בלי תמלוגים. הדרישה היחידה היא לשמור על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗