GPT
O

Ouro-1.4B-Thinking

קוד פתוח

ByteDanceapache-2.02025-10-28

  • transformers
  • safetensors
  • ouro
  • text-generation
  • looped-language-model

מודל חשיבה קומפקטי שמכוון למשימות מתמטיקה ומדע באמצעות צעדים חוזרים. הוא מציע יכולות של מודלים גדולים יותר בחבילה קלה להרצה מקומית.

  • 1.4Bפרמטרים
  • 65,536טוקנים בהקשר
  • 2.7 GBמשקל הקבצים
  • 11,240הורדות בחודש

מה זה

מדובר במודל שפה קטן של 1.4 מיליארד פרמטרים שעבר אימון ייעודי לחשיבה מפורטת על כ־8.3 מיליון דוגמאות של מתמטיקה, קוד ומדעים. בייטדאנס בנו אותו על ארכיטקטורה עם לולאות חוזרות, שבה המודל מריץ מספר פסיעות חישוב פנימיות לפני שהוא פולט תשובה, מה שמאפשר לו להפיק שרשרת חשיבה מפורטת.

הייחוד כאן הוא השילוב בין מנגנון יציאה מוקדמת לבין גודל פיזי קטן. אפשר לשלוט על כמות צעדי החישוב כדי לקזז בין זמן ריצה לדיוק, ובחברה טוענים שהתוצאות שלו מתחרות במודלים של 4 מיליארד פרמטרים. עם זאת, הוא מכוון בעיקר למשימות היסק לוגיות ופחות לשיחה כללית או יצירת תוכן חופשי.

מתאים ל

  • פתרון בעיות מתמטיות

    אימון ייעודי על מיליוני דוגמאות הופך אותו למנוע היסק מתמטי קומפקטי.

  • ניתוח קוד מדעי מקומי

    יכולת לפעול על חומרה חלשה בלי להוציא נתונים רגישים לענן חיצוני.

  • מחקרי ארכיטקטורת חשיבה

    שליטה ידנית על מספר צעדי החישוב לצורך בדיקת פשרות בין מהירות לדיוק.

איפה זה נופל

בייטדאנס מצהירים במפורש שהמודל מיועד למטרות מחקר בלבד ומסופק ללא שום אחריות לשימוש בייצור. הוא לא נבנה כמודל שיחה רחב, ואוסף הנתונים שלו כמעט כולו מדע ומתמטיקה, כך שאין מה לבנות עליו לעיבוד שפה טבעית עשיר או עברית.

מעבר לכך, התלות בגרסת transformers ישנה מהווה סיכון אבטחה ותחזוקה בפרויקטים חדשים. אם אתם שוקלים להכניס אותו למערכת פעילה, תצטרכו לבדוק היטב איך הוא מגיב לשאלות מחוץ לתחום ההיסק הצר שלו ולוודא שהקוד לא נשבר בשדרוגי חבילות.

אותה משפחה

Ouro יצא ב־4 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להריץ אותו בשרת ייצור עם vLLM?

אפשר טכנית, אבל מנגנון היציאה המוקדמת שמקצר זמנים לא יעבוד שם, והמודל יריץ תמיד את כל ארבע הפסיעות. בנוסף, בייטדאנס מגדירים אותו ככלי למחקר בלבד וללא אחריות למוצרי פרודקשן.

איזו גרסה של transformers חובה להתקין?

חייבים גרסה נמוכה מ־4.56.0, כשההמלצה הרשמית של המפתחים היא 4.54.1. שימוש בגרסאות חדשות יותר עלול לגרום לבעיות תאימות בריצת המודל ובזיכרון המטמון.

האם המודל מתאים לבוט שיחה כללי?

לא. מתוך מעל שמונה מיליון דוגמאות אימון, רק חלק זעיר הוקדש לצ׳אט, ורובו המוחלט מתמקד במדע, קוד והיסק לוגי.

איך מריצים

בזכות משקל קבצים של 2.7 גיגה בייט ודיוק bfloat16, המודל הזה עולה בלי בעיה על כרטיס מסך ביתי בסיסי, מחשב נייד מודרני או אפילו מעבד. מריצים אותו ישירות דרך ספריית transformers, אבל צריך לשים לב לדרישות: המפתחים דורשים גרסה ישנה מ־4.56.0, וממליצים על 4.54.1 כדי למנוע שגיאות תאימות.

אם אתם עובדים עם vLLM להאצת ביצועים, קחו בחשבון שמנגנון היציאה המוקדמת לא נתמך שם, והוא יריץ תמיד את כל ארבעת צעדי החישוב המוגדרים. למי שצריך רק כמה קריאות בודדות של פתרון משוואות פשוטות, עדיף להשתמש ב־API חיצוני של מודל כללי במקום להתעסק עם תלויות ישנות של ספריות.

from transformers import pipeline

pipe = pipeline("text-generation", model="ByteDance/Ouro-1.4B-Thinking")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0 סטנדרטי ומתירני. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי. יחד עם זאת, צריך לזכור שהיוצרים הדגישו בכרטיס המודל שהגרסה הזו מיועדת למחקר בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗