GPT
S

s1-mini

קוד פתוח

superwhisperother2026-08-12

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • asr

זה מודל זעיר לניקוי תמלולי שמע באנגלית, שמסיר גמגומים ומתקן פיסוק במקום להשתמש במודלי ענק יקרים. הוא מיועד למי שמריץ מנוע דיבור לטקסט ורוצה פלט קריא ישירות על מעבד מקומי.

  • 752Mפרמטרים
  • 40,960טוקנים בהקשר
  • 1.4 GBמשקל הקבצים
  • 8,034הורדות בחודש

מה זה

הבסיס כאן הוא מודל שפה בגודל 596 מיליון פרמטרים אמיתיים, שנועד למשימה אחת בלבד: לקחת תמלול גולמי ומבולגן ולהחזיר טקסט כתוב, מפוסק וערוך היטב. הוא לא יודע לענות על שאלות, לנהל שיחה או לבצע הוראות כלליות. במקום זה, הוא מזהה תיקונים עצמיים של הדובר, מסיר מילות מילוי, וממיר מספרים, שעות או כתובות מייל מדוברות לצורה הכתובה והתקנית שלהן.

בבדיקה על 7,519 דוגמאות באנגלית הוא הגיע לדיוק של 94.8 אחוזים ברמת הטוקן. בפועל זה אומר שכמעט בכל פלט תקבלו שחזור מדויק של כוונת הדובר ללא המצאת עובדות, כל עוד שולטים בתוצאה בעזרת שורת הפקודה הייעודית שמגדירה את רמת הרשמיות, המבנה וסגנון הטקסט.

מתאים ל

  • ניקוי הכתבות מקומי

    ממיר תמלול קולי למיילים וטקסטים מסודרים ישירות על המחשב בלי לשלוח מידע לרשת.

  • עיבוד פרוטוקולים מישיבות

    מסיר גמגומים ותיקוני דיבור מפלט של מנועי שמע כדי להפיק סיכומים נקיים.

  • כתוביות חכמות בזמן אמת

    מארגן משפטים מדוברים למבנה קריא עם סימני פיסוק מלאים במהירות גבוהה ועל מעבד פשוט.

איפה זה נופל

הוא עובד באנגלית בלבד. אם תזינו עברית, התוצאה תהיה חסרת ערך לחלוטין. הוא גם לא מתאים לטקסטים באורך מלא, וקטעים של יותר מאלף טוקנים חייבים לחתוך ידנית לפסקאות קצרות לפני השליחה.

הבעיה הטכנית המרכזית היא חובת ביטול מצב החשיבה בתבנית השיחה. אם לא תכבו את הדגל הזה במפורש בהגדרות הבקשה, המודל יחזיר פלט ריק לגמרי. בנוסף, חובה להעביר לו בדיוק את שורת הפקודה וההנחיה שהוגדרו מראש, אחרת הוא מייצר שיבושים והזיות.

שאלות
נפוצות

האם אפשר להשתמש במודל הזה בשביל לעבד תמלולים בעברית?

לא. המודל אומן ונבדק על השפה האנגלית בלבד, ואין לו תמיכה בעברית. הזנת קלט בשפה שאינה אנגלית תוביל לפלט פגום או ריק.

למה המודל מחזיר לי תשובה ריקה כשאני שולח אליו טקסט?

הסיבה הנפוצה ביותר היא השארת מנגנון החשיבה פעיל בתבנית ההרצה של קוון. חובה להגדיר ביטול של מצב החשיבה בקריאה, ולוודא ששלחתם את שורת הפקודה המדויקת שלפני התמלול.

איך מריצים

המודל שוקל 1.4 גיגה בייט בגרסת המשקלים המקורית, וגרסת קוונטיזציה מכווצת תופסת 462 מגה בייט בלבד. המשמעות היא שאין שום צורך בכרטיס מסך ייעודי כדי לעבוד איתו. הוא רץ ישירות על מעבד של מחשב נייד רגיל דרך ספריות כמו טרנספורמרס או מנועים מבוססי סי פלוס פלוס, בלי עומס מורגש על הזיכרון.

משתמשים בו כשלב המשך מיד אחרי מנוע תמלול. אם אתם מעבדים קטעים קצרים או עובדים מקומית באפליקציית הכתבה, הרצה עצמית על המכשיר היא הבחירה הנכונה והזולה. שירות חיצוני שווה לשקול רק אם אתם מקבלים קבצי שמע ארוכים במיוחד שדורשים חלוקה מורכבת מראש או אם התשתית שלכם כבר מבוססת כולה על שרתים קיימים.

from transformers import pipeline

pipe = pipeline("text-generation", model="superwhisper/s1-mini")
print(pipe("שלום"))

הרישיון

הרישיון מבוסס על אפאצ'י 2.0 המוכר, שמאפשר שימוש בקוד פתוח וגם שילוב במוצרים מסחריים בלי תשלום תמלוגים. עם זאת, נוסף כאן תנאי שמחייב אתכם לשמור על השם המדויק של המודל ועל שם החברה שיצרה אותו בכל מקום שבו הוא מופץ או מוטמע. לכן חשוב לבדוק שהשמירה על השם מתאימה למדיניות המיתוג של המוצר שלכם לפני השילוב.

הרישיון המלא בעמוד המודל ↗