GPT
N

NuExtract-tiny

קוד פתוח

numindmit2024-05-31

  • transformers
  • safetensors
  • qwen2
  • text-generation
  • conversational

numind עומדים גם מאחורי NuExtract 2.0 by NuMind, ויש עליו סקירה כאן.

חילוץ מידע מובנה לתוך תבנית JSON מטקסטים קצרים באנגלית. הוא שוקל פחות משני ג'יגה ורץ מקומית בלי לגעת במעבד גרפי כבד.

  • 464Mפרמטרים
  • 32,768טוקנים בהקשר
  • 1.7 GBמשקל הקבצים
  • 15,735הורדות בחודש

מה זה

מדובר בגרסה מכווננת של Qwen1.5-0.5B שאומנה על דאטה סינתטי פרטי לצורך משימה אחת בלבד, לקחת טקסט גולמי ולהוציא ממנו שדות לפי סכמת JSON מוגדרת מראש. בניגוד למודלי שיחה כלליים בגודל הזה שמנסים להמציא תשובות או לנסח מחדש, הוא עובד בצורה חילוצית טהורה. כל מילה שהוא מייצר בתור ערך חייבת להופיע במקור בדיוק כפי שהיא נכתבה.

היוצרים שלו מייעדים אותו בעיקר כבסיס לאימון נוסף עם שלושים דוגמאות ומעלה למשימה ספציפית, למרות שהוא מסוגל לעבוד גם בלי דוגמאות בכלל אם מצרפים לפרומפט דוגמת פלט. בנוסף קיימות לאותה משפחה גרסאות של 3.8 מיליארד ושל 7 מיליארד פרמטרים, כך שאם הדיוק של חצי מיליארד פרמטרים לא מספיק, יש לאן לעלות באותה שיטת עבודה.

מתאים ל

  • חילוץ נתונים מטפסים באנגלית

    שליפת שדות קבועים כמו שמות, תאריכים וכתובות מתוך טקסטים קצרים ישירות למבנה נתונים.

  • פייפליין מקומי וזול

    עיבוד אלפי מסמכים על חומרה פשוטה בלי לשלוח מידע רגיש לשירותי ענן חיצוניים.

  • בסיס לכוונון ייעודי

    אימון מהיר על כמה עשרות דוגמאות ספציפיות כדי לקבל חילוץ אמין במיוחד למשימה מוגדרת.

איפה זה נופל

היוצרים מציינים במפורש שהגרסה הזו מיושנת וכבר יש להם גרסת 1.5 עדכנית. מגבלה קריטית נוספת היא אורך הטקסט, הכרטיס דורש להזין פחות מ־2000 טוקנים בכל הרצה למרות חלון ההקשר הטכני. בנוסף, הוא תומך באנגלית בלבד ועובד רק בחילוץ מדויק, כך שאם אתם צריכים תרגום, סיכום, הסקת מסקנות או עבודה בעברית, הוא פשוט לא יעשה את זה.

שאלות
נפוצות

האם כדאי להוריד את הגרסה הזו עכשיו?

לא מומלץ להתחיל איתה פרויקט חדש. היוצרים עצמם ציינו בראש העמוד שהיא מיושנת והפנו לגרסת 1.5, ולכן עדיף לבדוק קודם את הגרסה המעודכנת.

האם הוא מתאים לעיבוד טקסטים בעברית?

לא. המודל הוגדר ואומן לשפה האנגלית בלבד, וגם מודל הבסיס שלו אינו מותאם לעברית, כך שהוא ייכשל במשימות חילוץ מקומיות.

איך מריצים

עם משקל קבצים של 1.7 גיגה בייט וסך הכל 464 מיליון פרמטרים, כל מחשב נייד מודרני מריץ אותו ישירות דרך ספריית transformers בלי להזיע. אפשר להעלות אותו על מעבד רגיל או על כרטיס מסך בסיסי ולקבל זמני תגובה מהירים מאוד בלי לשלם על שרתים יקרים.

שווה לקרוא ל־API חיצוני רק כשעובדים עם טקסטים ארוכים במיוחד או כשרמת המורכבות של החילוץ דורשת הבנה עמוקה של הקשרים, כי מודל בגודל כזה לא מתחרה במודלי ענק מסחריים בלי שעבר כוונון ייעודי לדאטה שלכם.

from transformers import pipeline

pipe = pipeline("text-generation", model="numind/NuExtract-tiny")
print(pipe("שלום"))

הרישיון

רישיון MIT פתוח ומתירני לחלוטין. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, לאמן עליו הלאה ולשלב אותו במוצר סגור בלי תשלום תמלוגים. התנאי היחיד הוא שמירת הודעת זכויות היוצרים של המפתחים המקוריים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗