GPT
D

deepdoctection

רץ בדפדפן

deepdoctectionapache-2.02022-06-28

  • gradio

העלאת מסמכים ותמונות כדי לפרק אותם לפסקאות, טקסט רציף וטבלאות מעוצבות. הכלי מיועד למי שרוצה לבדוק חילוץ מידע ויזואלי ומבני מקובצי PDF ישירות בדפדפן.

  • הורדות בחודש
  • 145לייקים

מה זה

אתם מעלים תמונה או קובץ PDF, ובוחרים כמה עמודים מתוכו לנתח. הפלט מחולק לארבעה חלקים עיקריים שמוצגים על המסך: טקסט רציף שחולץ מהמסמך, חלוקה לפי מקטעי מבנה, גלריית תמונות שמציגה את הוויזואליה של העיבוד, וטבלאות שמומרות ישירות לתצוגת HTML מסודרת.

מאחורי הקלעים הקוד משתמש בספריית deepdoctection יחד עם מודל Detectron2 לזיהוי מבנה המסמך ומודל tatr_tab_struct_v2 לחילוץ מבנה טבלאות. בממשק משולבות גם דוגמאות מוכנות מראש של קובצי תמונה וקובץ PDF, שממחישות איך המערכת מזהה אזורים ומפרקת עמוד מורכב למרכיביו השונים ללא צורך בהעלאת קובץ אישי מהמחשב.

מתאים ל

  • חילוץ טבלאות ל־HTML

    זיהוי אוטומטי של טבלאות בתוך מסמכים והמרתן לקוד תצוגה נקי בפורמט HTML.

  • פירוק מבנה מסמך

    הפרדה בין טקסט שוטף לחלקי עמוד שונים בעזרת מודל Detectron2 ייעודי.

  • קריאת PDF מרובה עמודים

    טעינת מסמך והרצת סריקה ממוקדת על 1 עד 8 עמודים לפי בחירה מהירה.

איפה זה נופל

ההדגמה הנוכחית נמצאת במצב מושהה ולא ניתן להריץ אותה בדפדפן כרגע בלי להפעיל אותה מחדש. בנוסף, הסליידר מוגבל לעד 8 עמודים בלבד בכל הרצה, כך שאי אפשר לבדוק כאן חוברות שלמות. הממשק גם מזהיר שאם נשארה תמונה שמורה בזיכרון צריך להסיר אותה ידנית לפני בדיקת PDF, אחרת הבדיקה עשויה להשתבש.

שאלות
נפוצות

האם השימוש בהדגמה כרוך בתשלום?

לא, הממשק פתוח לשימוש חופשי. עם זאת, נכון לעכשיו הוא נמצא במצב מושהה ולא יבצע עיבוד עד שיופעל מחדש.

מה קורה עם הקבצים שמעלים לכאן?

הקבצים נשלחים לעיבוד על שרת ה־Space של Hugging Face. אין מידע מפורט על מדיניות שמירת הנתונים בממשק, ולכן לא מומלץ להעלות מסמכים מסווגים או פרטיים.

כמה זמן לוקח לנתח מסמך?

הסביבה מוגדרת על מעבד בסיסי בלבד ללא האצת מאיץ גרפי. העיבוד דורש זמן מה, ותלוי בעיקר בכמות העמודים ובמורכבות הטבלאות במסמך.

האם אפשר להריץ את זה מקומית?

כן, הקוד מבוסס על ספריית הפייתון deepdoctection שזמינה תחת רישיון apache-2.0. ניתן להתקין אותה בסביבה מקומית ולהריץ את אותם המודלים על החומרה שלכם.

איך משתמשים

גוררים תמונה בלשונית המתאימה או מעלים מסמך בלשונית ה־PDF. אם יש בקובץ כמה עמודים, מכוונים את הסליידר בין 1 ל־8 עמודים כדי להגדיר את היקף העיבוד, ולוחצים על הכפתור הראשי להרצת המודל. השרת פועל על מעבד בסיסי בלבד, ולכן הניתוח עלול לקחת זמן, במיוחד במסמכים ארוכים או כבדים.

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0 שמאפשר שימוש חופשי, שינוי והפצה, כולל שימוש מסחרי בקוד. לגבי המידע והמסמכים שאתם מעלים לממשק ברשת, לא מפורטים תנאי פרטיות ספציפיים ולכן עדיף לא להעלות קבצים רגישים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗