GPT
C

chandra-ocr-2-GGUF

קוד פתוח

prithivMLmodsother2026-03-18

  • transformers
  • gguf
  • qwen3_5
  • ocr
  • pdf

המודל מחלץ טקסט מתמונות ומסמכים ישירות למבנה של מרקדאון, HTML או JSON. הוא מתאים למי שצריך לפענח טבלאות מורכבות, נוסחאות וסריקות בלי להסתבך עם פייפליין כבד.

  • 55.1 GBמשקל הקבצים
  • 9,666הורדות בחודש
  • 39לייקים

מה זה

מדובר בהמרה לפורמט GGUF של מודל הראייה מבית Datalab, שמיועד לעיבוד מסמכים והמרתם לפורמט מובנה. המודל שומר על המבנה המקורי של העמוד, כולל זיהוי תיבות סימון, כתב יד, כיתובי תמונות ותרשימים. לפי הכרטיס, הוא תומך ביותר מ־90 שפות, אם כי השפה הרשמית שמצוינת במטא-דאטה היא אנגלית בלבד.

במדד olmocr הוא מציג תוצאה של 85.9%, ובמבחן הרב-לשוני ציון של 77.8%, שזו עלייה של 12% לעומת הגרסה הקודמת שלו. המשמעות בפועל היא יכולת טובה יותר בהתמודדות עם טבלאות מורכבות שמכילות תאים ממוזגים ובפענוח של נוסחאות מתמטיות מתוך מאמרים אקדמיים או דוחות פיננסיים.

מתאים ל

  • המרת טבלאות ודוחות

    חילוץ נתונים מדוחות כספיים וסריקות עם תאים ממוזגים ישירות למבנה JSON או HTML.

  • סריקת מאמרים מדעיים

    זיהוי ופענוח של נוסחאות מתמטיות מורכבות ותרשימים מתוך קובצי PDF לעבודה עם מרקדאון.

  • עיבוד טפסים וסקרים

    קריאת טפסים שכוללים שדות של כתב יד ותיבות סימון לתוך פייפליין אוטומטי.

איפה זה נופל

למרות ההצהרה על תמיכה במעל 90 שפות, המטא-דאטה מפרט אנגלית בלבד, כך שאיכות הפענוח של מסמכים בעברית לא מובטחת ודורשת בדיקה מעשית על החומרים שלכם לפני שילוב במערכת. מעבר לכך, מכיוון שמדובר בהמרת קוונטיזציה של צד שלישי, גרסאות נמוכות כמו Q2 או Q3 עלולות לפגוע בדיוק של תווים קטנים בטבלאות צפופות.

שאלות
נפוצות

איזה קבצים צריך להוריד כדי להריץ אותו?

צריך להוריד שני קבצים, את קובץ המשקלים הראשי של המודל לפי רמת הדחיסה הרצויה, למשל Q4_K_M, ובנוסף את אחד מקובצי ה־mmproj שמטפלים ברכיב הראייה. בלי קובץ ה־mmproj אי אפשר להזין למודל תמונות.

האם המודל יפענח מסמכים בעברית?

בתיאור המודל נכתב שהוא תומך ביותר מ־90 שפות, אבל בהגדרות השפה הרשמיות של הדף מסומנת רק אנגלית. כדאי להריץ בדיקה על דוגמה מקומית לפני שבונים עליו לעברית, כי אין פירוט לגבי רמת הדיוק בשפות שאינן אנגלית.

איך מריצים

בשביל להריץ אותו מקומית צריך קובץ מודל וקובץ mmproj מתאים לעיבוד התמונה. המשקלים של קובצי המודל נעים בין 2.12 גיגה-בייט בגרסת Q2_K המצומצמת ועד 9.7 גיגה-בייט בגרסאות המלאות כמו BF16 ו־F16. גרסאות ביניים כמו Q4_K_M שוקלות סביב 3.07 גיגה-בייט, וקובץ ה־mmproj דורש בין 367 ל־676 מגה-בייט נוספים, כך שכרטיס מסך מודרני פשוט עם 6 עד 8 גיגה זיכרון יספיק לרוב הגרסאות המכווצות.

אם אתם צריכים מהירות גבוהה יותר או דיוק מקסימלי בלי לנהל תשתית, המפתחים מציעים גם API מנוהל או סביבת ניסוי חינמית. הרצה עצמית מתאימה בעיקר כשיש מגבלות פרטיות על המסמכים.

ollama run hf.co/prithivMLmods/chandra-ocr-2-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון המוגדר הוא other, ללא פירוט של תנאי השימוש החופשי או המסחרי בכרטיס המודל. במצב כזה אי אפשר לדעת מראש אם מותר לשלב אותו במוצר מסחרי, ומומלץ לבדוק את הרישיון של מודל המקור המקורי של Datalab לפני שמשתמשים בו.

הרישיון המלא בעמוד המודל ↗