AI & ML interests
VLMs and long context, document processing and understanding, confidence, calibration, alignment, and decision making.
Papers
GutenOCR: A Grounded Vision-Language Front-End for Documents
PubMed-OCR: PMC Open Access OCR Annotations
Organization Card
Data and models for optical character recognition
-
PubMed-OCR: PMC Open Access OCR Annotations
Paper • 2601.11425 • Published • 12 -
GutenOCR: A Grounded Vision-Language Front-End for Documents
Paper • 2601.14490 • Published • 38 -
bevaya/TABMEpp
Viewer • Updated • 122k • 1.72k • 5 -
bevaya/pubmed-ocr
Viewer • Updated • 1.55M • 3.54k • 72
Data and models for optical character recognition
-
PubMed-OCR: PMC Open Access OCR Annotations
Paper • 2601.11425 • Published • 12 -
GutenOCR: A Grounded Vision-Language Front-End for Documents
Paper • 2601.14490 • Published • 38 -
bevaya/TABMEpp
Viewer • Updated • 122k • 1.72k • 5 -
bevaya/pubmed-ocr
Viewer • Updated • 1.55M • 3.54k • 72
datasets 22
bevaya/ENTRANT
Viewer • Updated • 7.75M • 2.57k
bevaya/CISOL
Viewer • Updated • 1.37k • 185
bevaya/HiTab-StatCan-NSF
Viewer • Updated • 8.71k • 263
bevaya/MUSTARD
Viewer • Updated • 1.43k • 93
bevaya/MultiHiertt
Viewer • Updated • 8.87k • 327 • 2
bevaya/FinQA
Viewer • Updated • 8.28k • 558
bevaya/GloSAT
Viewer • Updated • 1k • 162
bevaya/SciTSR-cc-by-nc-sa
Viewer • Updated • 889 • 421
bevaya/SciTSR-pd
Viewer • Updated • 108 • 233
bevaya/pubmed-ocr
Viewer • Updated • 1.55M • 3.54k • 72