Infinity-Parser: Layout-Aware Reinforcement Learning with High-quality Document Parsing Dataset

Baode Wang; Biao Wu; Weizhen Li; Meng Fang; Zuming Huang; Jun Huang; Yanjie Liang; Haozhe Wang; Ling Chen; Wei Chu; Yuan Qi

Infinity-Parser: Layout-Aware Reinforcement Learning with High-quality Document Parsing Dataset

Baode Wang, Biao Wu, Weizhen Li, Meng Fang, Zuming Huang, Jun Huang, Yanjie Liang, Haozhe Wang, Ling Chen, Wei Chu, Yuan Qi

Abstract

Document parsing from scanned images into structured formats remains a significant challenge due to its complexly intertwined elements such as text paragraphs, figures, formulas, and tables. Existing supervised fine-tuning methods often struggle to generalize across diverse document types, leading to poor performance, particularly on out-of-distribution data. This issue is further exacerbated by the limited availability of high-quality training data for layout-aware parsing tasks. To address these challenges, we introduce layoutRL, a reinforcement learning framework that optimizes layout understanding through composite rewards integrating normalized edit distance, paragraph count accuracy, and reading order preservation. To support this training, we construct the Infinity-Doc-400K dataset, which we use to train Infinity-Parser, a vision-language model demonstrating robust generalization across various domains. Extensive evaluations on benchmarks including OmniDocBench, olmOCR-Bench, PubTabNet, and FinTabNet show that Infinity-Parser consistently achieves state-of-the-art performance across a broad range of document types, languages, and structural complexities, substantially outperforming both specialized document parsing systems and general-purpose vision-language models. We will release our code, dataset, and model to facilitate reproducible research in document parsing.

Anthology ID:: 2026.findings-acl.82
Volume:: Findings of the Association for Computational Linguistics: ACL 2026
Month:: July
Year:: 2026
Address:: San Diego, California, United States
Editors:: Maria Liakata, Viviane P. Moreira, Jiajun Zhang, David Jurgens
Venue:: Findings
SIG:
Publisher:: Association for Computational Linguistics
Note:
Pages:: 1647–1667
Language:
URL:: https://aclanthology.org/2026.findings-acl.82/
DOI:
Bibkey:
Cite (ACL):: Baode Wang, Biao Wu, Weizhen Li, Meng Fang, Zuming Huang, Jun Huang, Yanjie Liang, Haozhe Wang, Ling Chen, Wei Chu, and Yuan Qi. 2026. Infinity-Parser: Layout-Aware Reinforcement Learning with High-quality Document Parsing Dataset. In Findings of the Association for Computational Linguistics: ACL 2026, pages 1647–1667, San Diego, California, United States. Association for Computational Linguistics.
Cite (Informal):: Infinity-Parser: Layout-Aware Reinforcement Learning with High-quality Document Parsing Dataset (Wang et al., Findings 2026)
Copy Citation:
PDF:: https://aclanthology.org/2026.findings-acl.82.pdf
Checklist:: 2026.findings-acl.82.checklist.pdf

PDF Cite Search Checklist Fix data