Prerequisites
Feature Description
MonkeyOCRv2 is a text-centric visual foundation model that unifies fine-grained text modeling, cross-task representation learning, and cross-lingual generalization in a single encoder. MonkeyOCRv2 generalizes effectively across a broad range of OCR and document intelligence tasks, including multilingual document parsing, document understanding, text recognition, formula recognition, document tampering detection, scene text detection, and overlapping text segmentation.
Motivation
https://huggingface.co/collections/zenosai/monkeyocrv2
https://github.com/Yuliang-Liu/MonkeyOCRv2
Possible Implementation
No response
Prerequisites
Feature Description
MonkeyOCRv2 is a text-centric visual foundation model that unifies fine-grained text modeling, cross-task representation learning, and cross-lingual generalization in a single encoder. MonkeyOCRv2 generalizes effectively across a broad range of OCR and document intelligence tasks, including multilingual document parsing, document understanding, text recognition, formula recognition, document tampering detection, scene text detection, and overlapping text segmentation.
Motivation
https://huggingface.co/collections/zenosai/monkeyocrv2
https://github.com/Yuliang-Liu/MonkeyOCRv2
Possible Implementation
No response