12 repos
rednote-hilab/dots.ocr.base
dots.ocr: Multilingual Document Layout Parsing in a Single Vision-Language Model
13
2 commits
rednote-hilab/dots.ocr
1,331
22 commits
rednote-hilab/dots.mocr-svg
dots.mocr
37
3 commits
rednote-hilab/dots.mocr
172
10 commits
Multimodal OCR: Parse Anything from Documents
346
0 commits
zenosai/MonkeyOCRv2-B-Parsing-DFlash
News
3
4 commits
Yuliang-Liu/MonkeyOCRv2
MonkeyOCRv2 Vision Encoder — A Document-Native Visual Backbone
1,408
90 commits
DocTron-hub/OCRVerse
OCRVerse: Towards Holistic OCR in End-to-End Vision-Language Models
30
40 commits
echo840/MonkeyOCR
MonkeyOCR: Document Parsing with a Structure-Recognition-Relation Triplet Paradigm
516
54 commits
opendatalab/TRivia-3B
TRivia: Self-supervised Fine-tuning of Vision-Language Models for Table Recognition
12
PaddlePaddle/Real5-OmniDocBench
Real5-OmniDocBench measures the robustness of document parsing systems under five physical…
31 commits
PaddlePaddle/PP-DocLayoutV3_safetensors
Unified Layout Module for PaddleOCR-VL 1.5/1.6 & GLM-OCR
42
14 commits