1037 Luoyu Rd
Wuhan, 430074
China
Huazhong University of Science and Technology
Tampered text detection, Document forgery, Image forensics, Image manipulation detection, Multi-modal
multimodal OCR, document parsing, structured graphics parsing, image-to-SVG, vision-language model, multimodal pretraining