Guizhou
China
Guizhou University
Video anomaly detection, Self-supervised learning, Pretext task
Grounded Conversation Generation, Large Vision-Language Models, multimodal learning
Video Understanding, Multimodal learning, Prompt learning, Action recognition
Image fusion, Cross-Modality Compensation Blocks (CMCBs), Residual Enhancement Block (REB), mask, saliency-guided target detection