No.3 of Shangyuan Residence Haidian District
Beijing, 100089
China
Beijing Jiaotong University
Scene Graph Generation, Large Vision-Language Model, Image Caption, Visual Context Parsing, Instruction Tuning
Video anomaly detection, Self-supervised learning, Pretext task