Shien Ke(柯诗恩) ,Changsheng Gao,Hadi Amirpour,Zhihua Wang,Xiaoyan Sun(孙晓艳) (2026). Token-Wise Attention-Guided Semantic Quality Assessment for Compressed Visual Features. In QoMEX.
Xiangchen Yin(尹相臣) ,Wenzhang Sun,Jiahui Yuan(袁嘉辉) ,Zijie Liu(刘子杰) ,Yinda Chen,Wei Li(李蔚) ,Dachun Kai(开大纯) ,Chunfeng Wang,Xiaoyan Sun(孙晓艳) (2026). Holo-World: Unified Camera, Object and Weather Control for Video World Model. arXiv preprint arXiv:2606.20083. PDF Code
Zheng Chen(陈政) ,Peng Li,Zheyu Zhang(张哲宇) ,Siying Wu(吴思颖) ,Jing Zhang(张静) ,Cuiling Hu,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2026). Salient Diagnostic Value Perception For Preoperative Posterior Fossa Tumor Diagnosis. In ICASSP.
Xiaoman Wu(吴小满) ,Lubin Gan(甘鲁斌) ,Siying Wu(吴思颖) ,Jing Zhang(张静) ,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2026). SSCM: A Spatial-Semantic Consistent Model for Multi-Contrast MRI Super-Resolution. In ICASSP. PDF
Yansong Peng(彭岩松) ,Kai Zhu,Yu Liu,Pingyu Wu,Hebei Li(李和倍) ,Xiaoyan Sun(孙晓艳) ,Feng Wu (2026). Facm: Flow-anchored consistency models. In ICLR 2026. PDF Code
Wei Li(李蔚) ,Yiheng Zhang,Fuchen Long,Zhaofan Qiu,Ting Yao,Xiaoyan Sun(孙晓艳) ,Tao Mei (2026). ReactID: Synchronizing Realistic Actions and Identity in Personalized Video Generation. In ICLR. PDF
Dachun Kai(开大纯) ,Zeyu Xiao,Huyue Zhu(朱胡悦) ,Jiaxiao Wang(王佳笑) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2026). Seeing the unseen: Zooming in the dark with event cameras. In AAAI. PDF Code
Zhangchi Hu(胡张驰) ,Yifan Zhao(赵逸凡) ,Yansong Peng(彭岩松) ,Wenzhang Sun,Xiangchen Yin(尹相臣) ,Jie Chen(陈杰) ,Peixi Wu(吴沛熹) ,Hebei Li(李和倍) ,Xinghao Wang,Dongsheng Jiang,Xiaoyan Sun(孙晓艳) (2026). RiO-DETR: DETR for Real-time Oriented Object Detection. ECCV 2026. PDF Code
Dachun Kai(开大纯) ,Jiayao Lu(陆家尧) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2026). EvTexture++: Event-Driven Texture Enhancement for Video Super-Resolution. IEEE TPAMI. PDF Code
Zhangchi Hu(胡张驰) ,Peixi Wu(吴沛熹) ,Jie Chen(陈杰) ,Huyue Zhu(朱胡悦) ,Yijun Wang(王义钧) ,Yansong Peng(彭岩松) ,Hebei Li(李和倍) ,Xiaoyan Sun(孙晓艳) (2025). Dome-DETR: DETR with density-oriented feature-query manipulation for efficient tiny object detection. In ACM MM. PDF Code
Changsheng Gao,Zijie Liu(刘子杰) ,Li Li,Dong Liu,Xiaoyan Sun(孙晓艳) ,Weisi Lin (2025). DT-UFC: Universal large model feature coding via peaky-to-balanced distribution transformation. In ACM MM 2025. PDF
Lubin Gan(甘鲁斌) ,Jing Zhang(张静) ,Linhao Qu,Yijun Wang(王义钧) ,Siying Wu(吴思颖) ,Xiaoyan Sun(孙晓艳) (2025). Enhancing zero-shot brain tumor subtype classification via fine-grained patch-text alignment. Expert Systems with Applications 130161. PDF
Yijun Wang(王义钧) ,Siying Wu(吴思颖) ,Lubin Gan(甘鲁斌) ,Zheyu Zhang(张哲宇) ,Jing Zhang(张静) ,Zhangchi Hu(胡张驰) ,Huyue Zhu(朱胡悦) ,Peixi Wu(吴沛熹) ,Xiaoyan Sun(孙晓艳) (2025). MeDKCoOp: Dual Knowledge-guided Graph Prompt Learning for Biomedical Vision-Language Models. In ACM MM. PDF
Jie Chen(陈杰) ,Zhangchi Hu(胡张驰) ,Peixi Wu(吴沛熹) ,Huyue Zhu(朱胡悦) ,Hebei Li(李和倍) ,Xiaoyan Sun(孙晓艳) (2025). Dash: 4d hash encoding with self-supervised decomposition for real-time dynamic scene rendering. In ICCV. PDF Code
Peixi Wu(吴沛熹) ,Bosong Chai,Menghua Zheng,Wei Li(李蔚) ,Zhangchi Hu(胡张驰) ,Jie Chen(陈杰) ,Zheyu Zhang(张哲宇) ,Hebei Li(李和倍) ,Xiaoyan Sun(孙晓艳) (2025). Efficient spiking point mamba for point cloud analysis. In ICCV. PDF Code
Xinyu Li(李欣羽) ,Chuanbiao Song,Chenqi Zhang,Jun Lan,Huijia Zhu,Weiqiang Wang,Xiaoyan Sun(孙晓艳) (2025). Hybrid Vision Transformer and Convolutional Neural Network for Super-Resolution Image Quality Assessment. In ICCV Workshops. PDF
Yixiao Li,Xin Li,Chris Wei Zhou,Shuo Xing,Hadi Amirpour,Xiaoshuai Hao,Guanghui Yue,Baoquan Zhao,Weide Liu,Xiaoyuan Yang,Zhengzhong Tu,Xinyu Li(李欣羽) ,Chuanbiao Song,Chenqi Zhang,Jun Lan,Huijia Zhu,Weiqiang Wang,Xiaoyan Sun(孙晓艳) ,Shishun Tian,Dongyang Yan,Weixia Zhang,Junlin Chen,Wei Sun,Zhihua Wang,Zhuohang Shi,Zhizun Luo,Hang Ouyang,Tianxin Xiao,Fan Yang,Zhaowang Wu,Kaixin Deng (2025). Vquala 2025 challenge on image super-resolution generated content quality assessment: Methods and results. 2025 IEEE/CVF International Conference on Computer Vision Workshops (ICCVW …. PDF
Zilong He(贺子龙) ,Yijun Pan(潘屹君) ,Hebei Li(李和倍) ,Feipeng Ma(马飞鹏) ,Yansong Peng(彭岩松) ,Siying Wu(吴思颖) ,Xiaoyan Sun(孙晓艳) (2025). Enhancing Visual Question Answering Via Clustered In-Context Sequence Configuration. In ICIP. PDF
Haoyu Wang(王浩宇) ,Jing Zhang(张静) ,Siying Wu(吴思颖) ,Haoran Wei,Xun Chen,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2025). MMSupcon: An image fusion-based multi-modal supervised contrastive method for brain tumor diagnosis. Artificial Intelligence in Medicine.
Lubin Gan(甘鲁斌) ,Xiaoman Wu(吴小满) ,Jing Zhang(张静) ,Zhifeng Wang,Linhao Qu,Siying Wu(吴思颖) ,Xiaoyan Sun(孙晓艳) (2025). Semamil: Semantic reordering with retrieval-guided state space modeling for whole slide image classification. arXiv preprint arXiv:2509.00442.
Wei Li(李蔚) ,Hebei Li(李和倍) ,Yansong Peng(彭岩松) ,Siying Wu(吴思颖) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2025). Create anything anywhere: Layout-controllable personalized diffusion model for multiple subjects. 2025 IEEE International Conference on Multimedia and Expo (ICME), 1-6. PDF
Zheyu Zhang(张哲宇) ,Yayuan Lu,Feipeng Ma(马飞鹏) ,Yueyi Zhang,Huanjing Yue,Xiaoyan Sun(孙晓艳) (2025). Incomplete multi-modal brain tumor segmentation via learnable sorting state space model. In CVPR. PDF
Yansong Peng(彭岩松) ,Hebei Li(李和倍) ,Peixi Wu(吴沛熹) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) ,Feng Wu (2025). D-FINE: Redefine regression task of DETRs as fine-grained distribution refinement. In ICLR. PDF Code
Hebei Li(李和倍) ,Yansong Peng(彭岩松) ,Jiahui Yuan(袁嘉辉) ,Peixi Wu(吴沛熹) ,Jin Wang,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2025). Efficient event-based semantic segmentation via exploiting frame-event fusion: A hybrid neural network approach. In AAAI 39(17). PDF
Dachun Kai(开大纯) ,Yueyi Zhang,Jin Wang,Zeyu Xiao,Zhiwei Xiong,Xiaoyan Sun(孙晓艳) (2025). Event-enhanced blurry video super-resolution. Proceedings of the AAAI Conference on Artificial Intelligence 39 (4), 4175-4183. PDF Code
Peixi Wu(吴沛熹) ,Bosong Chai,Hebei Li(李和倍) ,Menghua Zheng,Yansong Peng(彭岩松) ,Zeyu Wang,Xuan Nie,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2025). Spiking point transformer for point cloud classification. In AAAI 39(20). PDF Code
Yucheng Zhan(占语承) ,Yijun Pan(潘屹君) ,Siying Wu(吴思颖) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2025). Hierarchical Task-aware Temporal Modeling and Matching for few-shot action recognition. Neurocomputing 624, 129467.
Yijun Pan(潘屹君) ,Quan Zhao(赵全) ,Yueyi Zhang,Zilei Wang,Xiaoyan Sun(孙晓艳) ,Feng Wu (2025). Semantic-aware late-stage supervised contrastive learning for fine-grained action recognition. IEEE Transactions on Circuits and Systems for Video Technology 35(6).
Yuheng Jiang(蒋煜恒) ,Hebei Li(李和倍) ,Dachun Kai(开大纯) ,Yansong Peng(彭岩松) ,Jiahui Yuan(袁嘉辉) ,Peilin Xiao(肖霈霖) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2025). Enhancing Visual Tracking by Leveraging High-frequency Information within Event Signals. PDF
Feipeng Ma(马飞鹏) ,Hongwei Xue,Yizhou Zhou,Guangting Wang,Fengyun Rao,Shilin Yan,Yueyi Zhang,Siying Wu(吴思颖) ,Mike Zheng Shou,Xiaoyan Sun(孙晓艳) (2024). Visual perception by large language model’s weights. Advances in Neural Information Processing Systems 37, 28615-28635. PDF Code
Yifan Ma(马一凡) ,Changsheng Gao,Qiaoxi Chen,Li Li,Dong Liu,Xiaoyan Sun(孙晓艳) (2024). Feature compression with 3d sparse convolution. In VCIP.
Rui Mao(毛锐) ,Xinmin Feng,Changsheng Gao,Li Li,Dong Liu,Xiaoyan Sun(孙晓艳) (2024). Perceptual image compression with conditional diffusion transformers. In VCIP.
Haoyu Wang(王浩宇) ,Zheyu Zhang(张哲宇) ,Yueyi Zhang,Jing Zhang(张静) ,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2024). Multi-modal diffusion network with controllable variability for medical image segmentation. In BIBM.
Zeyu Xiao,Dachun Kai(开大纯) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) ,Zhiwei Xiong (2024). Asymmetric event-guided video super-resolution. In ACM MM. PDF
Xuanye Zhang(张璇烨) ,Zhaobin Zhang,Yaojun Wu,Semih Esenlik,Xiaoyan Sun(孙晓艳) ,Kai Zhang,Li Zhang (2024). Optimized decoupled structure with non-local attention for deep image compression. In ICIP.
Quan Zhao(赵全) ,Siying Wu(吴思颖) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2024). Semantic-enhanced point-box joint prompting for video object segmentation. In ICIP.
Zeyu Xiao,Dachun Kai(开大纯) ,Yueyi Zhang,Zheng-Jun Zha,Xiaoyan Sun(孙晓艳) ,Zhiwei Xiong (2024). Event-adapted video super-resolution. European Conference on Computer Vision, 217-235. PDF
Jiahui Yuan(袁嘉辉) ,Hebei Li(李和倍) ,Yansong Peng(彭岩松) ,Jin Wang,Yuheng Jiang(蒋煜恒) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2024). Event-based head pose estimation: Benchmark and method. In ECCV. PDF Code
Feipeng Ma(马飞鹏) ,Yizhou Zhou,Zheyu Zhang(张哲宇) ,Shilin Yan,Hebei Li(李和倍) ,Zilong He(贺子龙) ,Siying Wu(吴思颖) ,Fengyun Rao,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2024). Ee-mllm: A data-efficient and compute-efficient multimodal large language model. arXiv preprint arXiv:2408.11795. PDF
Peilin Xiao(肖霈霖) ,Yueyi Zhang,Dachun Kai(开大纯) ,Yansong Peng(彭岩松) ,Zheyu Zhang(张哲宇) ,Xiaoyan Sun(孙晓艳) (2024). A micro-expression recognition system with event cameras. In ICMEW.
Peilin Xiao(肖霈霖) ,Yueyi Zhang,Dachun Kai(开大纯) ,Yansong Peng(彭岩松) ,Zheyu Zhang(张哲宇) ,Xiaoyan Sun(孙晓艳) (2024). Estme: Event-driven spatio-temporal motion enhancement for micro-expression recognition. In ICME. PDF
Yan-Ran Joyce Wang,Pengcheng Wang,Zihan Yan,Quan Zhou,Fatma Gunturkun,Peng Li,Yanshen Hu,Wei Emma Wu,Kankan Zhao,Michael Zhang,Haoyi Lv,Lehao Fu,Jiajie Jin,Qing Du,Haoyu Wang(王浩宇) ,Kun Chen,Liangqiong Qu,Keldon Lin,Michael Iv,Hao Wang,Xiaoyan Sun(孙晓艳) ,Hannes Vogel,Summer Han,Lu Tian,Feng Wu,Jian Gong (2024). Advancing presurgical non-invasive molecular subgroup prediction in medulloblastoma using artificial intelligence and MRI signatures. Cancer Cell 42(7): 1239-1257.e7. PDF
Feipeng Ma(马飞鹏) ,Yizhou Zhou,Yueyi Zhang,Siying Wu(吴思颖) ,Zheyu Zhang(张哲宇) ,Zilong He(贺子龙) ,Fengyun Rao,Xiaoyan Sun(孙晓艳) (2024). Task navigator: Decomposing complex tasks for multimodal large language models. In CVPR. PDF
Hebei Li(李和倍) ,Jin Wang,Jiahui Yuan(袁嘉辉) ,Yue Li,Wenming Weng,Yansong Peng(彭岩松) ,Yueyi Zhang,Zhiwei Xiong,Xiaoyan Sun(孙晓艳) (2024). Event-assisted low-light video object segmentation. In CVPR. PDF
Yanhui Wang,Jianmin Bao,Wenming Weng,Ruoyu Feng,Dacheng Yin,Tao Yang,Jingxu Zhang(张景旭) ,Qi Dai,Zhiyuan Zhao,Chunyu Wang,Kai Qiu,Yuhui Yuan,Xiaoyan Sun(孙晓艳) ,Chong Luo,Baining Guo (2024). Microcinema: A divide-and-conquer approach for text-to-video generation. In CVPR. PDF
Yansong Peng(彭岩松) ,Hebei Li(李和倍) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) ,Feng Wu (2024). Scene adaptive sparse transformer for event-based object detection. In CVPR. PDF Code
Hebei Li(李和倍) ,Yueyi Zhang,Zhiwei Xiong,Xiaoyan Sun(孙晓艳) (2024). Deep multi-threshold spiking-UNet for image processing. Neurocomputing 586, 127653. PDF
Feipeng Ma(马飞鹏) ,Hongwei Xue,Guangting Wang,Yizhou Zhou,Fengyun Rao,Shilin Yan,Yueyi Zhang,Siying Wu(吴思颖) ,Mike Zheng Shou,Xiaoyan Sun(孙晓艳) (2024). Multi-modal generative embedding model. arXiv preprint arXiv:2405.19333. PDF
Yayuan Lu,Zheyu Zhang(张哲宇) ,Yueyi Zhang,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2024). Semi-supervised medical image segmentation via dynamic pseudo-label refinement. In ISBI.
Qianqian Zhang(张乾乾) ,Yueyi Zhang,Ning Liu,Xiaoyan Sun(孙晓艳) (2024). Understanding of facial features in face perception: insights from deep convolutional neural networks. Frontiers in Computational Neuroscience 18, 1209082. PDF Code
Feipeng Ma(马飞鹏) ,Yizhou Zhou,Fengyun Rao,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2024). Image captioning with multi-context synthetic data. In AAAI. PDF Code
Zheyu Zhang(张哲宇) ,Gang Yang,Yueyi Zhang,Huanjing Yue,Aiping Liu,Yunwei Ou,Jian Gong,Xiaoyan Sun(孙晓艳) (2024). Tmformer: Token merging transformer for brain tumor segmentation with missing modalities. In AAAI. PDF
Zheyu Zhang(张哲宇) ,Xinzhao Liu,Zheng Chen(陈政) ,Yueyi Zhang,Huanjing Yue,Yunwei Ou,Xiaoyan Sun(孙晓艳) (2024). Anatomical consistency distillation and inconsistency synthesis for brain tumor segmentation with missing modalities. In ECAI. PDF
Yuqing Wen(文昱晴) ,Yucheng Zhao,Yingfei Liu,Fan Jia,Yanhui Wang,Chong Luo,Chi Zhang,Tiancai Wang,Xiaoyan Sun(孙晓艳) ,Xiangyu Zhang (2024). Panacea: Panoramic and controllable video generation for autonomous driving. In CVPR. PDF Code
Yucheng Zhan(占语承) ,Yucheng Zhao,Chong Luo,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2023). Attention-guided contrastive masked image modeling for transformer-based self-supervised learning. In ICIP.
Dachun Kai(开大纯) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2023). Video super-resolution via event-driven temporal alignment. In ICIP. PDF
Dong She(佘栋) ,Yueyi Zhang,Zheyu Zhang(张哲宇) ,Hebei Li(李和倍) ,Zihan Yan,Xiaoyan Sun(孙晓艳) (2023). Eoformer: Edge-oriented transformer for brain tumor segmentation. In MICCAI. PDF Code
Yansong Peng(彭岩松) ,Yueyi Zhang,Zhiwei Xiong,Xiaoyan Sun(孙晓艳) ,Feng Wu (2023). Get: Group event transformer for event-based vision. In ICCV. PDF Code
Yanchen Zuo(左延辰) ,Changsheng Gao,Dong Liu,Li Li,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2023). Learned rate-distortion cost prediction for ultrafast screen content intra coding. IEEE Transactions on Circuits and Systems for Video Technology 34(3).
Feipeng Ma(马飞鹏) ,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2023). Multimodal sentiment analysis with preferential fusion and distance-aware contrastive learning. In ICME. Code
Yansong Peng(彭岩松) ,Yueyi Zhang,Peilin Xiao(肖霈霖) ,Xiaoyan Sun(孙晓艳) ,Feng Wu (2023). Better and faster: Adaptive event conversion for event-based object detection. In AAAI. PDF
Hebei Li(李和倍) ,Yueyi Zhang,Zhiwei Xiong,Zheng-jun Zha,Xiaoyan Sun(孙晓艳) (2023). Deep spiking-unet for image processing. arXiv preprint arXiv:2307.10974.
Feipeng Ma(马飞鹏) ,Yizhou Zhou,Fengyun Rao,Yueyi Zhang,Xiaoyan Sun(孙晓艳) (2023). Text-Only Image Captioning with Multi-Context Data Generation.. arXiv preprint arXiv:2305.18072.
C Wang,S Min,X Chen,Xiaoyan Sun(孙晓艳) ,Hebei Li(李和倍) (2021). Dual progressive prototype network for generalized zero-shot learning. Advances in NeurIPS 34. Code
C Wang,X Chen,S Min,Xiaoyan Sun(孙晓艳) ,Hebei Li(李和倍) (2021). Task-independent knowledge makes for transferable representations for generalized zero-shot learning. In AAAI.
Siying Wu(吴思颖) ,C Chen,Z Xiong,X Chen,Xiaoyan Sun(孙晓艳) (2021). Uncertainty-aware label rectification for domain adaptive mitochondria segmentation. In MICCAI. Code
Yang Zhou(周洋) ,C Luo,Xiaoyan Sun(孙晓艳) ,ZJ Zha,W Zeng (2021). VAE^ 2: Preventing Posterior Collapse of Variational Video Predictions in the Wild. arXiv preprint arXiv:2101.12050. Code
Yijun Pan(潘屹君) ,Xiaoyan Sun(孙晓艳) ,F Wu (2020). Enriching optical flow with appearance information for action recognition. In VCIP.
Yang Zhou(周洋) ,Xiaoyan Sun(孙晓艳) ,C Luo,ZJ Zha,W Zeng (2020). Posterior-guided neural architecture search. In AAAI. Code
Yang Zhou(周洋) ,Xiaoyan Sun(孙晓艳) ,C Luo,ZJ Zha,W Zeng (2020). Spatiotemporal fusion in 3D CNNs: A probabilistic view. In CVPR. Code