![]() | EgoSound: Benchmarking Sound Understanding in Egocentric VideosIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026 Bingwen Zhu*, Yuqian Fu*, Qiaole Dong, Guolei Sun, Tianwen Qian, Yuzheng Wu, Danda Pani Paudel, Yanwei Fu, Xiangyang Xue [paper] [code] [Highlight] |
Publications
You can also find my articles on my Google Scholar profile.
* Equal contribution
![]() | EgoNight: Towards Egocentric Vision Understanding at Night with a Challenging BenchmarkInternational Conference on Learning Representations (ICLR), 2026 Deheng Zhang*, Yuqian Fu*, Runyi Yang, Yang Miao, Tianwen Qian, Xu Zheng, Guolei Sun, Ajad Chhatkuli, Xuanjing Huang, Yu-Gang Jiang, Luc Van Gool, Danda Pani Paudel [paper] [code] |
![]() | CamSAM2: Segment Anything Accurately in Camouflaged VideosAdvances in Neural Information Processing Systems (NeurIPS), 2025 Yuli Zhou, Yawei Li, Yuqian Fu, Luca Benini, Ender Konukoglu, Guolei Sun [paper] [code] |
![]() | XTrack: Multimodal Training Boosts RGB-X Video Object TrackersInternational Conference on Computer Vision (ICCV), 2025 Yuedong Tan, Zongwei Wu, Yuqian Fu, Zhuyun Zhou, Guolei Sun, Eduard Zamfir, Chao Ma, Danda Pani Paudel, Luc Van Gool, Radu Timofte [paper] [code] |
![]() | ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric PerspectivesInternational Conference on Computer Vision (ICCV), 2025 Yuqian Fu, Runze Wang, Bin Ren, Guolei Sun, Biao Gong, Yanwei Fu, Danda Pani Paudel, Xuanjing Huang, Luc Van Gool [paper] [code] [Highlight] |
![]() | Generalized Few-shot 3D Point Cloud Segmentation with Vision-Language ModelIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2025 Zhaochong An, Guolei Sun, Yun Liu, Runjia Li, Junlin Han, Ender Konukoglu, Serge Belongie [paper] [code] |
![]() | Multimodality Helps Few-shot 3D Point Cloud Semantic SegmentationInternational Conference on Learning Representations (ICLR), 2025 Zhaochong An, Guolei Sun, Yun Liu, Runjia Li, Min Wu, Ming-Ming Cheng, Ender Konukoglu, Serge Belongie [paper] [code] [Spotlight] |
![]() | Towards Open-Vocabulary Video Semantic SegmentationIEEE Transactions on Multimedia (TMM), 2025 Xinhao Li, Yun Liu, Guolei Sun, Min Wu, Le Zhang, Ce Zhu [paper] [code] |
![]() | Indiscernible Object Counting in Underwater ScenesIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023 Guolei Sun, Zhaochong An, Yun Liu, Ce Liu, Christos Sakaridis, Deng-Ping Fan, Luc Van Gool [paper] [code] |
![]() | Edge Guided GANs with Multi-Scale Contrastive Learning for Semantic Image SynthesisIEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2023 Hao Tang, Guolei Sun, Nicu Sebe, Luc Van Gool [paper] [code] |
![]() | Mining Relations among Cross-Frame Affinities for Video Semantic SegmentationEuropean Conference on Computer Vision (ECCV), 2022 Guolei Sun, Yun Liu, Hao Tang, Ajad Chhatkuli, Le Zhang, Luc Van Gool [paper] [code] |
![]() | Coarse-to-Fine Feature Mining for Video Semantic SegmentationIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022 Guolei Sun, Yun Liu, Henghui Ding, Thomas Probst, Luc Van Gool [paper] [code] |
![]() | Looking Beyond Single Images for Weakly Supervised Semantic Segmentation LearningIEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2022 Wenguan Wang, Guolei Sun, Luc Van Gool [paper] [code] |
![]() | SwinIR: Image Restoration using Swin TransformerInternational Conference on Computer Vision Workshop (ICCVW), 2021 Jingyun Liang, Jiezhang Cao, Guolei Sun, Kai Zhang, Luc Van Gool, Radu Timofte [paper] [code] |
![]() | Task Switching Network for Multi-task LearningInternational Conference on Computer Vision (ICCV), 2021 Guolei Sun, Thomas Probst, Danda Pani Paudel, Nikola Popović, Menelaos Kanakis, Jagruti Patel, Dengxin Dai, Luc Van Gool [paper] [code] |
![]() | Mutual Affine Network for Spatially Variant Kernel Estimation in Blind Image Super-resolutionInternational Conference on Computer Vision (ICCV), 2021 Jingyun Liang, Guolei Sun, Kai Zhang, Luc Van Gool, Radu Timofte [paper] [code] |
![]() | CompositeTasking: Understanding Images by Spatial Composition of TasksIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2021 Nikola Popovic, Danda Pani Paudel, Thomas Probst, Guolei Sun, Luc Van Gool [paper] [code] |
![]() | Towards Partial Supervision for Generic Object Counting in Natural ScenesIEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2020 Hisham Cholakkal*, Guolei Sun*, Salman Khan, Fahad Shahbaz Khan, Ling Shao, Luc Van Gool [paper] [code] |
![]() | Mining Cross-image Semantics for Weakly Supervised Semantic SegmentationEuropean Conference on Computer Vision (ECCV), 2020 Guolei Sun, Wenguan Wang, Jifeng Dai, Luc Van Gool [paper] [code] [Oral, acceptance rate: 2%] |
![]() | Fixing Localization Errors to Improve Image ClassificationEuropean Conference on Computer Vision (ECCV), 2020 Guolei Sun*, Salman Khan*, Wen Li, Hisham Cholakkal, Fahad Shahbaz, Luc Van Gool [paper] [code] |
![]() | Camouflaged Object DetectionIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2020 Deng-Ping Fan, Ge-Peng Ji, Guolei Sun, Ming-Ming Cheng, Jianbing Shen, Ling Shao [paper] [code] [Oral, acceptance rate: 6%] |
![]() | Fine-grained Recognition: Accounting for Subtle Differences between Similar ClassesAAAI Conference on Artificial Intelligence (AAAI), 2020 Guolei Sun, Hisham Cholakkal, Salman Khan, Fahad Shahbaz Khan, Ling Shao [paper] [code] |
![]() | Object Counting and Instance Segmentation with Image-level SupervisionIEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2019 Hisham Cholakkal*, Guolei Sun*, Fahad Shahbaz Khan, Ling Shao [paper] [code] |
![]() | isaid: A Large-scale Dataset for Instance Segmentation in Aerial ImagesIEEE Conference on Computer Vision and Pattern Recognition Workshop (CVPRW), 2019 Syed Waqas Zamir, Aditya Arora, Akshita Gupta, Salman Khan, Guolei Sun, Fahad Shahbaz Khan, Fan Zhu, Ling Shao, Gui-Song Xia, Xiang Bai [paper] [code] [MMSeg] |
























