Google Scholar Profile & DBLP Profile & ORCID: 0000-0001-6732-7823 & WebOfScience & arXiv

Source codes of some publications are available on Github

# indicates equal contribution and * indicates corresponding author

Major Journal & Conference Papers

    Year 2026

  1. Huangxuan Zhao*, Yaowei Bai, Lei Chen, Jinqiang Ma, ..., Xuefeng Kan*, Chengcheng Zhu*, Bo Du*, Xinggang Wang*, Chuansheng Zheng*. Generative AI-based low-dose digital subtraction angiography for intra-operative radiation dose reduction: a randomized controlled trial. Nature Medicine, 2026. DOI: 10.1038/s41591-025-04042-6.

  2. Hong Cao#, Yueting Zhu#, Tao Li, Ji Chen, Jiahua He, Xinggang Wang*, Sheng-You Huang*. EMReady2: improvement of cryo-EM and cryo-ET maps by local quality-aware deep learning with Mamba. Nature Communications, 2026. DOI: 10.1038/s41467-026-71794-1.

  3. Lianghui Zhu, Yingyue Li, Jiemin Fang, Yan Liu, Xin Hao, Wenyu Liu, Xinggang Wang. WeakTr: Exploring Plain Vision Transformer for Weakly-Supervised Semantic Segmentation. IEEE Transactions on Image Processing (IEEE TIP), vol. 35, pp. 4425-4439, 2026. pdf, code.

  4. Jia Lu, Taoran Yi, Jiemin Fang, Chen Yang, Chuiyun Wu, Wei Shen, Wenyu Liu, Qi Tian, Xinggang Wang. Snap-Snap: Taking Two Images to Reconstruct 3D Human Gaussians in Milliseconds. IEEE Transactions on Circuits and Systems for Video Technology (IEEE TCSVT), 2026, doi: 10.1109/TCSVT.2026.3701298. pdf, project page, code.

  5. Yuxuan Zhang, Tianheng Cheng, Lianghui Zhu, Rui Hu, Lei Liu, Heng Liu, Longjin Ran, Xiaoxin Chen, Wenyu Liu, Xinggang Wang. EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model. Image and Vision Computing, Volume 173, 106028, 2026. pdf.

  6. Bo Jiang, Shaoyu Chen, Hao Gao, Bencheng Liao, Qian Zhang, Wenyu Liu, Xinggang Wang. VADv2: End-to-End Autonomous Driving via Probabilistic Planning. International Conference on Learning Representations (ICLR) 2026. pdf, code.

  7. Yongkang Li, Kaixin Xiong, Xiangyu Guo, Fang Li, Sixu Yan, Gangwei Xu, Lijun Zhou, Long Chen, Haiyang Sun, Bing Wang, Kun Ma, Guang Chen, Hangjun Ye, Wenyu Liu, Xinggang Wang. ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving. International Conference on Learning Representations (ICLR) 2026. pdf, code.

  8. Yiyang Cao, Yunze Deng, Ziyu Lin, Bin Feng, Xinggang Wang, Wenyu Liu, DanDan Zheng, Jingdong Chen. TriC-Motion: Tri-Domain Causal Modeling Grounded Text-to-Motion Generation. International Conference on Learning Representations (ICLR) 2026. pdf.

  9. Wenrui Zhang, Xinggang Wang, Bin Feng, Wenyu Liu. MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement Learning. AAAI Conference on Artificial Intelligence (AAAI) 2026. pdf, code.

  10. Ya Zou, Jingfeng Yao, Siyuan Yu, Shuai Zhang, Wenyu Liu, Xinggang Wang. Turbo-VAED: Fast and Stable Transfer of Video-VAEs to Mobile Devices. AAAI Conference on Artificial Intelligence (AAAI) 2026. pdf, code.

  11. Lianghui Zhu, Bin Ouyang, Yuxuan Zhang, Tianheng Cheng, Rui Hu, Haocheng Shen, Longjin Ran, Xiaoxin Chen, Li Yu, Wenyu Liu, Xinggang Wang. LENS: Learning to Segment Anything with Unified Reinforced Reasoning. AAAI Conference on Artificial Intelligence (AAAI) 2026 (Oral). arxiv, code, project page.

  12. Jingfeng Yao, Yuda Song, Yucong Zhou, Xinggang Wang. Towards Scalable Pre-training of Visual Tokenizers for Generation. European Conference on Computer Vision (ECCV) 2026. pdf, code.

  13. Lunbin Zeng, Jingfeng Yao, Bencheng Liao, Hongyuan Tao, Wenyu Liu, Xinggang Wang. DiffusionVL: Translating Any Autoregressive Models into Diffusion Vision Language Models. European Conference on Computer Vision (ECCV) 2026. pdf, code.

  14. Kangsheng Duan, Ziyang Xu, Wenyu Liu, Xiaohu Ruan, Xiaoxin Chen, Xinggang Wang. Moebius: 0.2B Lightweight Image Inpainting Framework with 10B-Level Performance. European Conference on Computer Vision (ECCV) 2026. pdf, code, project page.

  15. Jialv Zou, Bencheng Liao, Qian Zhang, Wenyu Liu, Xinggang Wang. OmniMamba: Efficient and Unified Multimodal Understanding and Generation via State Space Models. European Conference on Computer Vision (ECCV) 2026. pdf, code.

  16. Tianze Xia, Yongkang Li, Lijun Zhou, Jingfeng Yao, Kaixin Xiong, Haiyang Sun, Bing Wang, Kun Ma, Guang Chen, Hangjun Ye, Wenyu Liu, Xinggang Wang. DriveLaW: Unifying Planning and Video Generation in a Latent Driving World. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026. pdf, code.

  17. Zongming Li, Lianghui Zhu, Haocheng Shen, Longjin Ran, Wenyu Liu, Xinggang Wang. TransLight: Image-Guided Customized Lighting Control with Generative Decoupling. International Conference on Machine Learning (ICML) 2026. pdf, project page.


  18. Year 2025

  19. Tianheng Cheng, Xinggang Wang, Junchao Liao, Wenyu Liu. Cross-Layer Attentive Feature Upsampling for Low-latency Semantic Segmentation. Machine Vision and Applications, 36, 18, 2025. DOI: 10.1007/s00138-024-01631-2.

  20. Sixu Yan, Zeyu Zhang, Muzhi Han, Zaijin Wang, Qi Xie, Zhitian Li, Zhehan Li, Hangxin Liu*, Xinggang Wang*, Song-Chun Zhu. M2Diffuser: Diffusion-based Trajectory Optimization for Mobile Manipulation in 3D Scenes. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), 2025. DOI: 10.1109/TPAMI.2025.3553454, pdf.

  21. Bencheng Liao, Shaoyu Chen, Yunchi Zhang, Bo Jiang, Qian Zhang, Wenyu Liu, Chang Huang, Xinggang Wang. MapTRv2: An End-to-End Framework for Online Vectorized HD Map Construction. International Journal of Computer Vision (IJCV) Volume 133, pages 1352–1374, (2025). DOI: 10.1007/s11263-024-02235-z, pdf, code.

  22. Jialv Zou, Bencheng Liao, Qian Zhang, Wenyu Liu, Xinggang Wang*. MIM4D: Masked Modeling with Multi-View Video for Autonomous Driving Representation Learning. International Journal of Computer Vision (IJCV) Volume 133, pages 6074–6087, (2025). DOI: 10.1007/s11263-025-02464-w, code.

  23. Lianghui Zhu, Xinggang Wang, Jiapei Feng, Tianheng Cheng, Yingyue Li, Bo Jiang, Dingwen Zhang, Junwei Han. WeakCLIP: Adapting CLIP for Weakly-Supervised Semantic Segmentation. International Journal of Computer Vision (IJCV) Volume 133, pages 1085–1105, (2025). DOI: 10.1007/s11263-024-02224-2, pdf, code.

  24. Hao Gao, Shaoyu Chen, Bo Jiang, Bencheng Liao, Yiang Shi, Xiaoyang Guo, Yuechuan Pu, Haoran Yin, Xiangyu Li, Xinbang Zhang, Ying Zhang, Wenyu Liu, Qian Zhang, Xinggang Wang. RAD: Training an End-to-End Driving Policy via Large-Scale 3DGS-based Reinforcement Learning. Conference on Neural Information Processing Systems (NeurIPS) 2025. pdf, website.

  25. Xiangyu Guo, Zhanqian Wu, Kaixin Xiong, Ziyang Xu, Lijun Zhou, Gangwei Xu, Shaoqing Xu, Haiyang Sun, Bing Wang, Guang Chen, Hangjun Ye, Wenyu Liu, Xinggang Wang. Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency. Conference on Neural Information Processing Systems (NeurIPS) 2025. pdf.

  26. Weiheng Zhao, Zilong Huang, Jiashi Feng, Xinggang Wang. SuperCLIP: CLIP with Simple Classification Supervision. Conference on Neural Information Processing Systems (NeurIPS) 2025. pdf.

  27. Shuai Zhang, Guanjun Wu, Xinggang Wang, Bin Feng, Wenyu Liu. Dynamic 2D Gaussians: Geometrically accurate radiance fields for dynamic objects. ACM International Conference on Multimedia (ACM MM) 2025. pdf, code.

  28. Yingyue Li, Bencheng Liao, Wenyu Liu, Xinggang Wang. MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling. IEEE International Conference on Computer Vision (ICCV) 2025. code, pdf.

  29. Rui Hu, Lianghui Zhu, Yuxuan Zhang, Tianheng Cheng, Lei Liu, Heng Liu, Longjin Ran, Xiaoxin Chen, Wenyu Liu, Xinggang Wang. GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding. IEEE International Conference on Computer Vision (ICCV) 2025. code, pdf.

  30. Bencheng Liao, Shaoyu Chen, Haoran Yin, Bo Jiang, Cheng Wang, Sixu Yan, Xinbang Zhang, Xiangyu Li, Ying Zhang, Qian Zhang, Xinggang Wang. DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025. pdf, code.

  31. Yongkang Li, Tianheng Cheng, Bin Feng, Wenyu Liu, Xinggang Wang. Mask-Adapter: The Devil is in the Masks for Open-Vocabulary Segmentation. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025, highlight paper. pdf, code.

  32. Jingfeng Yao, Bin Yang, Xinggang Wang. Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025, oral paper. pdf, code.

  33. Haoyi Jiang, Liu Liu, Tianheng Cheng, Xinjie Wang, Tianwei Lin, Zhizhong Su, Wenyu Liu, Xinggang Wang. GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025. pdf, code.

  34. Lianghui Zhu, Zilong Huang, Bencheng Liao, Jun Hao Liew, Hanshu Yan, Jiashi Feng, Xinggang Wang. DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025. pdf, code.

  35. Bencheng Liao, Xinggang Wang, Lianghui Zhu, Qian Zhang, Chang Huang. ViG: Linear-complexity Visual Sequence Learning with Gated Linear Attention. AAAI Conference on Artificial Intelligence (AAAI) 2025. pdf, code.

  36. Ziyang Xu, Huangxuan Zhao, Wenyu Liu, Xinggang Wang. GaraMoSt: Parallel Multi-Granularity Motion and Structural Modeling for Efficient Multi-Frame Interpolation in DSA Images. AAAI Conference on Artificial Intelligence (AAAI) 2025. pdf, code.

  37. Zongming Li, Tianheng Cheng, Shoufa Chen, Peize Sun, Haocheng Shen, Longjin Ran, Xiaoxin Chen, Wenyu Liu, Xinggang Wang. ControlAR: Controllable Image Generation with Autoregressive Models. International Conference on Learning Representations (ICLR) 2025. pdf, code.

  38. Lianghui Zhu, Xinggang Wang, Xinlong Wang. JudgeLM: Fine-tuned Large Language Models are Scalable Judges. International Conference on Learning Representations (ICLR) 2025 Spotlight. pdf, code.

  39. Zeyu Zhang, Sixu Yan, Muzhi Han, Zaijin Wang, Xinggang Wang, Song-Chun Zhu, Hangxin Liu. M3 Bench: Benchmarking Whole-Body Motion Generation for Mobile Manipulation in 3D Scenes. IEEE Robotics and Automation Letters (RA-L), 2025.

  40. Shaoyu Chen, Xinggang Wang, Tianheng Cheng, Qian Zhang, Chang Huang, Wenyu Liu. PolarDETR: Polar Parametrization for vision-based surround-view 3D detection. Image and Vision Computing, Volume 156, 2025, 105438.

  41. Bin Hu, Xinggang Wang, Wenyu Liu. Personvit: Large-scale Self-supervised Vision Transformer for Person Re-identification. Machine Vision and Applications, Volume 36, Number 2, pages 1–13, 2025.

  42. Huangxuan Zhao#, Ziyang Xu#, Lei Chen#, Linxia Wu#, Ziwei Cui, ..., Wenyu Liu, Xuefeng Kan*, Ruisheng Su*, Weihua Zhang*, Xinggang Wang*, Chuansheng Zheng*. Large-scale pretrained frame generative model enables real-time low-dose DSA imaging: An AI system development and multi-center validation study. Med, Volume 6, Number 1, 2025. DOI: 10.1016/j.medj.2024.07.025, code.

  43. Jingfeng Yao, Xinggang Wang, Yuehao Song, Huangxuan Zhao, Jun Ma, Yajie Chen, Wenyu Liu & Bo Wang. EVA-X: a foundation model for general chest x-ray analysis with self-supervised learning. npj Digital Medicine volume 8, Article number: 678 (2025), Published: 17 November 2025. PDF, Code.

  44. Zelin Liu, Xinggang Wang*, Cheng Wang, Wenyu Liu, Xiang Bai. SparseTrack: Multi-Object Tracking by Performing Scene Decomposition Based on Pseudo-Depth. IEEE Transactions on Circuits and Systems for Video Technology (IEEE TCSVT), Volume 35, Issue 5, pages 4870–4882, 2025. DOI: 10.1109/TCSVT.2024.3524670, pdf, code.


  45. Year 2024

  46. Yuehao Song, Xinggang Wang*, Jingfeng Yao, Wenyu Liu, Jinglin Zhang, Xiangmin Xu. ViTGaze: Gaze Following with Interaction Features in Vision Transformers. Visual Intelligence, Volume 2, Number 31, 2024. DOI: 10.1007/s44267-024-00064-9.

  47. Jingfeng Yao, Cheng Wang, Wenyu Liu, Xinggang Wang*. FasterDiT: Towards Faster Diffusion Transformers Training without Architecture Modification. Conference on Neural Information Processing Systems (NeurIPS) 2024. pdf.

  48. Yuxin Fang, Quan Sun, Xinggang Wang, Tiejun Huang, Xinlong Wang, Yue Cao. EVA-02: A visual representation for neon genesis. Image and Vision Computing, Volume 149, 2024, 105171. DOI: 10.1016/j.imavis.2024.105171, pdf, code.

  49. Tianheng Cheng, Haoyi Jiang, Shaoyu Chen, Bencheng Liao, Qian Zhang, Wenyu Liu, Xinggang Wang. Learning accurate monocular 3D voxel representation via bilateral voxel transformer. Image and Vision Computing, Volume 150, 2024, 105237. DOI: 10.1016/j.imavis.2024.105237, code.

  50. Bencheng Liao, Shaoyu Chen, Bo Jiang, Tianheng Cheng, Qian Zhang, Wenyu Liu, Chang Huang, Xinggang Wang*. Lane Graph as Path: Continuity-preserving Path-wise Modeling for Online Lane Graph Construction. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  51. Yiang Shi, Tianheng Cheng, Qian Zhang, Wenyu Liu, Xinggang Wang*. Occupancy as Set of Points. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  52. Lianjun Wu, Jiangxiao Han, Zengqiang Zheng, Xinggang Wang*. Co-Student: Collaborating Strong and Weak Students for Sparsely Annotated Object Detection. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  53. Yabo Chen, Jiemin Fang, Yuyang Huang, Taoran Yi, Xiaopeng Zhang, Lingxi Xie, Xinggang Wang, Wenrui Dai, Hongkai Xiong, Qi Tian. Cascade-Zero123: One Image to Highly Consistent 3D with Self-Prompted Nearby Views. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  54. Yuanzhi Zhu, Jiawei Liu, Feiyu Gao, Wenyu Liu, Xinggang Wang, Peng Wang, Fei Huang, Cong Yao, Zhibo Yang. Visual Text Generation in the Wild. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  55. Xiayu Wang, Ke Ma, Ruiyun Zhong, Xinggang Wang, Yi Fang, Yang Xiao, Tian Xia. Towards Dual Transparent Liquid Level Estimation in Biomedical Lab: Dataset, Methods and Practice. European Conference on Computer Vision (ECCV) 2024. pdf, code.

  56. Haijun Xiong, Bin Feng, Xinggang Wang, Wenyu Liu. Causality-inspired Discriminative Feature Learning in Triple Domains for Gait Recognition. European Conference on Computer Vision (ECCV) 2024. pdf.

  57. Lianghui Zhu, Junwei Zhou, Yan Liu, Xin Hao, Wenyu Liu, Xinggang Wang*. WeakSAM: Segment Anything Meets Weakly-supervised Instance-level Recognition. ACM International Conference on Multimedia (ACM MM) 2024. pdf, code.

  58. Ziyang Xu, Huangxuan Zhao, Ziwei Cui, Wenyu Liu, Chuansheng Zheng, Xinggang Wang. MoSt-DSA: Modeling Motion and Structural Interactions for Direct Multi-Frame Interpolation in DSA Images. European Conference on Artificial Intelligence (ECAI) 2024. pdf, code.

  59. Jingfeng Yao, Xinggang Wang, Lang Ye, Wenyu Liu. Matte anything: Interactive natural image matting with segment anything model. Image and Vision Computing, Volume 147, July 2024, 105067. pdf, code.

  60. Lang Ye, Xinggang Wang*, Jingfeng Yao, Wenyu Liu. Transgaze: exploring plain vision transformers for gaze estimation. Machine Vision and Applications, Volume 35, 128 (2024). DOI: 10.1007/s00138-024-01609-0.

  61. Cheng Wang, Guoli Wang, Qian Zhang, Peng Guo, Wenyu Liu, Xinggang Wang. Openinst: A simple query-based method for open-world instance segmentation. Pattern Recognition, Volume 153, September 2024, 110570. pdf, code.

  62. Xingsheng Zhou, Cheng Wang, Xinggang Wang*, Wenyu Liu. Video text tracking with transformer-based local search. Neurocomputing, Volume 609, 15 September 2024, 128420. DOI: 10.1016/j.neucom.2024.128420.

  63. Lianghui Zhu, Bencheng Liao, Qian Zhang, Xinlong Wang, Wenyu Liu, Xinggang Wang*. Vision mamba: Efficient visual representation learning with bidirectional state space model. International Conference on Machine Learning (ICML) 2024. pdf, code.

  64. Guanjun Wu, Taoran Yi, Jiemin Fang, Lingxi Xie, Xiaopeng Zhang, Wei Wei, Wenyu Liu, Qi Tian, Xinggang Wang*. 4d gaussian splatting for real-time dynamic scene rendering. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024. pdf, code.

  65. Taoran Yi, Jiemin Fang, Guanjun Wu, Lingxi Xie, Xiaopeng Zhang, Wenyu Liu, Qi Tian, Xinggang Wang*. Gaussiandreamer: Fast generation from text to 3d gaussian splatting with point cloud priors. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024. pdf, code.

  66. Haoyi Jiang, Tianheng Cheng, Naiyu Gao, Haoyang Zhang, Wenyu Liu, Xinggang Wang. Symphonize 3d semantic scene completion with contextual instance queries. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024. pdf, code.

  67. Tianheng Cheng, Lin Song, Yixiao Ge, Wenyu Liu, Xinggang Wang, Ying Shan. YOLO-World: Real-Time Open-Vocabulary Object Detection. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024. pdf, code.

  68. Renhong Zhang, Tianheng Cheng, Shusheng Yang, Haoyi Jiang, Shuai Zhang, Jiancheng Lyu, Xin Li, Xiaowen Ying, Dashan Gao, Wenyu Liu, Xinggang Wang*. Mobileinst: Video instance segmentation on the mobile. AAAI Conference on Artificial Intelligence (AAAI) 2024. pdf.

  69. Jingfeng Yao, Xinggang Wang*, Shusheng Yang, Baoyuan Wang. ViTMatte: Boosting image matting with pre-trained plain vision transformers. Information Fusion, Volume 103, March 2024, 102091, DOI: 10.1016/j.inffus.2023.102091. pdf, code.

  70. Zhenyang Hao, Xinggang Wang*, Jiawei Liu, Zhihang Yuan, Dawei Yang, Wenyu Liu. Stabilized activation scale estimation for precise Post-Training Quantization. Neurocomputing, Volume 569, 7 February 2024, 127120, DOI: 10.1016/j.neucom.2023.127120. pdf, code.

  71. Guanjun Wu, Taoran Yi, Jiemin Fang, Wenyu Liu, Xinggang Wang. Fast High Dynamic Range Radiance Fields for Dynamic Scenes. International Conference on 3D Vision (3DV) 2024, pp. 862-872. pdf, code.


  72. Year 2023

  73. Yuxin Fang, Xinggang Wang*, Rui Wu, Wenyu Liu. What Makes for Hierarchical Vision Transformer?. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), Volume: 45, Issue: 10, October 2023, DOI: 10.1109/TPAMI.2023.3282019. pdf, code

  74. Yifu Zhang, Chunyu Wang, Xinggang Wang, Wenjun Zeng, Wenyu Liu. VoxelTrack: Multi-Person 3D Human Pose Estimation and Tracking in the Wild. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), Volume: 45, Issue: 2, 01 February 2023, DOI: 10.1109/TPAMI.2023.3282019. pdf

  75. Jialv Zou, Xinggang Wang*, Jiahao Guo, Wenyu Liu, Qian Zhang, Chang Huang. Circuit as Set of Points. Conference on Neural Information Processing Systems (NeurIPS) 2023. pdf, code.

  76. Bo Jiang, Shaoyu Chen, Qing Xu, Bencheng Liao, Jiajie Chen, Helong Zhou, Qian Zhang, Wenyu Liu, Chang Huang, Xinggang Wang*. VAD: Vectorized Scene Representation for Efficient Autonomous Driving. IEEE International Conference on Computer Vision (ICCV) 2023. pdf, code.

  77. Yuxin Fang, Shusheng Yang, Shijie Wang, Yixiao Ge, Ying Shan, Xinggang Wang*. Unleashing Vanilla Vision Transformer with Masked Image Modeling for Object Detection. IEEE International Conference on Computer Vision (ICCV) 2023. pdf, code.

  78. Ruiqi Wang, Xinggang Wang, Te Li, Rong Yang, Minhong Wan, Wenyu Liu. Query6DoF: Learning Sparse Queries as Implicit Shape Prior for Category-Level 6DoF Pose Estimation. IEEE International Conference on Computer Vision (ICCV) 2023. pdf, code.

  79. Kan Wu, Houwen Peng, Zhenghong Zhou, Bin Xiao, Mengchen Liu, Lu Yuan, Hong Xuan, Michael Valenzuela, Xi (Stephen) Chen, Xinggang Wang, Hongyang Chao, Han Hu. TinyCLIP: CLIP Distillation via Affinity Mimicking and Weight Inheritance. IEEE International Conference on Computer Vision (ICCV) 2023. pdf, code.

  80. Xiaohu Huang, Xinggang Wang, Zhidianqiu Jin, Bo Yang, Botao He, Bin Feng, Wenyu Liu. Condition-Adaptive Graph Convolution Learning for Skeleton-Based Gait Recognition. IEEE Transactions on Image Processing (IEEE TIP), vol. 32, pp. 4773-4784, 2023, doi: 10.1109/TIP.2023.3305822. pdf

  81. Zilong Huang#, Xinggang Wang#*, Yunchao Wei, Lichao Huang, Humphrey Shi, Wenyu Liu, Thomas Huang. CCNet: Criss-Cross Attention for Semantic Segmentation. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 45, no. 6, pp. 6896-6908, 1 June 2023, doi: 10.1109/TPAMI.2020.3007032. pdf, code, bib

  82. Shaoyu Chen, Tianheng Cheng, Jiemin Fang, Qian Zhang, Yuan Li, Wenyu Liu, Xinggang Wang*. TinyDet: accurately detecting small objects within 1 GFLOPs. Science China Information Sciences (SCIS) 66, 119102, 2023, https://doi.org/10.1007/s11432-021-3504-4. pdf.

  83. Jiapei Feng, Xinggang Wang, Te Li, Shanshan Ji, Wenyu Liu. Weakly-supervised semantic segmentation via online pseudo-mask correcting. Pattern Recognition Letters (PRL), 2023. pdf.

  84. Yuxin Fang, Wen Wang, Binhui Xie, Quan Sun, Ledell Wu, Xinggang Wang, Tiejun Huang, Xinlong Wang, Yue Cao. EVA: Exploring the Limits of Masked Visual Representation Learning at Scale. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023 (Highlight paper, accept rate 2.5%). pdf, code.

  85. Tianheng Cheng, Xinggang Wang*, Shaoyu Chen, Qian Zhang, Wenyu Liu. Exploring High-Quality Pseudo Masks for Weakly Supervised Instance Segmentation. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023. pdf, code.

  86. Shusheng Yang, Yixiao Ge, Kun Yi, Dian Li, Ying Shan, Xiaohu Qie, Xinggang Wang*. RILS: Masked Visual Reconstruction in Language Semantic Space. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023. pdf, code.

  87. Jiawei Liu, Lin Niu, Zhihang Yuan, Dawei Yang, Xinggang Wang, Wenyu Liu. PD-Quant: Post-Training Quantization based on Prediction Difference Metric. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2023. pdf, code.

  88. Bencheng Liao, Shaoyu Chen, Xinggang Wang*, Tianheng Cheng, Qian Zhang, Wenyu Liu, Chang Huang. MapTR: Structured Modeling and Learning for Online Vectorized HD Map Construction. International Conference on Learning Representations (ICLR) 2023 (Spotlight). pdf, code.

  89. Yuxin Fang, Li Dong, Hangbo Bao, Xinggang Wang, Furu Wei. Corrupted Image Modeling for Self-Supervised Visual Pre-Training. International Conference on Learning Representations (ICLR) 2023 (Spotlight). pdf, code.

  90. Xiaohu Huang, Hao Zhou, Bin Feng, Xinggang Wang, Wenyu Liu, Jian Wang, Haocheng Feng, Junyu Han, Errui Ding, Jingdong Wang. Graph Contrastive Learning for Skeleton-based Action Recognition. International Conference on Learning Representations (ICLR) 2023. PDF.


  91. Year 2022

  92. Yifu Zhang, Peize Sun, Yi Jiang, Dongdong Yu, Fucheng Weng, Zehuan Yuan, Ping Luo, Wenyu Liu, Xinggang Wang. ByteTrack: Multi-Object Tracking by Associating Every Detection Box. European Conference on Computer Vision (ECCV) 2022. pdf, code.

  93. Tianheng Cheng, Xinggang Wang*, Shaoyu Chen, Wenqiang Zhang, Qian Zhang, Chang Huang, Zhaoxiang Zhang, Wenyu Liu. Sparse Instance Activation for Real-Time Instance Segmentation. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. pdf, code.

  94. Shaoyu Chen, Xinggang Wang*, Tianheng Cheng, Wenqiang Zhang, Qian Zhang, Chang Huang, Wenyu Liu. AziNorm: Exploiting the Radial Symmetry of Point Cloud for Azimuth-Normalized 3D Perception. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. pdf, code, bib.

  95. Jiemin Fang, Lingxi Xie, Xinggang Wang*, Xiaopeng Zhang, Wenyu Liu, Qi Tian. MSG-Transformer: Exchanging Local Spatial Information by Manipulating Messenger Tokens. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. pdf, code, bib.

  96. Shusheng Yang, Xinggang Wang*, Yu Li, Yuxin Fang, Jiemin Fang, Wenyu Liu, Xun Zhao, Ying Shan. Temporally Efficient Vision Transformer for Video Instance Segmentation. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. pdf, code, bib.

  97. Wenqiang Zhang, Zilong Huang, Guozhong Luo, Tao Chen, Xinggang Wang*, Wenyu Liu*, Gang Yu, Chunhua Shen. TopFormer: Token Pyramid Transformer for Mobile Semantic Segmentation. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2022. pdf, code, bib.

  98. Zhi Liu, Shaoyu Chen, Xiaojie Guo, Xinggang Wang, Tianheng Cheng, Hongmei Zhu, Qian Zhang, Wenyu Liu, Yi Zhang. Vision-based uneven bev representation learning with polar rasterization and surface estimation. Conference on Robot Learning (CoRL) 2022. pdf, code.

  99. Zilong Huang, Yunchao Wei, Xinggang Wang*, Wenyu Liu, Thomas S. Huang, Honghui Shi. AlignSeg: Feature-Aligned Segmentation Networks. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 44, no. 1, pp. 550-557, 1 Jan. 2022, doi: 10.1109/TPAMI.2021.3062772. pdf, code, bib

  100. Dong Wu, Manwen Liao, Weitian Zhang, Xinggang Wang, Xiang Bai, Wenqing Cheng, Wenyu Liu. YOLOP: You Only Look Once for Panoptic Driving Perception. Machine Intelligence Research, 19(6): 550-562 (2022). pdf, code, bib

  101. Jiyang Qi, Yan Gao, Yao Hu, Xinggang Wang, Xiaoyu Liu, Xiang Bai, Serge J. Belongie, Alan L. Yuille, Philip H. S. Torr, Song Bai. Occluded Video Instance Segmentation: A Benchmark. International Journal of Computer Vision (IJCV), vol. 130, no. 8, pp. 2022-2039, 2022

  102. Lin Niu, Xinggang Wang, Chen Duan, Qiongxia Shen, Wenyu Liu. Local Point Matching Network for Stabilized Crowd Counting and Localization. Chinese Conference on Pattern Recognition and Computer Vision (PRCV) 2022, pp. 566-579

  103. Jiemin Fang, Taoran Yi, Xinggang Wang*, Lingxi Xie, Xiaopeng Zhang, Wenyu Liu, Matthias Nießner, Qi Tian. Fast Dynamic Radiance Fields with Time-Aware Neural Voxels. SIGGRAPH Asia 2022, Article 11, pp. 1-9. pdf, code, bib

  104. Huangxuan Zhao, Zhenghong Zhou, Feihong Wu, Dongqiao Xiang, Hui Zhao, Wei Zhang, Lin Li, Zhong Li, Jia Huang, Hongyao Hu, Chengbo Liu, Tao Wang, Wenyu Liu, Jinqiang Ma*, Fan Yang*, Xinggang Wang*, Chuansheng Zheng*. Self-supervised learning enables 3D digital subtraction angiography reconstruction from ultra-sparse 2D projection views: A multicenter study, Cell Reports Medicine, Volume 3, Issue 10, 2022, 100775, ISSN 2666-3791. bib

  105. Yifu Zhang, Chunyu Wang, Xinggang Wang, Wenjun Zeng, Wenyu Liu. Multi-object Tracking by Marginal Inference. European Conference on Computer Vision (ECCV) 2022, pp. 22-40. PDF.

  106. Shenyuan Gao, Chunluan Zhou, Chao Ma, Xinggang Wang, Junsong Yuan. AiATrack: Attention in Attention for Transformer Visual Tracking. European Conference on Computer Vision (ECCV) 2022, pp. 146-164. PDF, code.

  107. Haohang Xu, Jiemin Fang, Xiaopeng Zhang, Lingxi Xie, Xinggang Wang, Wenrui Dai, Hongkai Xiong, Qi Tian. Bag of Instances Aggregation Boosts Self-supervised Distillation. International Conference on Learning Representations (ICLR) 2022.


  108. Year 2021

  109. Yifu Zhang, Chunyu Wang, Xinggang Wang, Wenjun Zeng, Wenyu Liu. FairMOT: On the Fairness of Detection and Re-Identification in Multiple Object Tracking. International Journal of Computer Vision (IJCV), 129, pages3069–3087 (2021). pdf, code.

  110. Jingdong Wang, Ke Sun, Tianheng Cheng, Borui Jiang, Chaorui Deng, Yang Zhao, Dong Liu, Yadong Mu, Mingkui Tan, Xinggang Wang, Wenyu Liu, Bin Xiao. Deep High-Resolution Representation Learning for Visual Recognition. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 43, no. 10, pp. 3349-3364, 1 Oct. 2021, doi: 10.1109/TPAMI.2020.2983686. pdf, code, bib

  111. Jiyang Qi, Xinggang Wang*, Yao Hu, Xu Tang, Wenyu Liu. Pyramid Self-attention for Semantic Segmentation. Chinese Conference on Pattern Recognition and Computer Vision (PRCV), pp. 480-492, 2021.

  112. Jiyang Qi, Yan Gao, Yao Hu, Xinggang Wang, Xiaoyu Liu, Xiang Bai, Serge Belongie, Alan Yuille, Philip Torr, Song Bai. Occluded Video Instance Segmentation: Dataset and Challenge. Conference on Neural Information Processing Systems (NeurIPS) Datasets and Benchmarks Track, 2021.

  113. Yuxin Fang#, Bencheng Liao#, Xinggang Wang*, Jiemin Fang, Jiyang Qi, Rui Wu, Jianwei Niu, Wenyu Liu. You Only Look at One Sequence: Rethinking Transformer in Vision through Object Detection. Conference on Neural Information Processing Systems (NeurIPS), 2021. pdf, code, bib

  114. Jiemin Fang#, Yuzhu Sun#, Qian Zhang, Kangjian Peng, Yuan Li, Wenyu Liu, Xinggang Wang*. FNA++: Fast Network Adaptation via Parameter Remapping and Architecture Search. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 43, no. 9, pp. 2990-3004, 1 Sept. 2021, doi: 10.1109/TPAMI.2020.3044416. pdf, code, bib

  115. Xinggang Wang, Zhaojin Huang, Bencheng Liao, Lichao Huang, Yongchao Gong, Chang Huang. Real-Time and Accurate Object Detection in Compressed Video by Long Short-term Feature Aggregation. Computer Vision and Image Understanding (CVIU), Volume 206, 2021,103188, doi:10.1016/j.cviu.2021.103188. pdf, code, bib

  116. Jiemin Fang, Yukang Chen, Xinbang Zhang, Qian Zhang, Chang Huang, Gaofeng Meng, Wenyu Liu, Xinggang Wang*. EAT-NAS: Elastic Architecture Transfer for Accelerating Large-scale Neural Architecture Search. Science China Information Sciences (SCIS), Volume 64, Issue 9: 192106 (2021) https://doi.org/10.1007/s11432-020-3112-8. pdf, code, bib

  117. Mengting Chen, Xinggang Wang, Heng Luo, Yifeng Geng and Wenyu Liu*. Learning to Focus: Cascaded Feature Matching Network for Few-shot Image Recognition. Science China Information Sciences (SCIS), 64, 192105 (2021). https://doi.org/10.1007/s11432-020-2973-7. pdf, code, bib

  118. Yuxin Fang#, Shusheng Yang#, Xinggang Wang*, Yu Li, Chen Fang, Ying Shan, Bin Feng, Wenyu Liu. Instances as Queries. IEEE International Conference on Computer Vision (ICCV) 2021. pdf, code.

  119. Shusheng Yang#, Yuxin Fang#, Xinggang Wang*, Yu Li, Chen Fang, Ying Shan, Bin Feng, Wenyu Liu. Crossover Learning for Fast Online Video Instance Segmentation. IEEE International Conference on Computer Vision (ICCV) 2021. pdf, code.

  120. Shaoyu Chen, Jiemin Fang, Qian Zhang, Wenyu Liu, Xinggang Wang*. Hierarchical Aggregation for 3D Instance Segmentation. IEEE International Conference on Computer Vision (ICCV) 2021.

  121. Xiaohu Huang, Duowang Zhu, Hao Wang, Xinggang Wang, Bo Yang, Botao He, Wenyu Liu, Bin Feng. Context-Sensitive Temporal Feature Learning for Gait Recognition. IEEE International Conference on Computer Vision (ICCV) 2021.

  122. Xinggang Wang, Jiapei Feng, Bin Hu, Qi Ding, Longjin Ran, Xiaoxin Chen, Wenyu Liu. Weakly-supervised Instance Segmentation via Class-agnostic Learning with Salient Images. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2021. pdf, code.

  123. Qiang Zhou, Shiyin Wang, Yitong Wang, Zilong Huang, Xinggang Wang*. Human De-occlusion: Invisible Perception and Recovery for Humans. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2021. pdf, dataset.

  124. Wenqiang Zhang, Jiemin Fang, Xinggang Wang*, Wenyu Liu. EfficientPose: Efficient Human Pose Estimation with Neural Architecture Search. Computational Visual Media (CVMJ), volume 7, pages 335–347 (2021). pdf, code, bib

  125. Jiapei Feng, Xinggang Wang*, Wenyu Liu. Deep Graph Cut Network for Weakly-supervised Semantic Segmentation. Science China Information Sciences (SCIS), Volume 64, Issue 3: 130105 (2021) https://doi.org/10.1007/s11432-020-3065-4, pdf, code, bib

  126. Bin Hu#, Jiwei Xu#, Xinggang Wang*. Learning Generalizable Deep Feature using Triplet-Batch-Center Loss for Person Re-identification. Science China Information Sciences (SCIS) 64, 120111 (2021). https://doi.org/10.1007/s11432-019-2943-6, pdf, code, bib

  127. Qixin Hu, Siyan Xu, Xue-wen Chen, Xinggang Wang, Ken Xingze Wang. Object recognition for remarkably small field-of-view with speckles. Applied Physics Letters (APL), Vol.118, Issue 9, 2021. DOI: 10.1063/5.0040343, pdf


  128. Year 2020

  129. Tianheng Cheng, Xinggang Wang, Lichao Huang, Wenyu Liu. Boundary-preserving Mask R-CNN. European Conference on Computer Vision (ECCV) 2020. pdf, code, bib

  130. Jiemin Fang, Yuzhu Sun, Qian Zhang, Yuan Li, Wenyu Liu, Xinggang Wang. Densely Connected Search Space for More Flexible Neural Architecture Search. CVPR, 2020. pdf, code, bib

  131. Jiemin Fang#, Yuzhu Sun#, Kangjian Peng#, Qian Zhang, Yuan Li, Wenyu Liu, Xinggang Wang. Fast Neural Network Adaptation via Parameter Remapping and Architecture Search. International Conference on Learning Representations (ICLR) 2020. pdf, code, bib

  132. Mengting Chen#, Yuxin Fang#, Xinggang Wang, Heng Luo, Yifeng Geng, Xinyu Zhang, Chang Huang, Wenyu Liu, Bo Wang. Diversity Transfer Network for Few-Shot Learning. AAAI Conference on Artificial Intelligence (AAAI) 2020. Oral presentation. pdf, code, bib

  133. Jiwei Xu, Xinggang Wang*, Wenyu Liu. Deep multi-metric learning for text-independent speaker verification. Neurocomputing, Volume 410, 14 October 2020, Pages 394-400. pdf, code, bib

  134. Xinggang Wang#, Xianbo Deng#, Qing Fu#, Qiang Zhou#, Jiapei Feng, Hui Ma, Wenyu Liu, Chuansheng Zheng. A Weakly-supervised Framework for COVID-19 Classification and Lesion Localization from Chest CT. IEEE Transactions on Medical Imaging (IEEE TMI), vol. 39, no. 8, pp. 2615-2625, Aug. 2020, doi: 10.1109/TMI.2020.2995965. pdf, code, bib

  135. Liang Xu, Xinggang Wang, Wenyu Liu, Bin Feng, Cascaded Boundary Network for High-Quality Temporal Action Proposal Generation, in IEEE Transactions on Circuits and Systems for Video Technology (IEEE TCSVT), vol. 30, no. 10, pp. 3702-3713, Oct. 2020, doi: 10.1109/TCSVT.2019.2944430. bib

  136. Meriem Sebai, Xinggang Wang, Tianjiang Wang. MaskMitosis: a deep learning framework for fully supervised, weakly supervised, and unsupervised mitosis detection in histopathology images, Med Biol Eng Comput 58, 1603–1623 (2020). https://doi.org/10.1007/s11517-020-02175-z, code, bib

  137. Liangchen Song, Yonghao Xu, Lefei Zhang, Bo Du, Qian Zhang, Xinggang Wang. Learning from Synthetic Images via Active Pseudo-Labeling. IEEE Transactions on Image Processing (IEEE TIP), vol. 29, pp. 6452-6465, 2020, doi: 10.1109/TIP.2020.2989100. code, bib

  138. Shengkai Wu, Xiaoping Li, Xinggang Wang. IoU-aware single-stage object detector for accurate localization. Image and Vision Computing (IMAVIS) (2020): 103911. pdf, bib

  139. Shuanlong Niu, Bin Li, Xinggang Wang, Hui Lin. Defect Image Sample Generation with GAN for Improving Defect Recognition. IEEE Transactions on Automation Science and Engineering (IEEE TASE), vol. 17, no. 3, pp. 1611-1622, July 2020, doi: 10.1109/TASE.2020.2967415. bib

  140. Liangchen Song, Cheng Wang, Lefei Zhang, Bo Du, Qian Zhang, Chang Huang, Xinggang Wang. Unsupervised Domain Adaptive Re-Identification: Theory and Practice. Pattern Recognition, Volume 102, June 2020, 107173. pdf, code, bib

  141. Cheng Wang, Liangchen Song, Guoli Wang, Qian Zhang, Xinggang Wang*. Multi-scale Multi-patch Person Re-Identification with Exclusivity Regularized Softmax. Neurocomputing, Volume 382, 21 March 2020, Pages 64-70, doi:10.1016/j.neucom.2019.11.062. pdf, bib

  142. Zilong Huang, Chunyu Wang, Xinggang Wang*, Wenyu Liu, Jingdong Wang. Semantic Image Segmentation by Scale-Adaptive Networks. IEEE Transactions on Image Processing (IEEE TIP), vol. 29, pp. 2066-2077, 2020, doi: 10.1109/TIP.2019.2941644. pdf, code, bib

  143. Yuan Li, Xinggang Wang, Wenyu Liu, Bin Feng*. Pose Anchor: A Single-stage Hand Keypoint Detection Network. IEEE Transactions on Circuits and Systems for Video Technology (IEEE TCSVT), vol. 30, no. 7, pp. 2104-2113, July 2020, doi: 10.1109/TCSVT.2019.2912620. pdf, bib

  144. Peng Tang, Chunyu Wang, Xinggang Wang, Wenyu Liu*, Wenjun Zeng, Jingdong Wang. Object Detection in Videos by High Quality Object Linking. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 42, no. 5, pp. 1272-1278, 1 May 2020, doi: 10.1109/TPAMI.2019.2910529. pdf, bib

  145. Peng Tang, Xinggang Wang*, Song Bai, Wei Shen, Xiang Bai, Wenyu Liu, Alan Yuille. PCL: Proposal Cluster Learning for Weakly Supervised Object Detection. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI), vol. 42, no. 1, pp. 176-191, 1 Jan. 2020, doi: 10.1109/TPAMI.2018.2876304. pdf, code, bib


  146. Year 2019

  147. Zilong Huang, Xinggang Wang, Lichao Huang, Chang Huang, Yunchao Wei, Wenyu Liu. CCNet: Criss-Cross Attention for Semantic Segmentation. IEEE International Conference on Computer Vision (ICCV) 2019. pdf, code, bib

  148. Zhaojin Huang, Lichao Huang, Yongchao Gong, Chang Huang, Xinggang Wang. Mask Scoring R-CNN. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019. Oral (5.6% acceptance rate) pdf, code, bib

  149. Yukang Chen, Gaofeng Meng, Qian Zhang, Shiming Xiang, Chang Huang, Lisen Mu, Xinggang Wang. RENAS: Reinforced Evolutionary Neural Architecture Search. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019. pdf, code, bib

  150. Xin Lei, Liangyu He, Ken Xingze Wang, Xinggang Wang, Yixuan Tan, Yihan Du, Shanhui Fan, Zongfu Yu. Direct Object Recognition Without Line-of-sight Using Optical Coherence. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2019. pdf, bib

  151. Hao Luo, Wenxuan Xie, Xinggang Wang, Wenjun Zeng. Detect or Track: Towards Cost-Effective Video Object Detection/Tracking. AAAI Conference on Artificial Intelligence (AAAI) 2019. pdf, bib

  152. Xinggang Wang, Jiasi Wang, Peng Tang, Wenyu Liu*. Weakly- and Semi-Supervised Fast Region-Based CNN for Object Detection. Journal of Computer Science and Technology (JCST) 34(6): 1269–1278 Nov. 2019. pdf, bib

  153. Xinggang Wang, Yongluan Yan, Peng Tang, Wenyu Liu*, Xiaojie Guo. Bag similarity network for deep multi-instance learning. Information Sciences (InfSci), Volume 504, December 2019, Pages 578-588, Doi: 10.1016/j.ins.2019.07.071. pdf, bib

  154. Chao Li, Xinggang Wang, Wenyu Liu*, Longin Latecki, Bo Wang, Junzhou Huang. Weakly Supervised Mitosis Detection in Breast Histopathology Images using Concentric Loss. Medical Image Analysis. Volume 53, Pages 165-178 (2019) pdf, code, bib

  155. Peng Tang, Xinggang Wang*, Baoguang Shi, Xiang Bai, Wenyu Liu, Zhuowen Tu. Deep FisherNet for Image Classification. IEEE Transactions on Neural Networks and Learning Systems (IEEE TNNLS) vol. 30, no. 7, pp. 2244-2250, July 2019, doi: 10.1109/TNNLS.2018.2874657. pdf, bib

  156. Baoguang Shi, Mingkun Yang, Xinggang Wang, Pengyuan Lyu, Cong Yao, Xiang Bai*. ASTER: An attentional scene text recognizer with flexible rectification. IEEE Transactions on Pattern Analysis and Machine Intelligence (IEEE TPAMI) vol. 41, no. 9, pp. 2035-2048, 1 Sept. 2019, doi: 10.1109/TPAMI.2018.2848939. pdf, code, bib

  157. Hui Lin, Bin Li, Xinggang Wang, Yufeng Shu, and Shuanglong Niu. Automated defect inspection of LED chip using deep convolutional neural network. Journal of Intelligent Manufacturing (J Intell Manuf) 30, no. 6 (2019): 2525-2534.


  158. Year 2018

  159. Peng Tang, Xinggang Wang, Angtian Wang, Yongluan Yan, Wenyu Liu, Junzhou Huang, Alan Yuille. Weakly Supervised Region Proposal Network and Object Detection. European Conference on Computer Vision (ECCV) 2018. pdf, bib

  160. Cheng Wang, Qian Zhang, Chang Huang, Wenyu Liu, Xinggang Wang*. Mancs: A Multi-task Attentional Network with Curriculum Sampling for Person Re-identification. European Conference on Computer Vision (ECCV) 2018. pdf, code, bib

  161. Zilong Huang, Xinggang Wang*, Jiasi Wang, Wenyu Liu, Jingdong Wang. Weakly-Supervised Semantic Segmentation Network with Deep Seeded Region Growing. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2018. pdf, code, bib

  162. Xinggang Wang*, Yongluan Yan, Peng Tang, Xiang Bai*, Wenyu Liu. Revisiting Multiple Instance Neural Networks. Pattern Recognition, Volume 74, February 2018, Pages 15-24, Doi: 10.1016/j.patcog.2017.08.026. pdf, code, bib

  163. Yongluan Yan, Xinggang Wang, Xiaojie Guo, Jiemin Fang, Wenyu Liu, Junzhou Huang. Deep Multi-instance Learning with Dynamic Pooling. ACML, 2018. pdf, bib

  164. Mengting Chen, Xinggang Wang, Bin Feng, Wenyu Liu*. Structured random forest for label distribution learning. Neurocomputing Volume 320, 3 December 2018, Pages 171-182. pdf, bib

  165. Yuan Li, Xinggang Wang, Wenyu Liu, Bin Feng*. Deep attention network for joint hand gesture localization and recognition using static RGB-D images. Information Sciences. Volume 441, May 2018, Pages 66-78. pdf, bib

  166. Chao Li, Xinggang Wang*, Wenyu Liu, Longin Latecki. DeepMitosis: Mitosis detection via deep detection, verification and segmentation networks. Medical Image Analysis. Volume 45, Pages 121-133, (2018) pdf, code, bib


  167. Year 2017

  168. Jianxiang Ma, Anlong Ming, Zilong Huang, Xinggang Wang, Yu Zhou. Object-Level Proposals. ICCV, 2017. pdf, bib

  169. Peng Tang, Xinggang Wang, Xiang Bai, and Wenyu Liu. Multiple Instance Detection Network with Online Instance Classifier Refinement. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2017. pdf, code, bib

  170. Minghui Liao, Baoguang Shi, Xiang Bai, Xinggang Wang, Wenyu Liu. TextBoxes: A Fast Text Detector with a Single Deep Neural Network. AAAI Conference on Artificial Intelligence (AAAI) 2017. pdf, code, bib

  171. Xinggang Wang, Wei Yang, Jeffrey Weinreb, Juan Han, Qiubai Li, Xiangchuang Kong, Yongluan Yan, Zan Ke, Bo Luo, Tao Liu, Liang Wang*. Searching for prostate cancer by fully automated magnetic resonance imaging classification: deep learning versus non-deep learning. Scientific Reports, volume 7, Article number: 15415 (2017), doi:10.1038/s41598-017-15720-y. pdf, bib

  172. Peng Tang, Xinggang Wang*, Zilong Huang, Xiang Bai, Wenyu Liu. Deep Patch Learning for Weakly Supervised Object Classification and Discovery. Pattern Recognition, Volume 71, Pages 446-459, 2017. pdf code, bib

  173. Peng Tang, Xinggang Wang, Bin Feng, Wenyu Liu*. Learning Multi-instance Deep Discriminative Patterns for Image Classification. IEEE Transactions on Image Processing (IEEE TIP), vol. 26, no. 7, pp. 3385-3396, July 2017.

  174. Bin Feng, Fangzi He, Xinggang Wang, Yongjiang Wu, Hao Wang, Sihua Yi, Wenyu Liu. Depth-Projection-Map-Based Bag of Contour Fragments for Robust Hand Gesture Recognition. IEEE Transactions on Human-Machine Systems (THMS) 47(4): 511-523 (2017)

  175. Chao Li, Xinggang Wang, Wenyu Liu*. Neural features for pedestrian detection. Neurocomputing, Volume 238, 17 May 2017, Pages 420–432

  176. Peng Tang, Jin Zhang, Xinggang Wang*, Bin Feng, Fabio Roli, Wenyu Liu. Learning Extremely Shared Middle-level Image Representation for Scene Classification. Knowledge and Information Systems (KIS), 52, 509–530 (2017), doi:10.1007/s10115-016-1015-z code


  177. Year 2016

  178. Baoguang Shi, Xinggang Wang, Pengyuan Lv, Cong Yao, Xiang Bai. Robust Scene Text Recognition with Automatic Rectification. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2016. pdf, bib

  179. Xinggang Wang, Xiong Duan, Xiang Bai*. Deep sketch feature for cross-domain image retrieval. Neurocomputing, Volume 207, 26 September 2016, Pages 387–397. code

  180. Zhuotun Zhu, Xinggang Wang*, Song Bai, Cong Yao, Xiang Bai. Deep Learning Representation using Autoencoder for 3D Shape Retrieval. Neurocomputing, Volume 204, 5 September 2016, Pages 41–50

  181. Yingying Zhu, Chengquan Zhang, Duoyou Zhou, Xinggang Wang, Xiang Bai, Wenyu Liu*. Traffic Sign Detection and Recognition using Fully Convolutional Network Guided Proposals. Neurocomputing, Volume 214, 19 November 2016, Pages 758–766

  182. Wei Shen, Yuan Jiang, Wenjing Gao, Dan Zeng, Xinggang Wang. Shape recognition by bag of skeleton-associated contour parts. Pattern Recognition Letters, Volume 83, Part 3, 1 November 2016, Pages 321–329

  183. Sihua Yi, Nan Jiang, Bin Feng, Xinggang Wang, Wenyu Liu. Online similarity learning for visual tracking. Information Sciences, 364-365: 33-50 (2016)

  184. Sihua Yi, Nan Jiang, Xinggang Wang, Wenyu Liu. Individual adaptive metric learning for visual tracking. Neurocomputing 191: 273-285 (2016)

  185. Yang Wang, Xinggang Wang*, Wenyu Liu. Unsupervised Local Deep Feature for Image Recognition. Information Sciences (2016), Volume 351, 10 July 2016, Pages 67–75, 10.1016/j.ins.2016.02.044. bib


  186. Year 2015

  187. Xinggang Wang#, Zhuotun Zhu#, Cong Yao, Xiang Bai. Relaxed Multiple-Instance SVM with Application to Object Discovery. IEEE International Conference on Computer Vision (ICCV) 2015. pdf, code, bib

  188. Wei Shen, Xinggang Wang, Yan Wang, Xiang Bai, Zhijiang Zhang. DeepContour: A Deep Convolutional Feature for Contour Detection. IEEE Computer Society Conference on Computer Vision and Pattern Recognition (CVPR) 2015, Boston, USA. pdf, code, bib

  189. Chuanping Hu, Xiang Bai, Li Qi, Xinggang Wang, Gengjian Xue, Lin Mei. Learning Discriminative Pattern for Real-Time Car Brand Recognition. IEEE Transactions on Intelligent Transportation Systems (TITS) 16(6): 3170-3181 (2015)

  190. Xiang Bai, Song Bai, Xinggang Wang*. Beyond diffusion process: Neighbor set similarity for fast re-ranking. Information Sciences Volume 325, 20 December 2015, Pages 342-354, doi: 10.1016/j.ins.2015.07.022. bib


  191. Year 2014

  192. Xiaojie Guo, Xinggang Wang, Liang Yang, Xiaochun Cao and Yi Ma, Robust Foreground Detection Using Smoothness and Arbitrariness Constraints, European Conference on Computer Vision (ECCV), Zurich, September, 2014. pdf, bib

  193. Xiang Bai, Cong Rao, and Xinggang Wang*. Shape Vocabulary: A Robust and Efficient Shape Representation for Shape Matching. IEEE Transactions on Image Processing (TIP) vol. 23, no. 9, pp. 3935-3949, Sept. 2014, doi: 10.1109/TIP.2014.2336542. pdf, bib

  194. Chen Duan, Xinggang Wang, Shuiming Shu, Changwei Jing, and Huawei Chang. Thermodynamic design of Stirling engine using multi-objective particle swarm optimization algorithm. Energy Conversion and Management, Volume 84, August 2014, Pages 88–96.

  195. Xinggang Wang, Zhengdong Zhang, Yi Ma, Xiang Bai, Wenyu Liu, and Zhuowen Tu. Robust Subspace Discovery via Relaxed Rank Minimization. Neural Computation, Vol. 26, No. 3 April 2014, Pages 611-635. pdf, code, bib

  196. Xinggang Wang, Bin Feng, Xiang Bai, Wenyu Liu, and Longin Jan Latecki. Bag of Contour Fragments for Robust Shape Classification. Pattern Recognition, Volume 47, Issue 6, June 2014, Pages 2116-2125. pdf, code, bib


  197. Year 2009 - 2013

  198. Xinggang Wang, Baoyuan Wang, Xiang Bai, Wenyu Liu, and Zhuowen Tu, Max-Margin Multiple Instance Dictionary Learning, International Conference on Machine Learning (ICML), Atlanta, June, 2013. pdf, code, bib

  199. Xinggang Wang, Xiang Bai, Tianyang Ma, Wenyu Liu, Longin Latecki. Fan Shape Model for Object Detection. IEEE Computer Society Conference on Computer vision and Pattern Recognition (CVPR), 2012. pdf, code, bib

  200. Xinggang Wang, Xiang Bai, Xingwei Yang, Wenyu Liu, and Longin Jan Latecki. Maximal Cliques that Satisfy Hard Constraints with Application to Deformable Object Model Learning. Conference on Neural Information Processing Systems (NIPS) 2011. pdf, bib

  201. Xinggang Wang, Xiang Bai, Wenyu Liu, Longin Latecki. Feature Context for Object Detection and Image Classification. IEEE Computer Society Conference on Computer Vision and Pattern Recognition (CVPR) 2011. pdf, code, bib

  202. Bo Wang, Xiang Bai, Xinggang Wang, Wenyu Liu, Zhuowen Tu. Object Recognition using Junctions. European Conference on Computer Vision (ECCV), 2010. pdf

  203. Xiang Bai, Bo Wang, Xinggang Wang, Wenyu Liu, Zhuowen Tu. Co-Transduction for Shape Retrieval. European Conference on Computer Vision (ECCV), 2010. pdf

  204. Xiang Bai, Xinggang Wang, Longin Jan Latecki, Wenyu Liu, and Zhuowen Tu. Active Skeleton for Non-rigid Object Detection. IEEE International Conference on Computer Vision (ICCV), 2009. pdf, code


Other Conference Papers

  1. Qiang Zhou, Zilong Huang, Lichao Huang, Yongchao Gong, Han Shen, Wenyu Liu, Xinggang Wang. Motion-Guided Spatial Time Attention for Video Object Segmentation. In Proceedings of the IEEE International Conference on Computer Vision Workshops (ICCVW), pp. 0-0. 2019.

  2. Shuanlong Niu, Hui Lin, Tongzhi Niu, Bin Li, Xinggang Wang. DefectGAN: Weakly-Supervised Defect Detection using Generative Adversarial Network. International Conference on Automation Science and Engineering (CASE), 2019

  3. Shoufa Chen, Xinggang Wang. Single-shot Detector with Multiple Inference Paths. IEEE International Conference on Image Processing (ICIP), 2019

  4. Jiasi Wang, Xinggang Wang, and Wenyu Liu. Weakly- and Semi-supervised Faster R-CNN with Curriculum Learning. International Conference on Pattern Recognition (ICPR), 2018 pdf

  5. Yongluan Yan, Xinggang Wang, Xin Yang, Xiang Bai, and Wenyu Liu. Joint Classification Loss and Histogram Loss for Sketch-based Image Retrieval. ICIG, 2017 (oral)

  6. Xinggang Wang, Zhengdong Zhang, Yi Ma, Xiang Bai, Wenyu Liu, and Zhuowen Tu. One-Class Multiple Instance Learning via Robust PCA for Common Object Discovery. Asian Conference on Computer Vision (ACCV), 2012. pdf

  7. Weichao Qiu, Xinggang Wang, Xiang Bai, Alan Yuille, and Zhuowen Tu, Scale-space SIFT Flow. IEEE Winter Conference on Applications of Computer Vision (WACV), Steamboat Springs CO, March, 2014. pdf

  8. Zhuotun Zhu, Xinggang Wang, Song Bai, Cong Yao, Xiang Bai. Deep Learning Representation using Autoencoder for 3D Shape Retrieval, ICSPAC 2014, Wuhan

  9. Wei Shen, Xinggang Wang, Cong Yao, Xiang Bai. Shape Recognition by Combining Contour and Skeleton into a Mid-Level Representation. Chinese Conference on Pattern Recognition (CCPR) 2014, pp. 391-400

  10. Xin Yang, Xinggang Wang, Tim Cheng. OGB: A Distinctive and Efficient Feature for Mobile Augmented Reality. International Conference on Multimedia Modeling (MMM), 2016

  11. Xinggang Wang, Xin Yang, Wenyu Liu, Chen Duan, Longin Latecki. Location-Aware Image Classification. International Conference on Multimedia Modeling (MMM), 2016

  12. Song Bai, Xinggang Wang, Cong Yao, Xiang Bai. Multiple Stage Residual Model for Accurate Image Classification. Asian Conference on Computer Vision (ACCV) 2014, pp. 430-445

  13. Song Bai, Xinggang Wang, Xiang Bai. Aggregating contour fragments for shape classification. IEEE International Conference on Image Processing (ICIP) 2014, pp. 5252-5256

  14. Yingying Zhu, Xinggang Wang, Cong Yao, Xiang Bai. Traffic sign classification using twolayer image representation. International Conference on Image Processing (ICIP), 2013.

  15. Yueming Wang, Xinggang Wang, Shaojun Zhu, Xiang Bai, Wenyu Liu, Adjacent Coding for Image Classification. International Conference on Pattern Recognition (ICPR), 2012.

  16. Meng Yi, Tatyana Nuzhnaya, Vasileios Megalooikonomou, Xinggang Wang, Longin Jan Latecki, Mark Kohn, Robert Steiner. Lung Image Classification using Locality-Constrained Linear Coding. STMI 2012: MICCAI Workshop on Sparsity Techniques in Medical Imaging. pdf

  17. Quannan Li, Xinggang Wang, Wei Wang, Yuan Jiang, Zhi-Hua Zhou, and Zhuowen Tu, Disagreement-Based Multi-System Tracking, Workshop of Detection and Tracking in Challenging Environments, 2012. pdf


Book Chapters

  1. Weichao Qiu, Xinggang Wang, Xiang Bai, Alan Yuille, Zhuowen Tu. Scale-Space SIFT Flow. Book Chapter: Dense Image Correspondences for Computer Vision (Edited by Tal Hassner and Ce Liu), pp. 51-70, Springer, 2016.


Misc

  1. Qiang Zhou, Zilong Huang, Lichao Huang, Yongchao Gong, Han Shen, Wenyu Liu, Xinggang Wang. Motion-Guided Spatial Time Attention for Video Object Segmentation. Proceedings of the IEEE International Conference on Computer Vision Workshops. 2019. 2nd place in the 2nd Large-scale Video Object Segmentation Challenge. pdf

  2. Zilong Huang, Yunchao Wei, Xinggang Wang, Wenyu Liu. A PyTorch Semantic Segmentation Toolbox. pdf code


Technical Reports

  1. Shaoyu Chen, Tianheng Cheng, Xinggang Wang, Wenming Meng, Qian Zhang, Wenyu Liu. Efficient and Robust 2D-to-BEV Representation Learning via Geometry-guided Kernel Transformer. arXiv preprint arXiv:2206.04584 (2022).

  2. Shaoyu Chen, Xinggang Wang, Tianheng Cheng, Qian Zhang, Chang Huang, Wenyu Liu. Polar Parametrization for Vision-based Surround-View 3D Detection. arXiv preprint arXiv:2206.10965 (2022).

  3. Zilong Huang, Wentian Hao, Xinggang Wang, Mingyuan Tao, Jianqiang Huang, Wenyu Liu, and Xian-Sheng Hua. Half-Real Half-Fake Distillation for Class-Incremental Semantic Segmentation. arXiv preprint arXiv:2104.00875 (2021).

  4. Hao Luo, Lichao Huang, Han Shen, Yuan Li, Chang Huang, Xinggang Wang. Object Detection in Video with Spatial-temporal Context Aggregation. arXiv:1907.04988 (2019)

  5. Qiang Zhou, Zilong Huang, Lichao Huang, Yongchao Gong, Han Shen, Chang Huang, Wenyu Liu, Xinggang Wang. Proposal, Tracking and Segmentation (PTS): A Cascaded Network for Video Object Segmentation. arXiv:1907.01203v2 (2019) code

  6. Xinggang Wang, Kaibing Chen, Zilong Huang, Cong Yao, Wenyu Liu. Point Linking Network for Object Detection. arXiv:1706.03646 (2017)