Xiongkuo Min – Publication

2026

   Conference

  • I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
    Juntong Wang, Jiarui Wang, Huiyu Duan, Jiaxiang Kang, Guangtao Zhai, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
    [Database & Code]

  • FVBench: Benchmarking Deepfake Video Detection Capability of Large Multimodal Models
    Jiarui Wang, Huiyu Duan, Juntong Wang, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
    [Database & Code]

  • Generalizable Video Quality Assessment via Weak-to-Strong Learning
    Linhan Cao, Wei Sun, Xiangyang Zhu, Kaiwei Zhang, Jun Jia, Yicong Peng, Dandan Zhu, Guangtao Zhai, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
    [Code]

  • VITAL: Vision-Encoder-Centered Pretraining for LMMs in Visual Quality Assessment
    Ziheng Jia, Linhan Cao, Jinliang Han, Zicheng Zhang, Jiaying Qian, Jiarui Wang, Zijian Chen, Guangtao Zhai, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
    [Code]

  • LifeEval: A Multimodal Benchmark for Assistive AI in Egocentric Daily Life Tasks
    Hengjian Gao, Kaiwei Zhang, Shibo Wang, Mingjie Chen, Qihang Cao, Xianfeng Wang, Yucheng Zhu, Xiongkuo Min, Wei Sun, Dandan Zhu, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.

  • Adapter Shield: A Unified Framework with Built-In Authentication for Preventing Unauthorized Zero-Shot Image-to-Image Generation
    Jun Jia, Hongyi Miao, Yingjie Zhou, Wangqiu Zhou, Jianbo Zhang, Linhan Cao, Dandan Zhu, Hua Yang, Xiongkuo Min, Wei Sun, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026.

  • Learning to Wander: Improving the Global Image Geolocation Ability of LMMs via Actionable Reasoning
    Yushuo Zheng, Huiyu Duan, Zicheng Zhang, Xiaohong Liu, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (Findings), 2026.

  • Evaluating Dataset Watermarking for Fine-Tuning Traceability of Customized Diffusion Models: A Comprehensive Benchmark and Removal Approach
    Xincheng Wang, Hanchi Sun, Wenjun Sun, Kejun Xue, Wangqiu Zhou, Jianbo Zhang, Wei Sun, Dandan Zhu, Xiongkuo Min, Jun Jia, and Zhijun Fang
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (Findings), 2026.

  • VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement Learning
    Linhan Cao, Wei Sun, Weixia Zhang, Xiangyang Zhu, Jun Jia, Kaiwei Zhang, Dandan Zhu, Guangtao Zhai, and Xiongkuo Min
    AAAI Conference on Artificial Intelligence (AAAI), 2026.
    [Code]

  • Audio-Assisted Face Video Restoration with Temporal and Identity Complementary Learning
    Yuqin Cao, Yixuan Gao, Wei Sun, Xiaohong Liu, Yulun Zhang, and Xiongkuo Min
    AAAI Conference on Artificial Intelligence (AAAI), 2026.

  • Refine-IQA: Multi-Stage Reinforcement Finetuning for Perceptual Image Quality Assessment
    Ziheng Jia, Jiaying Qian, Zicheng Zhang, Zijian Chen, and Xiongkuo Min
    AAAI Conference on Artificial Intelligence (AAAI), 2026.
    [Code]

  • Scaling-Up Perceptual Video Quality Assessment
    Ziheng Jia, Zicheng Zhang, Xiaorong Zhu, Chunyi Li, Jinliang Han, Xiaohong Liu, Guangtao Zhai, and Xiongkuo Min
    AAAI Conference on Artificial Intelligence (AAAI), 2026.
    [Database & Code]
    Oral

  • SalDiff-DTM: A Novel Dual-Temporal Modulated Diffusion Model for Omnidirectional Images Scanpath Prediction
    Xiaohui Kong, Qian Liu, Dandan Zhu, Kaiwei Zhang, and Xiongkuo Min
    AAAI Conference on Artificial Intelligence (AAAI), 2026.

  • Grounding-IQA: Grounding Multimodal Language Model for Image Quality Assessment
    Zheng Chen, Xun Zhang, Wenbo Li, Renjing Pei, Fenglong Song, Xiongkuo Min, Xiaohong Liu, Xin Yuan, Yong Guo, and Yulun Zhang
    International Conference on Learning Representations (ICLR), 2026.

  • MIMIC-Bench: Exploring the User-Like Thinking and Mimicking Capabilities of Multimodal Large Language Models
    Jiajie Teng, Huiyu Duan, Sijing Wu, Jiarui Wang, Xilei Zhu, Jianing Jin, Wei Shen, Xiongkuo Min, and Guangtao Zhai
    International Conference on Learning Representations (ICLR), 2026.

  • ODI-Bench: Can MLLMs Understand Immersive Omnidirectional Environments?
    Liu Yang, Huiyu Duan, Ran Tao, Juntao Cheng, Sijing Wu, Yunhao Li, Jing Liu, Xiongkuo Min, and Guangtao Zhai
    International Conference on Learning Representations (ICLR), 2026.
    [Database]

  • LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
    Jiarui Wang, Huiyu Duan, Ziheng Jia, Zicheng Zhang, Yu Zhao, Juntong Wang, Guangtao Zhai, and Xiongkuo Min
    International Conference on Machine Learning (ICML), 2026.
    [Database & Code]

  • EEmo-Logic: A Unified Dataset and Multi-Stage Framework for Comprehensive Image-Evoked Emotion Assessment
    Lancheng Gao, Ziheng Jia, Zixuan Xing, Wei Sun, Huiyu Duan, Guangtao Zhai,and Xiongkuo Min
    International Conference on Machine Learning (ICML), 2026.
    [Database & Code]
    Spotlight

  • Invisible in Space, Visible in Time: Motion Vision CAPTCHA against GUI Agents
    Zeyu Zhang, Dingyi Rong, Zijian Chen, Zicheng Zhang, Xiongkuo Min, Guangtao Zhai
    ACM International Conference on Multimedia (MM), 2026.

  • AGTI-Bench: A Human-Aligned Benchmark for Text-Aware Text-to-Image Generation
    Zhichao Ma, Jiarui Wang, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), 2026.

  • From Open Loop to Closed Loop: A Test-Time Iterative Optimization Framework for Reference-Consistent Image Generation
    Baixuan Zhao, Xinyu Zhang, Huayu Zheng, Shuaicheng Liu, Xiongkuo Min, Guangtao Zhai, and Xiaohong Liu
    European Conference on Computer Vision (ECCV), 2026.
    [Code]

  • EditHF-1M: A Million-Scale Rich Human Preference Feedback for Image Editing
    Zitong Xu, Huiyu Duan, Zhongpeng Ji, Xinyun Zhang, Yutao Liu, Xiongkuo Min, Ke Gu, Jian Zhang, Shusong Xu, Jinwei Chen, Bo Li, and Guangtao Zhai
    European Conference on Computer Vision (ECCV), 2026.
    [Database & Code]
    Spotlight

   Journal

  • Quality Assessment for AI Generated Images with Instruction Tuning
    Jiarui Wang, Huiyu Duan, Guangtao Zhai, and Xiongkuo Min
    IEEE Transactions on Multimedia (TMM), 2026.
    [Database & Code]

  • Multi-Dimensional Quality Assessment for AI-Generated Human-Centric Videos: Dataset and Model
    Sijing Wu, Yunhao Li, Huiyu Duan, Yucheng Zhu, Xiongkuo Min, Patrick Le Callet, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), 2026.

  • MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis
    Yingjie Zhou, Zicheng Zhang, Jiezhang Cao, Yanwei Jiang, Jun Jia, Farong Wen, Xiaohong Liu, Xiongkuo Min, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), 2026.
    [Database]

  • Who is a Better Dresser: Your Personal Quality Assessment Agent for Virtual Try-On Digital Humans
    Yingjie Zhou, Zicheng Zhang, Farong Wen, Yanwei Jiang, Jun Jia, Xiaohong Liu, Xiongkuo Min, Jiezhang Cao, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), 2026.
    [Database]

  • Subjective and Objective QoE Assessment for Real-Time Streaming Interactive Digital Human
    Yingjie Zhou, Jing Wan, Farong Wen Wen, Zicheng Zhang, Xiaohong Liu, Yu Zhou, Jiezhang Cao, Yu Wang, Xiongkuo Min, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), 2026.
    [Code]

  • AGHI-QA: A Subjective-Aligned Dataset and Metric for AI-Generated Human Images
    Yunhao Li, Sijing Wu, Wei Sun, Zhichao Zhang, Yucheng Zhu, Zicheng Zhang, Huiyu Duan, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 4, pp. 4636-4649, 2026.

  • Subjective and Objective Quality-of-Experience Evaluation Study for Live Video Streaming
    Zehao Zhu, Wei Sun, Jun Jia, Wei Wu, Sibin Deng, Kai Li, Xiongkuo Min, Jia Wang, Ying Chen, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 9, pp. 13708-13722, 2026.

  • HarmonyQA: A Unified Framework for Harmonization Quality Assessment
    Zitong Xu, Huiyu Duan, Guangji Ma, Liu Yang, Jiarui Wang, Sijing Wu, Yunhao Li, Qingbo Wu, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 9, pp. 13118-13134, 2026.

  • Multi-Dimensional Quality Assessment for Single-Image-to-3D Contents: Dataset and Model
    Kang Fu, Huiyu Duan, Zicheng Zhang, Jing Liu, Yun Liu, Xiaohong Liu, Jia Wang, Xiongkuo Min, Patrick Le Callet, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 35, pp. 7033-7048, 2026.

  • MEScan360: A Memory-Enhanced Scanpath Prediction Model for Omnidirectional Images
    Yuchen Zhang, Dandan Zhu, Kaiwei Zhang, Kun Zhu, Nana Zhang, Xiongkuo Min, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 22, no. 8, pp. 212:1-212:22, 2026.

  • Developing Evolving Adaptability in Biological Intelligence: A Novel Biologically-Inspired Continual Learning Model for Video Saliency Prediction
    Dandan Zhu, Kaiwei Zhang, Kun Zhu, Nana Zhang, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), vol. 48, no. 4, pp. 4257-4274, 2026.

  • Subjective and Objective Quality Assessment of Display Content Videos
    Yijie Huang, Fangfang Lu, Huiqun Yu, Kaiwei Zhang, Wei Sun, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 5, pp. 6601-6616, 2026.

  • LMVQ: Label-Free Metric-Learning for General AI-Generated Video Quality Assessment
    Zhichao Zhang, Xinyue Li, Wei Sun, Zicheng Zhang, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 3, pp. 3367-3381, 2026.

  • Towards Versatile Multimedia Quality Assessment for Visual Communications
    Zicheng Zhang, Ziheng Jia, Chunyi Li, Yingjie Zhou, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    SCIENCE CHINA Information Sciences (SCIS), vol. 69, no. 2, pp. 122306:1-122306:15, 2026.

  • Future Fixation Sequence Prediction for Audio-Visual 360deg Videos
    Yucheng Zhu, Guangtao Zhai, Xiongkuo Min, Yunhao Li, Long Teng, Huiyu Duan, Liang Yuan, and Xiaokang Yang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 1, pp. 551-565, 2026.
    ESI Highly Cited Paper

  • Quality Assessment and Distortion-Aware Saliency Prediction for AI-Generated Omnidirectional Images
    Liu Yang, Huiyu Duan, Jiarui Wang, Jing Liu, Menghan Hu, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 3, pp. 3351-3366, 2026.
    [Code]

  • UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
    Yuqin Cao, Xiongkuo Min, Yixuan Gao, Wei Sun, Long Ye, Weisi Lin, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 3, pp. 3336-3350, 2026.

  • Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model, and Training Strategy
    Yinan Sun, Xiongkuo Min, Zicheng Zhang, Yixuan Gao, Yuqin Cao, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 36, no. 3, pp. 3382-3396, 2026.

2025

   Conference

  • Mesh Mamba: A Unified State Space Model for Saliency Prediction in Non-Textured and Textured Meshes
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 16219-16228, 2025.
    [Code]

  • Image Quality Assessment: From Human to Machine Preference
    Chunyi Li, Yuan Tian, Xiaoyue Ling, Zicheng Zhang, Haodong Duan, Haoning Wu, Ziheng Jia, Xiaohong Liu, Xiongkuo Min, Guo Lu, Weisi Lin, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 7570-7581, 2025.
    [Database]

  • Q-Eval-100k: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
    Zicheng Zhang, Tengchuan Kou, Shushi Wang, Chunyi Li, Wei Sun, Wei Wang, Xiaoyu Li, Zongyu Wang, Xuezhi Cao, Xiongkuo Min, Xiaohong Liu, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 10621-10631, 2025.
    [Database & Code]

  • FineVQ: Fine-Grained User Generated Content Video Quality Assessment
    Huiyu Duan, Qiang Hu, Jiarui Wang, Liu Yang, Zitong Xu, Lu Liu, Xiongkuo Min, Chunlei Cai, Tianxiao Ye, Xiaoyun Zhang, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3206-3217, 2025.
    [Database & Code]

  • AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
    Jiarui Wang, Huiyu Duan, Guangtao Zhai, Juntong Wang, and Xiongkuo Min
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 18869-18880, 2025.
    [Database & Code]

  • Q-Bench-Video: Benchmark the Video Quality Understanding of LMMs
    Zicheng Zhang, Ziheng Jia, Haoning Wu, Chunyi Li, Zijian Chen, Yingjie Zhou, Wei Sun, Xiaohong Liu, Xiongkuo Min, Weisi Lin, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp. 3229-3239, 2025.
    [Database]

  • LMM4LMM: Benchmarking and Evaluating Large-Multimodal Image Generation with LMMs
    Jiarui Wang, Huiyu Duan, Yu Zhao, Juntong Wang, Guangtao Zhai, and Xiongkuo Min
    IEEE/CVF International Conference on Computer Vision (ICCV), pp. 17312-17323, 2025.
    [Database & Code]

  • Information Density Principle for MLLM Benchmarks
    Chunyi Li, Xiaozhe Li, Zicheng Zhang, Yuan Tian, Ziheng Jia, Xiaohong Liu, Xiongkuo Min, Jia Wang, Haodong Duan, Kai Chen, and Guangtao Zhai
    IEEE/CVF International Conference on Computer Vision (ICCV), pp. 4167-4177, 2025.
    [Database]

  • Who Is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
    Yingjie Zhou, Jiezhang Cao, Zicheng Zhang, Farong Wen, Yanwei Jiang, Jun Jia, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    IEEE/CVF International Conference on Computer Vision (ICCV), pp. 12201-12211, 2025.

  • FPEM: Face Prior Enhanced Facial Attractiveness Prediction for Live Videos with Face Retouching
    Hui Li, Xiaoyu Ren, Hongjiu Yu, Ying Chen, Kai Li, L Wang, Xiongkuo Min, Huiyu Duan, Guangtao Zhai, and Xu Liu
    IEEE/CVF International Conference on Computer Vision (ICCV), pp. 11458-11468, 2025.
    [Database & Code]

  • Textured Mesh Saliency: Bridging Geometry and Texture for Human Perception in 3D Graphics
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, and Guangtao Zhai
    AAAI Conference on Artificial Intelligence (AAAI), pp. 9977-9984, 2025.
    [Database & Code]

  • AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
    Yuqin Cao, Xiongkuo Min, Yixuan Gao, Wei Sun, and Guangtao Zhai
    International Conference on Machine Learning (ICML), vol. 267, pp. 6615-6633, 2025.
    [Database & Code]

  • Redundancy Principles for MLLMs Benchmarks
    Zicheng Zhang, Xiangyu Zhao, Xinyu Fang, Chunyi Li, Xiaohong Liu, Xiongkuo Min, Haodong Duan, Kai Chen, and Guangtao Zhai
    Annual Meeting of the Association for Computational Linguistics (Long Papers) (ACL), pp. 12492-12504, 2025.
    [Database]

  • Multi-Dimensional Text-to-Face Image Quality Assessment Using LLM: Database and Method
    Yixuan Gao, Xiongkuo Min, Jinliang Han, Yuqin Cao, Sijing Wu, Yunze Dou, and Guangtao Zhai
    ACM International Conference on Multimedia (MM), pp. 6948-6957, 2025.

  • Towards a New Paradigm of Visual Signal Compression
    Chunyi Li, Xiele Wu, Haoning Wu, Donghui Feng, Zicheng Zhang, Guo Lu, Xiongkuo Min, Xiaohong Liu, Guangtao Zhai, and Weisi Lin
    ACM International Conference on Multimedia (MM), pp. 12934-12941, 2025.
    [Code]

  • LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
    Zitong Xu, Huiyu Duan, Bingnan Liu, Guangji Ma, Jiarui Wang, Liu Yang, Shiqi Gao, Xiaoyu Wang, Jia Wang, Xiongkuo Min, Guangtao Zhai, and Weisi Lin
    ACM International Conference on Multimedia (MM), pp. 6908-6917, 2025.
    [Database & Code]

  • RGC-VQA: An Exploration Database for Robotic-Generated Video Quality Assessment
    Jianing Jin, Jiangyong Ying, Huiyu Duan, Liu Yang, Sijing Wu, Yunhao Li, Yushuo Zheng, Xiongkuo Min, and Guangtao Zhai
    ACM International Conference on Multimedia (MM), pp. 13413-13420, 2025.
    [Database]

  • GoBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs
    Xiaorong Zhu, Ziheng Jia, Jiarui Wang, Xiangyu Zhao, Haodong Duan, Xiongkuo Min, Jia Wang, Zicheng Zhang, and Guangtao Zhai
    ACM International Conference on Multimedia (MM), pp. 12690-12697, 2025.
    [Database]

  • DFBench: Benchmarking Deepfake Image Detection Capability of Large Multimodal Models
    Jiarui Wang, Huiyu Duan, Juntong Wang, Ziheng Jia, Woo Yi Yang, Xiaorong Zhu, Yu Zhao, Jiaying Qian, Yuke Xing, Guangtao Zhai, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), pp. 12666-12673, 2025.
    [Database & Code]

  • LMME3DHF: Benchmarking and Evaluating Multimodal 3D Human Face Generation with LMMs
    Woo Yi Yang, Jiarui Wang, Sijing Wu, Huiyu Duan, Yuxin Zhu, Liu Yang, Kang Fu, Guangtao Zhai, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), pp. 8825-8834, 2025.
    [Database & Code]

  • EEmo-Bench: A Benchmark for Multi-Modal Large Language Models on Image Evoked Emotion Assessment
    Lancheng Gao, Ziheng Jia, Yunhao Zeng, Wei Sun, Yiming Zhang, Wei Zhou, Guangtao Zhai, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), pp. 7064-7073, 2025.
    [Database]

  • Omni2: Unifying Omnidirectional Image Generation and Editing in an Omni Model
    Liu Yang, Huiyu Duan, Yucheng Zhu, Xiaohong Liu, Lu Liu, Zitong Xu, Guangji Ma, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    ACM International Conference on Multimedia (MM), pp. 10103-10112, 2025.
    [Code]

  • Towards Explainable Partial-AIGC Image Quality Assessment
    Jiaying Qian, Ziheng Jia, Zicheng Zhang, Zeyu Zhang, Guangtao Zhai, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), pp. 6761-6770, 2025.
    [Database & Code]

  • Human-Activity AGV Quality Assessment: A Benchmark Dataset and an Objective Evaluation Metric
    Zhichao Zhang, Wei Sun, Xinyue Li, Yunhao Li, Qihang Ge, Jun Jia, Zicheng Zhang, Zhongpeng Ji, Fengyu Sun, Shangling Jui, Xiongkuo Min, and Guangtao Zhai
    ACM International Conference on Multimedia (MM), pp. 6771-6780, 2025.
    [Database & Code]

  • VQA2: Visual Question Answering for Video Quality Assessment
    Ziheng Jia, Zicheng Zhang, Jiaying Qian, Haoning Wu, Wei Sun, Chunyi Li, Xiaohong Liu, Weisi Lin, Guangtao Zhai, and Xiongkuo Min
    ACM International Conference on Multimedia (MM), pp. 6751-6760, 2025.
    [Database & Code]

  • Engagement Prediction of Short Videos with Large Multimodal Models
    Wei Sun, Linhan Cao, Yuqin Cao, Weixia Zhang, Wen Wen, Kaiwei Zhang, Zijian Chen, Fangfang Lu, Xiongkuo Min, and Guangtao Zhai
    IEEE/CVF International Conference on Computer Vision Workshops (ICCVW), pp. 3443-3452, 2025.
    [Code]
    Winner Award of the IEEE/CVF ICCV VQualA 2025 Engagement Prediction for Short Videos Challenge

  • Efficient Face Image Quality Assessment via Self-training and Knowledge Distillation
    Wei Sun, Weixia Zhang, Linhan Cao, Jun Jia, Xiangyang Zhu, Dandan Zhu, Xiongkuo Min, and Guangtao Zhai
    arXiv:2507.15709, 2025.
    [Code]
    Winner Award of the IEEE/CVF ICCV VQualA 2025 Face Image Quality Assessment Challenge

   Journal

  • Study of Subjective and Objective Naturalness Assessment of AI-Generated Images
    Zijian Chen, Wei Sun, Haoning Wu, Zicheng Zhang, Jun Jia, Ru Huang, Xiongkuo Min, Guangtao Zhai, and Wenjun Zhang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 4, pp. 3573-3588, 2025.
    [Database & Code]

  • Explain Vision Focus: Blending Human Saliency Into Synthetic Face Images
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, Huiyu Duan, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 27, pp. 489-502, 2025.
    [Database & Code]

  • Time-Smooth Wireless Transmission of Probabilistic Slicing VR 360 Video in MISO-OFDM Systems
    Long Teng, Guangtao Zhai, Yongpeng Wu, Xiongkuo Min, Biqian Feng, Yucheng Zhu, and Wenjun Zhang
    IEEE Transactions on Communications (TCOM), vol. 73, no. 5, pp. 3409-3422, 2025.

  • Energy-Efficient VR 360 Video Streaming in the IRS-Aided Rate-Splitting Multiple Access Network
    Long Teng, Qingqing Wu, Huiyu Duan, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Communications (TCOM), vol. 73, no. 8, pp. 6840-6853, 2025.

  • Quality-guided Skin Tone Enhancement for Portrait Photography
    Shiqi Gao, Huiyu Duan, Xinyue Li, Kang Fu, Yicong Peng, Qihang Xu, Yuanyuan Chang, Jia Wang, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 27, pp. 171-185, 2025.

  • Evaluating Point Cloud from Moving Camera Videos: A No-Reference Metric
    Zicheng Zhang, Wei Sun, Yucheng Zhu, Xiongkuo Min, Wei Wu, Ying Chen, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 27, pp. 927-939, 2025.
    [Code]
    ESI Highly Cited Paper

  • Large Multimodal Models Evaluation: A Survey
    Zicheng Zhang, …, Xiongkuo Min, et al.
    SCIENCE CHINA Information Sciences (SCIS), vol. 68, no. 12, pp. 221301:1-221301:40, 2025.

  • Elevating Mesh Saliency in VR: Introducing a Novel Prediction Network and Dataset
    Kaiwei Zhang, Mohan He, Dandan Zhu, Kun Zhu, Xiongkuo Min, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 21, no. 12, pp. 363:1-363:22, 2025.

  • Subjective and Objective Audio-Visual Quality Assessment for Omnidirectional Videos
    Xilei Zhu, Huiyu Duan, Yuqin Cao, Yucheng Zhu, Yuxin Zhu, Jing Liu, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    IEEE Transactions on Image Processing (TIP), vol. 34, pp. 6506-6523, 2025.

  • Benchmarking Multi-dimensional AIGC Video Quality Assessment: A Dataset and Unified Model
    Zhichao Zhang, Wei Sun, Li Xinyue, Jun Jia, Xiongkuo Min, Zicheng Zhang, Chunyi Li, Zijian Chen, Wang Puyi, Fengyu Sun, Shangling Jui, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 21, no. 9, pp. 269:1-269:24, 2025.

  • Blind Image Quality Assessment by Gaussian Mixture Distribution
    Yixuan Gao, Xiongkuo Min, Yuqin Cao, Weisi Lin, Bu Sung Lee, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 34, pp. 4660-4675, 2025.
    [Code]

  • From Haziness to Clarity: A Novel Iterative Memory-Retrospective Emergence Model for Omnidirectional Image Saliency Prediction
    Dandan Zhu, Kaiwei Zhang, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Image Processing (TIP), vol. 34, pp. 3944-3959, 2025.

  • Advancing Zero-Shot Digital Human Quality Assessment Through Text-Prompted Evaluation
    Zicheng Zhang, Wei Sun, Yingjie Zhou, Haoning Wu, Chunyi Li, Xiongkuo Min, Xiaohong Liu, Guangtao Zhai, and Weisi Lin
    IEEE Transactions on Image Processing (TIP), vol. 34, pp. 3503-3517, 2025.
    [Database]

  • Who Is a Better Imitator: Subjective and Objective Quality Assessment of Animated Humans
    Yingjie Zhou, Zicheng Zhang, Jun Jia, Yanwei Jiang, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 10, pp. 10047-10058, 2025.
    [Database]

  • LMM-VQA: Advancing Video Quality Assessment With Large Multimodal Models
    Qihang Ge, Wei Sun, Yu Zhang, Yunhao Li, Zhongpeng Ji, Fengyu Sun, Shangling Jui, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 11, pp. 11083-11096, 2025.

  • R-Bench: Are Your Large Multimodal Model Robust to Real-World Corruptions?
    Chunyi Li, Jianbo Zhang, Zicheng Zhang, Haoning Wu, Yuan Tian, Wei Sun, Guo Lu, Xiongkuo Min, Xiaohong Liu, Weisi Lin, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), vol. 19, no. 7, pp. 1349-1361, 2025.
    [Database]

  • How Does Audio Influence Visual Attention in Omnidirectional Videos? Database and Model
    Yuxin Zhu, Huiyu Duan, Kaiwei Zhang, Yucheng Zhu, Xilei Zhu, Long Teng, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 34, pp. 3447-3462, 2025.
    [Database & Code]

  • LCIQA: A Lightweight Contrastive-Learning Framework for Image Quality Assessment via Cross-Scale Consistency Minimization
    Chenxi Feng, Xiongkuo Min, Long Ye, and Yinghao Yang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 10, pp. 9986-9999, 2025.

  • MM-PCQA+: Advancing Multi-Modal Learning for Point Cloud Quality Assessment
    Zicheng Zhang, Yingjie Zhou, Chunyi Li, Wei Sun, Xiongkuo Min, Xiaohong Liu, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 21, no. 4, pp. 119:1-119:22, 2025.

  • ESIQA: Perceptual Quality Assessment of Vision-Pro-based Egocentric Spatial Images
    Xilei Zhu, Liu Yang, Huiyu Duan, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    IEEE Transactions on Visualization and Computer Graphics (TVCG), vol. 31, no. 5, pp. 2277-2287, 2025.
    [Database & Code]

  • Unified Approach to Mesh Saliency: Evaluating Textured and Non-Textured Meshes Through VR and Multifunctional Prediction
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Visualization and Computer Graphics (TVCG), vol. 31, no. 5, pp. 3151-3160, 2025.

  • ScanDTM: A Novel Dual-Temporal Modulation Scanpath Prediction Model for Omnidirectional Images
    Dandan Zhu, Kaiwei Zhang, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 8, pp. 7850-7865, 2025.

  • Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
    Kang Fu, Huiyu Duan, Zicheng Zhang, Xiaohong Liu, Xiongkuo Min, Jia Wang, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 27, pp. 8145-8159, 2025.
    [Database]

  • Exploring Rich Subjective Quality Information for Image Quality Assessment in the Wild
    Xiongkuo Min, Yixuan Gao, Yuqin Cao, Guangtao Zhai, Wenjun Zhang, Huifang Sun, and Chang Wen Chen
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 8, pp. 7778-7791, 2025.
    [Code]
    ESI Highly Cited Paper

  • Joint Luminance-Chrominance Learning for Image Debanding
    Zijian Chen, Wei Sun, Jun Jia, Ru Huang, Fangfang Lu, Ying Chen, Xiongkuo Min, Guangtao Zhai, and Wenjun Zhang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 8, pp. 7747-7761, 2025.

  • Aggregate and Discriminate: Pseudo Clips-Guided Boundary Perception for Video Moment Retrieval
    Jin Liu, Zongbing Zhang, Yuting Su, Bing Yang, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 27, pp. 4819-4830, 2025.

  • Full-Reference and No-Reference Quality Assessment for Video Frame Interpolation
    Jinliang Han, Xiongkuo Min, Jun Jia, Yixuan Gao, Xiaohong Liu, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 7, pp. 6575-6588, 2025.

2024

   Journal

  • Perceptual Video Quality Assessment: A Survey
    Xiongkuo Min, Huiyu Duan, Wei Sun, Yucheng Zhu, and Guangtao Zhai
    SCIENCE CHINA Information Sciences, vol. 67, no. 11, pp. 211301:1–211301:57, 2024.

  • AGIQA-3K: An Open Database for AI-Generated Image Quality Assessment
    Chunyi Li, Zicheng Zhang, Haoning Wu, Wei Sun, Xiongkuo Min, Xiaohong Liu, Guangtao Zhai, and Weisi Lin
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 8, pp. 6833-6846, 2024.
    [Database]
    ESI Highly Cited Paper

  • Unified Audio-visual Saliency Model for Omnidirectional Videos with Spatial Audio
    Dandan Zhu, Kaiwei Zhang, Nana Zhang, Qiangqiang Zhou, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Multimedia (TMM), vol. 26, pp. 764-775, 2024.

  • No-Reference Image Quality Assessment: Obtain MOS from Image Quality Score Distribution
    Yixuan Gao, Xiongkuo Min, Yuqin Cao, Xiaohong Liu, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 35, no. 2, pp. 1840-1854, 2024.

  • Blind Image Quality Assessment: A Fuzzy Neural Network for Opinion Score Distribution Prediction
    Yixuan Gao, Xiongkuo Min, Yucheng Zhu, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 3, pp. 1641-1655, 2024.
    [Code]

  • Synergetic Assessment of Quality and Aesthetic: Approach and Comprehensive Benchmark Dataset
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, Zhongpai Gao, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 4, pp. 2536-2549, 2024.

  • Un-Gaze: A Unified Transformer for Joint Gaze-Location and Gaze-Object Detection
    Danyang Tu, Wei Shen, Wei Sun, Xiongkuo Min, Guangtao Zhai, and Chang Wen Chen
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 5, pp. 3271-3285, 2024.

  • Hidden Barcode in Sub-Images with Invisible Locating Marker
    Jun Jia, Zhongpai Gao, Yiwei Yang, Wei Sun, Dandan Zhu, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 20, no. 10, pp. 302:1-302:24, 2024.

  • Pixel-Learnable 3DLUT With Saturation-Aware Compensation for Image Enhancement
    Jing Liu, Qingying Li, Xiongkuo Min, Yuting Su, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Multimedia (TMM), vol. 26, pp. 11219-11231, 2024.

  • Continuous and Overall Quality of Experience Evaluation for Streaming Video Based on Rich Features Exploration and Dual-Stage Attention
    Ziheng Jia, Xiongkuo Min, Wei Sun, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 11, pp. 11709-11723, 2024.

  • Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
    Wei Sun, Wen Wen, Xiongkuo Min, Long Lan, Guangtao Zhai, and Kede Ma
    IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), vol. 46, no. 11, pp. 7056-7071, 2024.
    [Code]

  • How is Visual Attention Influenced by Text Guidance? Database and Model
    Yinan Sun, Xiongkuo Min, Huiyu Duan, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 33, pp. 5392-5407, 2024.
    [Database & Code]

  • GMS-3DQA: Projection-Based Grid Mini-patch Sampling for 3D Model Quality Assessment
    Zicheng Zhang, Wei Sun, Haoning Wu, Yingjie Zhou, Chunyi Li, Zijian Chen, Xiongkuo Min, Guangtao Zhai, and Weisi Lin
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 20, no. 6, pp. 178:1-178:19, 2024.
    [Code]

  • BAND-2k: Banding Artifact Noticeable Database for Banding Detection and Quality Assessment
    Zijian Chen, Wei Sun, Jun Jia, Fangfang Lu, Zicheng Zhang, Jing Liu, Ru Huang, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 34, no. 7, pp. 6347-6362, 2024.
    [Database & Code]

  • MTCAM: A Novel Weakly-Supervised Audio-Visual Saliency Prediction Model With Multi-Modal Transformer
    Dandan Zhu, Kun Zhu, Weiping Ding, Nana Zhang, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Emerging Topics in Computational Intelligence (TETCI), vol. 8, no. 2, pp. 1756-1771, 2024.

  • Quality-of-Experience Evaluation for Digital Twins in 6G Network Environments
    Zicheng Zhang, Yingjie Zhou, Long Teng, Wei Sun, Chunyi Li, Xiongkuo Min, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Transactions on Broadcasting (TBC), vol. 70, no. 3, pp. 995-1007, 2024.
    Best Paper Award

   Conference

  • Subjective and Objective Quality-of-Experience Assessment for 3D Talking Heads
    Yingjie Zhou, Zicheng Zhang, Wei Sun, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), pp. 6033-6042, 2024.
    [Database & Code]

  • LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
    Zicheng Zhang, Haoning Wu, Yingjie Zhou, Chunyi Li, Wei Sun, Chaofeng Chen, Xiongkuo Min, Xiaohong Liu, Weisi Lin, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), pp. 7783-7792, 2024.
    [Code]
    Best Paper Nomination

  • Large Multi-modality Model Assisted AI-Generated Image Quality Assessment
    Puyi Wang, Wei Sun, Zicheng Zhang, Jun Jia, Yanwei Jiang, Zhichao Zhang, Xiongkuo Min, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), pp. 7803-7812, 2024.
    [Code]

  • Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
    Tengchuan Kou, Xiaohong Liu, Zicheng Zhang, Chunyi Li, Haoning Wu, Xiongkuo Min, Guangtao Zhai, and Ning Liu
    ACM International Conference on Multimedia (ACM MM), pp. 7793-7802, 2024.
    [Database & Code]

  • GAIA: Rethinking Action Quality Assessment for AI-Generated Videos
    Zijian Chen, Wei Sun, Yuan Tian, Jun Jia, Zicheng Zhang, Jiarui Wang, Ru Huang, Xiongkuo Min, Guangtao Zhai, and Wenjun Zhang
    The Thirty-Eighth Annual Conference on Neural Information Processing Systems (NeurIPS), 2024.
    [Database]

  • UniProcessor: A Text-Induced Unified Low-Level Image Processor
    Huiyu Duan, Xiongkuo Min, Sijing Wu, Wei Shen, and Guangtao Zhai
    European Conference on Computer Vision (ECCV), pp. 180-199, 2024.
    [Code]

  • GLARE: Low Light Image Enhancement via Generative Latent Feature Based Codebook Retrieval
    Han Zhou, Wei Dong, Xiaohong Liu, Shuaicheng Liu, Xiongkuo Min, Guangtao Zhai, and Jun Chen
    European Conference on Computer Vision (ECCV), pp. 36-54, 2024.
    [Code]

  • Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels
    Haoning Wu, Zicheng Zhang, Weixia Zhang, Chaofeng Chen, Liang Liao, Chunyi Li, Yixuan Gao, Annan Wang, Erli Zhang, Wenxiu Sun, Qiong Yan, Xiongkuo Min, Guangtao Zhai, and Weisi Lin
    International Conference on Machine Learning (ICML), 2024.
    [Project]

  • NTIRE 2024 Quality Assessment of AI-Generated Content Challenge
    Xiaohong Liu, Xiongkuo Min, Guangtao Zhai, Chunyi Li, Tengchuan Kou, Wei Sun, Haoning Wu, Yixuan Gao, Yuqin Cao, Zicheng Zhang, Xiele Wu, Radu Timofte, et al.
    IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), 2024, pp. 6337-6362.
    [Challenge - Track 1] [Challenge - Track 2]

  • Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
    Wei Sun, Haoning Wu, Zicheng Zhang, Jun Jia, Zhichao Zhang, Linhan Cao, Qiubo Chen, Xiongkuo Min, Weisi Lin, and Guangtao Zhai
    arXiv preprint arXiv:2405.08745, 2024.
    [Code]
    Winner Award of the IEEE/CVF CVPR NTIRE 2024 Challenge on Short-form UGC Video Quality Assessment

  • Assessing UHD Image Quality from Aesthetics, Distortions, and Saliency
    Wei Sun, Weixia Zhang, Yuqin Cao, Linhan Cao, Jun Jia, Zijian Chen, Zicheng Zhang, Xiongkuo Min, Guangtao Zhai
    arXiv:2409.00749, 2024.
    [Code]
    The 1st Place Award of the ECCV AIM 2024 Challenge on UHD Blind Photo Quality Assessment

  • DSA-QoE: Quality of Experience Evaluation for Streaming Video Based on Dual-Stage Attention
    Ziheng Jia, Xiongkuo Min, and Guangtao Zhai
    IEEE International Symposium on Circuits and Systems (ISCAS), pp. 1-5, 2024.
    IEEE VSPC-TC (The Visual Signal Processing and Communications Technical Committee) Best Paper Award

2023

   Journal

  • Attention-Guided Neural Networks for Full-Reference and No-Reference Audio-Visual Quality Assessment
    Yuqin Cao, Xiongkuo Min, Wei Sun, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 32, pp. 1882-1896, 2023.
    [Code]

  • Subjective and Objective Audio-Visual Quality Assessment for User Generated Content
    Yuqin Cao, Xiongkuo Min, Wei Sun, and Guangtao Zhai
    IEEE Transactions on Image Processing (TIP), vol. 32, pp. 3847-3861, 2023. [Database & Code]

  • Blind Image Quality Assessment for Pathological Microscopic Image under Screen and Immersion Scenarios
    Yifei Guo, Menghan Hu, Xiongkuo Min, Yan Wang, Min Dai, Guangtao Zhai, Xiao-Ping Zhang, and Xiaokang Yang
    IEEE Transactions on Medical Imaging (TMI), vol. 42, no. 11, pp.3295-3306, 2023.
    [Database & Code]

  • Blind Quality Assessment for in-the-Wild Images via Hierarchical Feature Fusion and Iterative Mixed Database Training
    Wei Sun, Xiongkuo Min, Danyang Tu, Siwei Ma, and Guangtao Zhai
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), vol. 17, no. 6, pp. 1178-1192, 2023.
    [Code]

ESI Highly Cited Paper

  • Attentive Deep Image Quality Assessment for Omnidirectional Stitching
    Huiyu Duan, Xiongkuo Min, Wei Sun, Yucheng Zhu, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), vol. 17, no. 6, pp. 1150-1164, 2023.
    [Database(TeraBox)] [Database(BaiduCloud)]

  • Develop then Rival: A Human Vision-Inspired Framework for Superimposed Image Decomposition
    Huiyu Duan, Wei Shen, Xiongkuo Min, Yuan Tian, Jae-Hyun Jung, Xiaokang Yang, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 25, pp. 4267-4281, 2023.

  • A Novel Lightweight Audio-visual Saliency Model for Videos
    Dandan Zhu, Xuan Shao, Qiangqiang Zhou, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 19, no. 4, pp. 147:1-147:22, 2023.

  • Toward Visual Behavior and Attention Understanding for Augmented 360 Degree Videos
    Yucheng Zhu, Xiongkuo Min, Dandan Zhu, Guangtao Zhai, Xiaokang Yang, Wenjun Zhang, Ke Gu, and Jiantao Zhou
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 19, no. 2s, pp. 99:1-99:24, 2023.

  • Subjective and Objective Quality Assessment for in-the-Wild Computer Graphics Images
    Zicheng Zhang, Wei Sun, Yingjie Zhou, Jun Jia, Zhichao Zhang, Jing Liu, Xiongkuo Min, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications and Applications (TOMM), vol. 20, no. 4, pp. 96:1-96:22, 2023.
    [Database]

  • Image Quality Score Distribution Prediction via Alpha Stable Model
    Yixuan Gao, Xiongkuo Min, Wenhan Zhu, Xiao-Ping Zhang, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 33, no. 6, pp. 2656-2671, 2023.
    [Database & Code]

  • Deep Neural Network for Blind Visual Quality Assessment of 4K Content
    Wei Lu, Wei Sun, Xiongkuo Min, Wenhan Zhu, Quan Zhou, Jun He, Qiyuan Wang, Zicheng Zhang, Tao Wang, and Guangtao Zhai
    IEEE Transactions on Broadcasting (TBC), vol. 69, no. 2, pp. 406-421, 2023.

  • Toward a No-Reference Quality Metric for Camera-Captured Images
    Runze Hu, Yutao Liu, Ke Gu, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Cybernetics (TCYB), vol. 53, no. 6, pp. 3651-3664, 2023.

  • Blind Image Quality Assessment Via Cross-View Consistency
    Yucheng Zhu, Yunhao Li, Wei Sun, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Multimedia (TMM), vol. 25, pp. 7364-7377, 2023.

  • RIVIE: Robust Inherent Video Information Embedding
    Jun Jia, Zhongpai Gao, Dandan Zhu, Xiongkuo Min, Menghan Hu, and Guangtao Zhai
    IEEE Transactions on Multimedia (TMM), vol. 25, pp. 7607-7620, 2023.

  • A Deep Learning Based Multi-Dimensional Aesthetic Quality Assessment Method for Mobile Game Images
    Tao Wang, Wei Sun, Wei Wu, Ying Chen, Xiongkuo Min, Wei Lu, Zicheng Zhang, and Guangtao Zhai
    IEEE Transactions on Games (ToG), vol. 15, no. 4, pp. 658-668, 2023.

  • Implicit Neural Representation Learning for Hyperspectral Image Super-Resolution
    Kaiwei Zhang, Dandan Zhu, Xiongkuo Min, and Guangtao Zhai
    IEEE Transactions on Geoscience and Remote Sensing (TGRS), vol. 61, p. 5500212, 2023.
    [Code]

   Conference

  • MM-PCQA: Multi-Modal Learning for No-reference Point Cloud Quality Assessment
    Zicheng Zhang, Wei Sun, Xiongkuo Min, Quan Zhou, Jun He, Qiyuan Wang, and Guangtao Zhai
    International Joint Conference on Artificial Intelligence (IJCAI), pp. 1759-1767, 2023.
    [Code]

  • StableVQA: A Deep No-Reference Quality Assessment Model for Video Stability
    Tengchuan Kou, Xiaohong Liu, Wei Sun, Jun Jia, Xiongkuo Min, Guangtao Zhai, and Ning Liu
    ACM International Conference on Multimedia (ACM MM), 2023, pp. 1066-1076.
    [Code]

  • MD-VQA: Multi-Dimensional Quality Assessment for UGC Live Videos
    Zicheng Zhang, Wei Wu, Wei Sun, Danyang Tu, Wei Lu, Xiongkuo Min, Ying Chen, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2023, pp. 1746-1755.
    [Database]

  • VDPVE: VQA Dataset for Perceptual Video Enhancement
    Yixuan Gao, Yuqin Cao, Tengchuan Kou, Wei Sun, Yunlong Dong, Xiaohong Liu, Xiongkuo Min, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), 2023, pp. 1474-1483.
    [Challenge] [Database]

  • NTIRE 2023 Quality Assessment of Video Enhancement Challenge
    Xiaohong Liu, Radu Timofte, Yunlong Dong, Zhiliang Ma, Haotian Fan, Chunzheng Zhu, Xiongkuo Min, Guangtao Zhai, Ziheng Jia, Mirko Agarla, Shiqi Zhou, Wei Sun, Yixuan Gao, Yulun Zhang, Yuqin Cao, Hongye Liu, Wenqi Wang, Kai Zhang, Tengchuan Kou, Hang Shi, Ironhead Chuang, Haoning Wu, Tengfei Shi, Yilin Li, Yu Lai, Kai Zhao, Heng Cong, Zhiwei Huang, Shiling Zhao, Hanene Brachemi Meftah, and Azadeh Mansouri
    IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), 2023, pp. 1551-1569.
    [Challenge]

  • The Influence of Text-guidance on Visual Attention
    Yinan Sun, Xiongkuo Min, Huiyu Duan, and Guangtao Zhai
    IEEE International Symposium on Circuits and Systems (ISCAS), 2023, pp. 1-5.
    IEEE MSA-TC Best Paper Award - Honorable Mention

  • AIGCIQA2023: A Large-scale Image Quality Assessment Database for AI Generated Images: From the Perspectives of Quality, Authenticity and Correspondence
    Jiarui Wang, Huiyu Duan, Jing Liu, Shi Chen, Xiongkuo Min, and Guangtao Zhai
    CAAI International Conference on Artificial Intelligence (CICAI), 2023, pp. 46–57.
    [Database]

  • Simple Baselines for Projection-based Full-reference and No-reference Point Cloud Quality Assessment
    Zicheng Zhang, Yingjie Zhou, Wei Sun, Xiongkuo Min, and Guangtao Zhai
    arXiv preprint arXiv:2310.17147, 2023.
    Winner Prize of the IEEE ICIP Point Cloud Visual Quality Assessment Grand Challenge

2022

   Journal

  • Screen Content Quality Assessment: Overview, Benchmark, and Beyond
    Xiongkuo Min, Ke Gu, Guangtao Zhai, Xiaokang Yang, Wenjun Zhang, Patrick Le Callet, and Chang Wen Chen
    ACM Computing Surveys (CSUR), vol. 54, no. 9, pp. 1-36, 2022.
    ESI Highly Cited Paper

  • Confusing Image Quality Assessment: Toward Better Augmented Reality Experience
    Huiyu Duan, Xiongkuo Min, Yucheng Zhu, Guangtao Zhai, Xiaokang Yang, and Patrick Le Callet
    IEEE Transactions on Image Processing (TIP), vol. 31, pp. 7206-7221, 2022.
    [Database & Code]

  • No-Reference Quality Assessment for 3D Colored Point Cloud and Mesh Models
    Zicheng Zhang, Wei Sun, Xiongkuo Min, Tao Wang, Wei Lu, and Guangtao Zhai
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 32, no. 11, pp. 7618-7631, 2022.
    [Code]

  • Viewing Behavior Supported Visual Saliency Predictor for 360 Degree Videos
    Yucheng Zhu, Guangtao Zhai, Yiwei Yang, Huiyu Duan, Xiongkuo Min, and Xiaokang Yang
    IEEE Transactions on Circuits and Systems for Video Technology (TCSVT), vol. 32, no. 7, pp. 4188-4201, 2022.
    Grand Prize of IEEE ICME 2018 Salient360! Grand Challenge

  • QoE Driven VR 360° Video Massive MIMO Transmission
    Long Teng, Guangtao Zhai, Yongpeng Wu, Xiongkuo Min, Wenjun Zhang, Zhi Ding, and Chengshan Xiao
    IEEE Transactions on Wireless Communications (TWC), vol. 21, no. 1, pp. 18-33, 2022.

  • RIHOOP: Robust Invisible Hyperlinks in Offline and Online Photographs
    Jun Jia, Zhongpai Gao, Kang Chen, Menghan Hu, Xiongkuo Min, Guangtao Zhai, and Xiaokang Yang
    IEEE Transactions on Cybernetics (TCYB), vol. 52, no. 7, pp. 7094-7106, 2022.

  • SMGEA: A New Ensemble Adversarial Attack Powered by Long-Term Gradient Memories
    Zhaohui Che, Ali Borji, Guangtao Zhai, Suiyi Ling, Jing Li, Xiongkuo Min, Guodong Guo, and Patrick Le Callet
    IEEE Transactions on Neural Networks and Learning Systems (TNNLS), vol. 33, no. 3, pp. 1051-1065, 2022.
    [Code]

  • Dynamic Backlight Scaling Considering Ambient Luminance for Mobile Videos on LCD Displays
    Wei Sun, Xiongkuo Min, Guangtao Zhai, Ke Gu, Siwei Ma, and Xiaokang Yang
    IEEE Transactions on Mobile Computing (TMC), vol. 21, no. 1, pp. 110-124, 2022.
    [Database]

  • HazDesNet: An End-to-End Network for Haze Density Prediction
    Jiahe Zhang, Xiongkuo Min, Yucheng Zhu, Guangtao Zhai, Jiantao Zhou, Xiaokang Yang, and Wenjun Zhang
    IEEE Transactions on Intelligent Transportation Systems (TITS), vol. 23, no. 4, pp. 3087-3102, 2022.
    [Code & Database]

   Conference

  • Perceptual Attacks of No-Reference Image Quality Models with Human-in-the-Loop
    Weixia Zhang, Dingquan Li, Xiongkuo Min, Guangtao Zhai, Guodong Guo, Xiaokang Yang, and Kede Ma
    Advances in Neural Information Processing Systems (NeurIPS), 2022, vol. 35, pp. 2916-2929.
    [Code]

  • Video-based Human-Object Interaction Detection from Tubelet Tokens
    Danyang Tu, Wei Sun, Xiongkuo Min, Guangtao Zhai, and Wei Shen
    Advances in Neural Information Processing Systems (NeurIPS), 2022, vol. 35, pp. 23345-23357.

  • End-to-End Human-Gaze-Target Detection with Transformers
    Danyan Tu, Xiongkuo Min, Huiyu Duan, Guodong Guo, Guangtao Zhai, and Wei Shen
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2022, pp. 2192-2200.

  • Learning Invisible Markers for Hidden Codes in Offline-to-online Photography
    Jun Jia, Zhongpai Gao, Dandan Zhu, Xiongkuo Min, Guodong Guo, and Guangtao Zhai
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2022, pp. 2273-2282.

  • Iwin: Human-Object Interaction Detection via Transformer with Irregular Windows
    Danyang Tu, Xiongkuo Min, Huiyu Duan, Guodong Guo, Guangtao Zhai, and Wei Shen
    European Conference on Computer Vision (ECCV), 2022, pp. 87-103.

  • Image Quality Assessment: From Mean Opinion Score to Opinion Score Distribution
    Yixuan Gao, Xiongkuo Min, Yucheng Zhu, Jing Li, Xiao-Ping Zhang, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), 2022, pp. 997–1005.
    [Code]

  • A Deep Learning based No-reference Quality Assessment Model for UGC Videos
    Wei Sun, Xiongkuo Min, Wei Lu, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), 2022, pp. 856-865.
    [Code]

  • Saliency in Augmented Reality
    Huiyu Duan, Wei Shen, Xiongkuo Min, Danyang Tu, Jing Li, and Guangtao Zhai
    ACM International Conference on Multimedia (ACM MM), 2022, pp. 6549-6558.
    [Database & Code]

  • SMESwin Unet: Merging CNN and Transformer for Medical Image Segmentation
    Ziheng Wang, Xiongkuo Min, Fangyu Shi, Ruinian Jin, Saida S Nawrin, Ichen Yu, and Ryoichi Nagatomi
    International Conference on Medical Image Computing and Computer-Assisted Intervention (MICCAI), 2022, pp. 517–526.

  • Augmented Reality Image Quality Assessment Based on Visual Confusion Theory
    Huiyu Duan, Lantu Guo, Wei Sun, Xiongkuo Min, Li Chen, and Guangtao Zhai
    IEEE International Symposium on Broadband Multimedia Systems and Broadcasting (BMSB), 2022, pp. 1-6.
    [Database & Code]
    Best Paper Award

  • Surveillance Video Quality Assessment Based on Quality Related Retraining
    Zicheng Zhang, Wei Lu, Wei Sun, Xiongkuo Min, Tao Wang, and Guangtao Zhai
    IEEE International Conference on Image Processing (ICIP), 2022, pp. 4278-4282.
    The First Prize of the IEEE ICIP Grand Challenge: Video Distortion Detection and Classification in the Context of Video Surveillance

2021

   Journal

  • Perceptual Quality Assessment of Low-light Image Enhancement
    Guangtao Zhai, Wei Sun, Xiongkuo Min, and Jiantao Zhou
    ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), vol. 17, no. 4, pp. 130:1-130:24, 2021.
    [Code: LIEQA] [Database: LIEQ]

  • Enhancing Decoding Rate of Barcode Decoders in Complex Scenes for IoT Systems
    Adnan Sharif, Guangtao Zhai, Xiongkuo Min, Jun Jia, and Kashif Munir
    IEEE Internet of Things Journal (IoT-J), vol. 8, no. 24, pp. 17495-17507, 2021.

  • Comparative Perceptual Assessment of Visual Signals Using Free Energy Features
    Guangtao Zhai, Yucheng Zhu, and Xiongkuo Min
    IEEE Transactions on Multimedia (TMM), vol. 23, pp. 3700-3713, 2021.

  • Quality Assessment of Free-Viewpoint Videos by Quantifying the Elastic Changes of Multi-Scale Motion Trajectories
    Suiyi Ling, Jing Li, Zhaohui Che, Xiongkuo Min, Guangtao Zhai, and Patrick Le Callet
    IEEE Transactions on Image Processing (TIP), vol. 30, pp. 517-531, 2021.

  • Video Frame Interpolation and Enhancement via Pyramid Recurrent Framework
    Wang Shen, Wenbo Bao, Guangtao Zhai, Li Chen, Xiongkuo Min, and Zhiyong Gao
    IEEE Transactions on Image Processing (TIP), vol. 30, pp. 277-292, 2021.
    [Project & Code]

  • Subjective and Objective Quality Assessment of Compressed Screen Content Videos
    Teng Li, Xiongkuo Min, Heng Zhao, Guangtao Zhai, Yiling Xu, and Wenjun Zhang
    IEEE Transactions on Broadcasting (TBC), vol. 67, no. 2, pp. 438-449, 2021.
    [Database]

  • An Accurate and Efficient 1-D Barcode Detector for Medium of Deployment in IoT Systems
    Adnan Sharif, Guangtao Zhai, Jun Jia, Xiongkuo Min, Xiangyang Zhu, and Jiahe Zhang
    IEEE Internet of Things Journal (IoT-J), vol. 8, no. 2, pp. 889-900, 2021.

   Conference

  • Self-Conditioned Probabilistic Learning of Video Rescaling
    Yuan Tian, Guo Lu, Xiongkuo Min, Zhaohui Che, Guangtao Zhai, Guodong Guo, and Zhiyong Gao
    IEEE/CVF International Conference on Computer Vision (ICCV), 2021, pp. 4490-4499.
    [Code]

  • Deep Learning Based Full-Reference and No-Reference Quality Assessment Models for Compressed UGC Videos
    Wei Sun, Tao Wang, Xiongkuo Min, Fuwang Yi, and Guangtao Zhai
    IEEE International Conference on Multimedia and Expo Workshops (ICMEW), 2021, pp. 1-6.
    [Code]
    First Place Award of IEEE ICME 2021 Grand Challenge on Quality Assessment of Compressed UGC Videos

  • A No-Reference Evaluation Metric for Low-Light Image Enhancement
    Zicheng Zhang, Wei Sun, Xiongkuo Min, Wenhan Zhu, Tao Wang, Wei Lu, and Guangtao Zhai
    IEEE International Conference on Multimedia and Expo (ICME), 2021, pp. 1-6.
    [Code]

2020

   Journal

  • Study of Subjective and Objective Quality Assessment of Audio-Visual Signals
    Xiongkuo Min, Guangtao Zhai, Jiantao Zhou, Mylene C.Q. Farias, and Alan Conrad Bovik
    IEEE Transactions on Image Processing (TIP), vol. 29, pp. 6054–6068, 2020.
    [Code] [LIVE-SJTU A/V-QA Database]

  • A Multimodal Saliency Model for Videos With High Audio-Visual Correspondence
    Xiongkuo Min, Guangtao Zhai, Jiantao Zhou, Xiao-Ping Zhang, Xiaokang Yang, and Xinping Guan
    IEEE Transactions on Image Processing (TIP), vol. 29, pp. 3805-3819, 2020.
    [Code] [AVA Database]

  • A Metric for Light Field Reconstruction, Compression, and Display Quality Evaluation
    Xiongkuo Min, Jiantao Zhou, Guangtao Zhai, Patrick Le Callet, Xiaokang Yang, and Xinping Guan
    IEEE Transactions on Image Processing (TIP), vol. 29, pp. 3790-3804, 2020.
    [Code]

  • Learning a Deep Agent to Predict Head Movement in 360-Degree Images
    Yucheng Zhu, Guangtao Zhai, Xiongkuo Min, and Jiantao Zhou
    ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), vol. 16, no. 4, pp. 130:1-130:23, 2020.

  • The Prediction of Saliency Map for Head and Eye Movements in 360 Degree Images
    Yucheng Zhu, Guangtao Zhai, Xiongkuo Min, and Jiantao Zhou,
    IEEE Transactions on Multimedia (TMM), vol. 22, no. 9, pp. 2331-2344, 2020.

  • How is Gaze Influenced by Image Transformations? Dataset and Model
    Zhaohui Che, Ali Borji, Guangtao Zhai, Xiongkuo Min, Guodong Guo, and Patrick Le Callet
    IEEE Transactions on Image Processing (TIP), vol. 29, pp. 2287-2300, 2020.
    [Code] [Database]

  • MC360IQA: The Multi-Channel CNN for Blind 360-Degree Image Quality Assessment
    Wei Sun, Xiongkuo Min, Guangtao Zhai, Ke Gu, Huiyu Duan, and Siwei Ma
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), vol. 14, no. 1, pp. 64-77, 2020.
    [Code] [Database]

  • A Wavelet-Predominant Algorithm Can Evaluate Quality of THz Security Image and Identify Its Usability
    Menghan Hu, Guangtao Zhai, Rong Xie, Xiongkuo Min, Qingli Li, and Xiaokang Yang
    IEEE Transactions on Broadcasting (TBC), vol. 66, no. 1, pp. 140-152, 2020.
    [Database]

  • Perceptual Image Quality Assessment: A Survey
    Guangtao Zhai, and Xiongkuo Min
    SCIENCE CHINA Information Sciences, vol. 63, no. 11, pp. 211301, 2020.
    Hot Paper Award, ESI Highly Cited Paper

  • Tiny-BDN: An Efficient and Compact Barcode Detection Network
    Jun Jia, Guangtao Zhai, Ping Ren, Jiahe Zhang, Zhongpai Gao, Xiongkuo Min, and Xiaokang Yang
    IEEE Journal of Selected Topics in Signal Processing (JSTSP), vol. 14, no. 4, pp. 688-699, 2020.

  • DevsNet: Deep Video Saliency Network using Short-term and Long-term Cues
    Yuming Fang, Chi Zhang, Xiongkuo Min, Hanqin Huang, Yuegen Yi, Guangtao Zhai, and Chia-Wen Lin
    Pattern Recognition (PR), vol. 103, pp. 107294, 2020.

   Conference

  • Blurry Video Frame Interpolation
    Wang Shen, Wenbo Bao, Guangtao Zhai, Li Chen, Xiongkuo Min, and Zhiyong Gao
    IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2020, pp. 5114-5123.
    [Project & Code]

2019

   Journal

  • Quality Evaluation of Image Dehazing Methods Using Synthetic Hazy Images
    Xiongkuo Min, Guangtao Zhai, Ke Gu, Yucheng Zhu, Jiantao Zhou, Guodong Guo, Xiaokang Yang, Xinping Guan, and Wenjun Zhang
    IEEE Transactions on Multimedia (TMM), vol. 21, no. 9, pp. 2319-2333, 2019.
    [Code: DEHAZEfr] [Database: SHRQ]

  • Objective Quality Evaluation of Dehazed Images
    Xiongkuo Min, Guangtao Zhai, Ke Gu, Xiaokang Yang, and Xinping Guan
    IEEE Transactions on Intelligent Transportation Systems (TITS), vol. 20, no. 9, pp. 2879-2892, 2019.
    [Code: DHQI] [Database: DHQ] [Database: rDHAZY] [Database: rFRIDA]
    ESI Highly Cited Paper

  • Multi-Channel Decomposition in Tandem With Free-Energy Principle for Reduced-Reference Image Quality Assessment
    Wenhan Zhu, Guangtao Zhai, Xiongkuo Min, Menghan Hu, Jing Liu, Guodong Guo, and Xiaokang Yang
    IEEE Transactions on Multimedia (TMM), vol. 21, no. 9, pp. 2334-2346, 2019.

  • EMBDN: An Efficient Multiclass Barcode Detection Network for Complicated Environments
    Jun Jia, Guangtao Zhai, Jiahe Zhang, Zhongpai Gao, Zehao Zhu, Xiongkuo Min, Xiaokang Yang, and Guodong Guo
    IEEE Internet of Things Journal (IoT-J), vol. 6, no. 6, pp. 9919-9933, 2019.

  • Visual Attention Analysis and Prediction on Human Faces for Children with Autism Spectrum Disorder
    Huiyu Duan, Xiongkuo Min, Yi Fang, Lei Fan, Xiaokang Yang, and Guangtao Zhai
    ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), vol. 15, no. 3s, pp. 90:1-90:23, 2019.

   Conference

  • Fine Detection and Classification of Multi-class Barcode in Complex Environments
    Jiahe Zhang, Jun Jia, Zehao Zhu, Xiongkuo Min, Guangtao Zhai, and Xiao-Ping Zhang
    IEEE International Workshop on Mobile Multimedia Computing (in conjunction with IEEE ICME), 2019, pp. 1-6.
    Best Paper Award

  • A Dataset of Eye Movements for the Children with Autism Spectrum Disorder
    Huiyu Duan, Guangtao Zhai, Xiongkuo Min, Zhaohui Che, Yi Fang, Xiaokang Yang, Jesus Gutierrez, and Patrick Le Callet
    ACM Multimedia Systems Conference (ACM MMSys), 2019, pp. 255–260.
    [Database]

2018

   Journal

  • Blind Quality Assessment Based on Pseudo Reference Image
    Xiongkuo Min, Ke Gu, Guangtao Zhai, Jing Liu, Xiaokang Yang, and Chang Wen Chen
    IEEE Transactions on Multimedia (TMM), vol. 20, no. 20, pp. 2049-2062, 2018.
    [Code: BPRI]
    Best Paper Runner-up Award, ESI Highly Cited Paper

  • Blind Image Quality Estimation via Distortion Aggravation
    Xiongkuo Min, Guangtao Zhai, Ke Gu, Yutao Liu, and Xiaokang Yang
    IEEE Transactions on Broadcasting (TBC), vol. 64, no. 2, pp. 508-517, 2018.
    [Code: BMPRI]

  • Saliency-Induced Reduced-Reference Quality Index for Natural Scene and Screen Content Images
    Xiongkuo Min, Ke Gu, Guangtao Zhai, Menghan Hu, and Xiaokang Yang
    Signal Processing (SP), vol. 145, pp. 127-136, 2018.
    [Code]

  • Evaluating Quality of Screen Content Images Via Structural Variation Analysis
    Ke Gu, Junfei Qiao, Xiongkuo Min, Guanghui Yue, Weisi Lin, and Daniel Thalmann
    IEEE Transactions on Visualization and Computer Graphics (TVCG), vol. 24, no. 10, pp. 2689-2701, 2018.
    [Code]

  • Partial-Reference Sonar Image Quality Assessment for Underwater Transmission
    Weilin Chen, Ke Gu, Xiongkuo Min, Fei Yuan, En Chen, and Wenjun Zhang
    IEEE Transactions on Aerospace and Electronic Systems (TAES), vol. 54, no. 6, pp. 2776-2787, 2018.

  • The Prediction of Head and Eye Movement for 360 Degree Images
    Yucheng Zhu, Guangtao Zhai, and Xiongkuo Min
    Signal Processing: Image Communication (SPIC), vol. 69, pp. 15-25, 2018.
    Special Award of IEEE ICME 2017 Salient360! Grand Challenge

   Conference

  • Perceptual Quality Assessment of Omnidirectional Images
    Huiyu Duan, Guangtao Zhai, Xiongkuo Min, Yucheng Zhu, Yi Fang, Xiaokang Yang
    IEEE International Symposium on Circuits and Systems (ISCAS), 2018, pp. 1-5.
    [Database]

2017

   Journal

  • Unified Blind Quality Assessment of Compressed Natural, Graphic, and Screen Content Images
    Xiongkuo Min, Kede Ma, Ke Gu, Guangtao Zhai, Zhou Wang, and Weisi Lin
    IEEE Transactions on Image Processing (TIP), vol. 26, no. 11, pp. 5462-5474, 2017.
    [Project] [Code: UCA] [Database: CCT]
    ESI Hot Paper, ESI Highly Cited Paper

  • Fixation Prediction through Multimodal Analysis
    Xiongkuo Min, Guangtao Zhai, Ke Gu, and Xiaokang Yang
    ACM Transactions on Multimedia Computing, Communications, and Applications (TOMM), vol. 13, no. 1, pp. 6:1-6:23, 2017.
    [Code] [Database]

  • A Fast Reliable Image Quality Predictor by Fusing Micro- and Macro-Structures
    Ke Gu, Leida Li, Hong Lu, Xiongkuo Min, and Weisi Lin
    IEEE Transactions on Industrial Electronics (TIE), vol. 64, no. 5, pp. 3903-3912, 2017.
    [Code]
    ESI Highly Cited Paper

  • Visual Attention Analysis and Prediction on Human Faces
    Xiongkuo Min, Guangtao Zhai, Ke Gu, Jing Liu, Shiqi Wang, Xinfeng Zhang, and Xiaokang Yang
    Information Sciences (IS), vol. 420, pp. 417-430, 2017.

2016

   Conference

  • Blind Quality Assessment of Compressed Images via Pseudo Structural Similarity
    Xiongkuo Min, Guangtao Zhai, Ke Gu, Yuming Fang, Xiaokang Yang, Xiaolin Wu, Jiantao Zhou, and Xianming Liu
    IEEE International Conference on Multimedia and Expo (ICME), 2016, pp. 1-6.
    [Code]
    Best Student Paper Award