@inproceedings{zhao2026geometric,title={{Geometric-Mean Policy Optimization}},author={Zhao, Yuzhong and Liu, Yue and Liu, Junpeng and Chen, Jingye and Wu, Xun and Hao, Yaru and Lv, Tengchao and Huang, Shaohan and Cui, Lei and Ye, Qixiang and Wan, Fang and Wei, Furu},booktitle={International Conference on Learning Representations},pages={41354--41374},year={2026},}
arXiv
On-Policy Context Distillation for Language Models
Tianzhu Ye, Li Dong, Xun Wu, Shaohan Huang, and Furu Wei
@article{ye2026onpolicycontext,title={{On-Policy Context Distillation for Language Models}},author={Ye, Tianzhu and Dong, Li and Wu, Xun and Huang, Shaohan and Wei, Furu},journal={arXiv preprint arXiv:2602.12275},year={2026},}
arXiv
Online Experiential Learning for Language Models
Tianzhu Ye, Li Dong, Qingxiu Dong, Xun Wu, Shaohan Huang, and Furu Wei
@article{ye2026online,title={{Online Experiential Learning for Language Models}},author={Ye, Tianzhu and Dong, Li and Dong, Qingxiu and Wu, Xun and Huang, Shaohan and Wei, Furu},journal={arXiv preprint arXiv:2603.16856},year={2026},}
arXiv
SlideSparse: Fast and Flexible (2N-2): 2N Structured Sparsity
Hanyong Shao, Yingbo Hao, Ting Song, Yan Xia, Di Zhang, Shaohan Huang, and 7 more authors
@article{shao2026slidesparse,title={{SlideSparse: Fast and Flexible (2N-2): 2N Structured Sparsity}},author={Shao, Hanyong and Hao, Yingbo and Song, Ting and Xia, Yan and Zhang, Di and Huang, Shaohan and Wu, Xun and Xu, Songchen and Xu, Le and Dong, Li and Chi, Zewen and Zou, Yi and Wei, Furu},journal={arXiv preprint arXiv:2603.05232},year={2026},}
ACL
Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
Di Zhang, Xun Wu, Shaohan Huang, Lingjie Jiang, Yaru Hao, Li Dong, and 3 more authors
In Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics, 2026
@inproceedings{zhang2026stable,title={{Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts}},author={Zhang, Di and Wu, Xun and Huang, Shaohan and Jiang, Lingjie and Hao, Yaru and Dong, Li and Chi, Zewen and Sui, Zhifang and Wei, Furu},booktitle={Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics},pages={25446--25457},year={2026},}
arXiv
Sparse-BitNet: 1.58-Bit LLMs Are Naturally Friendly to Semi-Structured Sparsity
Di Zhang, Xun Wu, Shaohan Huang, Yudong Wang, Hanyong Shao, Yingbo Hao, and 6 more authors
@article{zhang2026sparsebitnet,title={{Sparse-BitNet: 1.58-Bit LLMs Are Naturally Friendly to Semi-Structured Sparsity}},author={Zhang, Di and Wu, Xun and Huang, Shaohan and Wang, Yudong and Shao, Hanyong and Hao, Yingbo and Chi, Zewen and Dong, Li and Song, Ting and Xia, Yan and Sui, Zhifang and Wei, Furu},journal={arXiv preprint arXiv:2603.05168},year={2026},}
2025
NeurIPS
Reward Reasoning Models
Jiaxin Guo, Zewen Chi, Li Dong, Qingxiu Dong, Xun Wu, Shaohan Huang, and 1 more author
In Advances in Neural Information Processing Systems, 2025
@inproceedings{guo2025reward,title={{Reward Reasoning Models}},author={Guo, Jiaxin and Chi, Zewen and Dong, Li and Dong, Qingxiu and Wu, Xun and Huang, Shaohan and Wei, Furu},booktitle={Advances in Neural Information Processing Systems},volume={38},pages={150477--150510},year={2025},}
NeurIPS
Think Only When You Need with Large Hybrid-Reasoning Models
Lingjie Jiang*, Xun Wu*, Shaohan Huang, Qingxiu Dong, Zewen Chi, Li Dong, and 4 more authors
In Advances in Neural Information Processing Systems, 2025
@inproceedings{jiang2025think,title={{Think Only When You Need with Large Hybrid-Reasoning Models}},author={Jiang, Lingjie and Wu, Xun and Huang, Shaohan and Dong, Qingxiu and Chi, Zewen and Dong, Li and Zhang, Xingxing and Lv, Tengchao and Cui, Lei and Wei, Furu},booktitle={Advances in Neural Information Processing Systems},volume={38},pages={159355--159382},year={2025},}
arXiv
Black-Box On-Policy Distillation of Large Language Models
Tianzhu Ye, Li Dong, Zewen Chi, Xun Wu, Shaohan Huang, and Furu Wei
@article{ye2025blackbox,title={{Black-Box On-Policy Distillation of Large Language Models}},author={Ye, Tianzhu and Dong, Li and Chi, Zewen and Wu, Xun and Huang, Shaohan and Wei, Furu},journal={arXiv preprint arXiv:2511.10643},year={2025},}
arXiv
On-Policy RL with Optimal Reward Baseline
Yaru Hao, Li Dong, Xun Wu, Shaohan Huang, Zewen Chi, and Furu Wei
@article{hao2025onpolicy,title={{On-Policy RL with Optimal Reward Baseline}},author={Hao, Yaru and Dong, Li and Wu, Xun and Huang, Shaohan and Chi, Zewen and Wei, Furu},journal={arXiv preprint arXiv:2505.23585},year={2025},}
EMNLP
Textual Aesthetics in Large Language Models
Lingjie Jiang, Shaohan Huang, Xun Wu, and Furu Wei
In Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, 2025
@inproceedings{jiang2025textual,title={{Textual Aesthetics in Large Language Models}},author={Jiang, Lingjie and Huang, Shaohan and Wu, Xun and Wei, Furu},booktitle={Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing},pages={13801--13829},year={2025},}
TOIS
Unsupervised Video Moment Retrieval with Knowledge-Based Pseudo-Supervision Construction
Guolong Wang, Xun Wu, Xun Tu, Zhaoyuan Liu, and Junchi Yan
@article{wang2025unsupervised,title={{Unsupervised Video Moment Retrieval with Knowledge-Based Pseudo-Supervision Construction}},author={Wang, Guolong and Wu, Xun and Tu, Xun and Liu, Zhaoyuan and Yan, Junchi},journal={ACM Transactions on Information Systems},volume={43},number={1},pages={1--26},year={2025},publisher={ACM},}
arXiv
BitNet Distillation
Xun Wu, Shaohan Huang, Wenhui Wang, Ting Song, Li Dong, Yan Xia, and 1 more author
@article{wu2025bitnet,title={{BitNet Distillation}},author={Wu, Xun and Huang, Shaohan and Wang, Wenhui and Song, Ting and Dong, Li and Xia, Yan and Wei, Furu},journal={arXiv preprint arXiv:2510.13998},year={2025},}
@inproceedings{wu2025rethinking,title={{Rethinking DPO-Style Diffusion Aligning Frameworks}},author={Wu, Xun and Huang, Shaohan and Jiang, Lingjie and Wei, Furu},booktitle={IEEE/CVF International Conference on Computer Vision},pages={18068--18077},year={2025},publisher={IEEE},}
arXiv
The Era of Agentic Organization: Learning to Organize with Language Models
Zewen Chi, Li Dong, Qingxiu Dong, Yaru Hao, Xun Wu, Shaohan Huang, and 1 more author
@article{chi2025agentic,title={{The Era of Agentic Organization: Learning to Organize with Language Models}},author={Chi, Zewen and Dong, Li and Dong, Qingxiu and Hao, Yaru and Wu, Xun and Huang, Shaohan and Wei, Furu},journal={arXiv preprint arXiv:2510.26658},year={2025},}
2024
ICLR
Mixture of LoRA Experts
Xun Wu, Shaohan Huang, and Furu Wei
In International Conference on Learning Representations, 2024
@inproceedings{wu2024mixture,title={{Mixture of LoRA Experts}},author={Wu, Xun and Huang, Shaohan and Wei, Furu},booktitle={International Conference on Learning Representations},year={2024},}
NeurIPS
Multimodal Large Language Models Make Text-to-Image Generative Models Align Better
@inproceedings{wu2024multimodal,title={{Multimodal Large Language Models Make Text-to-Image Generative Models Align Better}},author={Wu, Xun and Huang, Shaohan and Wang, Guolong and Xiong, Jing and Wei, Furu},booktitle={Advances in Neural Information Processing Systems},volume={37},pages={81287--81323},year={2024},}
NeurIPS
Multi-Head Mixture-of-Experts
Xun Wu, Shaohan Huang, Wenhui Wang, Shuming Ma, Li Dong, and Furu Wei
In Advances in Neural Information Processing Systems, 2024
@inproceedings{wu2024multihead,title={{Multi-Head Mixture-of-Experts}},author={Wu, Xun and Huang, Shaohan and Wang, Wenhui and Ma, Shuming and Dong, Li and Wei, Furu},booktitle={Advances in Neural Information Processing Systems},volume={37},pages={94073--94096},year={2024},}
Inf. Sci.
Progressive Reinforcement Learning for Video Summarization
@article{wang2024progressive,title={{Progressive Reinforcement Learning for Video Summarization}},author={Wang, Guolong and Wu, Xun and Yan, Junchi},journal={Information Sciences},volume={655},pages={119888},year={2024},publisher={Elsevier},}
arXiv
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
Zixuan Li, Jing Xiong, Fanghua Ye, Chuanyang Zheng, Xun Wu, Jianqiao Lu, and 6 more authors
@article{li2024uncertaintyrag,title={{UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation}},author={Li, Zixuan and Xiong, Jing and Ye, Fanghua and Zheng, Chuanyang and Wu, Xun and Lu, Jianqiao and Wan, Zhongwei and Liang, Xiaodan and Li, Chengming and Sun, Zhenan and Kong, Lingpeng and Wong, Ngai},journal={arXiv preprint arXiv:2410.02719},year={2024},}
KDD
The Heterophilic Snowflake Hypothesis: Training and Empowering GNNs for Heterophilic Graphs
Kun Wang, Guibin Zhang, Xinnan Zhang, Junfeng Fang, Xun Wu, Guohao Li, and 3 more authors
In Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2024
@inproceedings{wang2024heterophilic,title={{The Heterophilic Snowflake Hypothesis: Training and Empowering GNNs for Heterophilic Graphs}},author={Wang, Kun and Zhang, Guibin and Zhang, Xinnan and Fang, Junfeng and Wu, Xun and Li, Guohao and Pan, Shirui and Huang, Wei and Liang, Yuxuan},booktitle={Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining},pages={3164--3175},year={2024},}
NeurIPS
Boosting Text-to-Video Generative Model with MLLMs Feedback
@inproceedings{wu2024boosting,title={{Boosting Text-to-Video Generative Model with MLLMs Feedback}},author={Wu, Xun and Huang, Shaohan and Wang, Guolong and Xiong, Jing and Wei, Furu},booktitle={Advances in Neural Information Processing Systems},volume={37},pages={139444--139469},year={2024},}
@article{huang2024mhmoe,title={{MH-MoE: Multi-Head Mixture-of-Experts}},author={Huang, Shaohan and Wu, Xun and Ma, Shuming and Wei, Furu},journal={arXiv preprint arXiv:2411.16205},year={2024},}
OpenReview
UnComp: Uncertainty-Aware Long-Context Compressor for Efficient Large Language Model Inference
Jing Xiong, Jianghan Shen, Fanghua Ye, Chaofan Tao, Zhongwei Wan, Jianqiao Lu, and 5 more authors
@article{xiong2024uncomp,title={{UnComp: Uncertainty-Aware Long-Context Compressor for Efficient Large Language Model Inference}},author={Xiong, Jing and Shen, Jianghan and Ye, Fanghua and Tao, Chaofan and Wan, Zhongwei and Lu, Jianqiao and Wu, Xun and Zheng, Chuanyang and Guo, Zhijiang and Kong, Lingpeng and Wong, Ngai},journal={OpenReview},year={2024},}
KDD
Routing Evidence for Unseen Actions in Video Moment Retrieval
Guolong Wang, Xun Wu, Zheng Qin, and Liangliang Shi
In Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2024
@inproceedings{wang2024routing,title={{Routing Evidence for Unseen Actions in Video Moment Retrieval}},author={Wang, Guolong and Wu, Xun and Qin, Zheng and Shi, Liangliang},booktitle={Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining},pages={3024--3035},year={2024},}
IROS
Kosmos-E: Learning to Follow Instruction for Robotic Grasping
Zhi Wang, Xun Wu, Shaohan Huang, Li Dong, Wenhui Wang, Shuming Ma, and 1 more author
In IEEE/RSJ International Conference on Intelligent Robots and Systems, 2024
@inproceedings{wang2024kosmose,title={{Kosmos-E: Learning to Follow Instruction for Robotic Grasping}},author={Wang, Zhi and Wu, Xun and Huang, Shaohan and Dong, Li and Wang, Wenhui and Ma, Shuming and Wei, Furu},booktitle={IEEE/RSJ International Conference on Intelligent Robots and Systems},pages={9510--9517},year={2024},publisher={IEEE},}
ICASSP
An Efficient Transformer for Demosaicing via Compressed Multi-Branch Attention Mechanism
@inproceedings{wu2024efficient,title={{An Efficient Transformer for Demosaicing via Compressed Multi-Branch Attention Mechanism}},author={Wu, Xun and Meng, Fanqing and Wu, Yaqi and Zhang, Jiawei and Zhang, Feng},booktitle={IEEE International Conference on Acoustics, Speech and Signal Processing},pages={2575--2576},year={2024},publisher={IEEE},}
2023
CVPRW
MIPI 2023 Challenge on RGBW Remosaic: Methods and Results
Qianhui Sun, Qingyu Yang, Chongyi Li, Shangchen Zhou, Ruicheng Feng, Yuekun Dai, and 28 more authors
In IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops, 2023
@inproceedings{sun2023mipi,title={{MIPI 2023 Challenge on RGBW Remosaic: Methods and Results}},author={Sun, Qianhui and Yang, Qingyu and Li, Chongyi and Zhou, Shangchen and Feng, Ruicheng and Dai, Yuekun and Sun, Wenxiu and Zhu, Qingpeng and Loy, Chen Change and Gu, Jinwei and Liu, Yuqing and Yu, Hongyuan and Yu, Weichen and Dong, Zhen and Han, Binnan and Jia, Qi and Yin, Xuanwu and Zuo, Kunlong and Wu, Yaqi and Fan, Zhihao and Meng, Fanqing and Wu, Xun and Zhang, Jiawei and Zhang, Feng and Han, Mingyan and Luo, Jinting and Wu, Qi and Jiang, Ting and Jiang, Chengzhi and Lin, Wenjie and Li, Xinpeng and Yu, Lei and Fan, Haoqiang and Liu, Shuaicheng},booktitle={IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops},pages={2878--2885},year={2023},publisher={IEEE},}
CVPRW
OTST: A Two-Phase Framework for Joint Denoising and Remosaicing in RGBW CFA
@inproceedings{fan2023otst,title={{OTST: A Two-Phase Framework for Joint Denoising and Remosaicing in RGBW CFA}},author={Fan, Zhihao and Wu, Xun and Meng, Fanqing and Wu, Yaqi and Zhang, Feng},booktitle={IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops},pages={2833--2842},year={2023},publisher={IEEE},}
IPM
Reducing 0S Bias in Video Moment Retrieval with a Circular Competence-Based Captioner
@article{wang2023reducing,title={{Reducing 0S Bias in Video Moment Retrieval with a Circular Competence-Based Captioner}},author={Wang, Guolong and Wu, Xun and Liu, Zhaoyuan and Qin, Zheng},journal={Information Processing \& Management},volume={60},number={2},pages={103147},year={2023},publisher={Pergamon},}
ICIP
Joint Demosaicing and Denoising with Gradient Guidance in Quad Bayer CFA
Xun Wu, Yaqi Wu, Jiawei Zhang, Feng Zhang, and Jimmy Ren
In IEEE International Conference on Image Processing, 2023
@inproceedings{wu2023joint,title={{Joint Demosaicing and Denoising with Gradient Guidance in Quad Bayer CFA}},author={Wu, Xun and Wu, Yaqi and Zhang, Jiawei and Zhang, Feng and Ren, Jimmy},booktitle={IEEE International Conference on Image Processing},pages={256--260},year={2023},publisher={IEEE},}
2022
CVPRW
NTIRE 2022 Spectral Demosaicing Challenge and Data Set
Boaz Arad, Radu Timofte, Rony Yahel, Nimrod Morag, Amir Bernat, Yaqi Wu, and 31 more authors
In IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops, 2022
@inproceedings{arad2022ntire,title={{NTIRE 2022 Spectral Demosaicing Challenge and Data Set}},author={Arad, Boaz and Timofte, Radu and Yahel, Rony and Morag, Nimrod and Bernat, Amir and Wu, Yaqi and Wu, Xun and Fan, Zhihao and Xia, Chenjie and Zhang, Feng and Liu, Shuai and Li, Yongqiang and Feng, Chaoyu and Lei, Lei and Zhang, Mingwei and Feng, Kai and Zhang, Xun and Yao, Jiaxin and Zhao, Yongqiang and Ma, Suina and He, Fan and Dong, Yangyang and Yu, Shufang and Qiu, Difa and Liu, Jinhui and Bi, Mengzhao and Song, Beibei and Sun, WenFang and Zheng, Jiesi and Zhao, Bowen and Cao, Yanpeng and Yang, Jiangxin and Cao, Yanlong and Kong, Xiangyu and Yu, Jingbo and Xue, Yuanyang and Xie, Zheng},booktitle={IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops},pages={881--895},year={2022},publisher={IEEE},}
ACM MM
Prompt-Based Zero-Shot Video Moment Retrieval
Guolong Wang, Xun Wu, Zhaoyuan Liu, and Junchi Yan
In Proceedings of the 30th ACM International Conference on Multimedia, 2022
@inproceedings{wang2022prompt,title={{Prompt-Based Zero-Shot Video Moment Retrieval}},author={Wang, Guolong and Wu, Xun and Liu, Zhaoyuan and Yan, Junchi},booktitle={Proceedings of the 30th ACM International Conference on Multimedia},pages={413--421},year={2022},}
ECCVW
Learned Smartphone ISP on Mobile GPUs with Deep Learning, Mobile AI & AIM 2022 Challenge: Report
Andrey Ignatov, Radu Timofte, Shuai Liu, Chaoyu Feng, Furui Bai, Xiaotao Wang, and 32 more authors
@inproceedings{ignatov2022learned,title={{Learned Smartphone ISP on Mobile GPUs with Deep Learning, Mobile AI \& AIM 2022 Challenge: Report}},author={Ignatov, Andrey and Timofte, Radu and Liu, Shuai and Feng, Chaoyu and Bai, Furui and Wang, Xiaotao and Lei, Lei and Yi, Ziyao and Xiang, Yan and Liu, Zibin and Li, Shaoqing and Shi, Keming and Kong, Dehui and Xu, Ke and Kwon, Minsu and Wu, Yaqi and Zheng, Jiesi and Fan, Zhihao and Wu, Xun and Zhang, Feng and No, Albert and Cho, Minhyeok and Chen, Zewen and Zhang, Xiaze and Li, Ran and Wang, Juan and Wang, Zhiming and Conde, Marcos V. and Choi, Ui-Jin and Perevozchikov, Georgy and Ershov, Egor and Hui, Zheng and Dong, Mengchuan and Lou, Xin and Zhou, Wei and Pang, Cong and Qin, Haina and Cai, Mingxuan},booktitle={Computer Vision -- ECCV 2022 Workshops},pages={44--70},year={2022},publisher={Springer Nature Switzerland},}
ECCVW
MIPI 2022 Challenge on Quad-Bayer Re-Mosaic: Dataset and Report
Qingyu Yang, Guang Yang, Jun Jiang, Chongyi Li, Ruicheng Feng, Shangchen Zhou, and 40 more authors
@inproceedings{yang2022mipi,title={{MIPI 2022 Challenge on Quad-Bayer Re-Mosaic: Dataset and Report}},author={Yang, Qingyu and Yang, Guang and Jiang, Jun and Li, Chongyi and Feng, Ruicheng and Zhou, Shangchen and Sun, Wenxiu and Zhu, Qingpeng and Loy, Chen Change and Gu, Jinwei and Wang, Zhen and Li, Daoyu and Zhang, Yuzhe and Peng, Lintao and Chang, Xuyang and Zhang, Yinuo and Wu, Yaqi and Wu, Xun and Fan, Zhihao and Xia, Chengjie and Zhang, Feng and Zeng, Haijin and Feng, Kai and Zhao, Yongqiang and Luong, Hiep Quang and Aelterman, Jan and Truong, Anh Minh and Philips, Wilfried and Liu, Xiaohong and Jia, Jun and Sun, Hanchi and Zhai, Guangtao and Xiao, Longan and Xu, Qihang and Jiang, Ting and Wu, Qi and Jiang, Chengzhi and Han, Mingyan and Li, Xinpeng and Lin, Wenjie and Li, Youwei and Fan, Haoqiang and Liu, Shuaicheng and Wu, Rongyuan and Sun, Lingchen and Yi, Qiaosi},booktitle={Computer Vision -- ECCV 2022 Workshops},pages={21--35},year={2022},publisher={Springer Nature Switzerland},}
ECCVW
Learning to Joint Remosaic and Denoise in Quad Bayer CFA via Universal Multi-Scale Channel Attention Network
@inproceedings{wu2022joint,title={{Learning to Joint Remosaic and Denoise in Quad Bayer CFA via Universal Multi-Scale Channel Attention Network}},author={Wu, Xun and Fan, Zhihao and Zheng, Jiesi and Wu, Yaqi and Zhang, Feng},booktitle={Computer Vision -- ECCV 2022 Workshops},pages={147--160},year={2022},publisher={Springer Nature Switzerland},}