Skip to content

Weixun Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

26

Venues

12

Active years

2009–2026

Best venue rank

A*

Where they publish

Papers

26 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIThink-J: Learning to Think for Generative LLM-as-a-Judge.Hui Huang, Yancheng He, Hongli Zhou, Rui Zhang, Wei Liu, Weixun Wang, Jiaheng Liu, Wenbo Su
2026ACLCE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria.Xinyu Hu, Yancheng He, Weixun Wang, Tao Feng, Li Lin, Jiashun Liu, Wenbo Su, Bo Zheng, Xiaojun Wan
2026ACLShopSimulator: Evaluating and Exploring RL-Driven LLM Agent for Shopping Assistants.Pei Wang, Yanan Wu, Xiaoshuai Song, Weixun Wang, Gengru Chen, Zhongwen Li, Kezhong Yan, Qi Liu, Ken Deng, Shuaibing Zhao, Shaopan Xiong, Xuepeng Liu, Xuefeng Chen, Wanxi Deng, Wenbo Su, Bo Zheng
2026ACLUSB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models.Baolin Zheng, Guanlin Chen, Qingyang Teng, Hongqiong Zhong, Yingshui Tan, Zhendong Liu, Weixun Wang, Jiaheng Liu, Jian Yang, Huiyun Jing, Jincheng Wei, Wenbo Su, Xiaoyong Zhu, Bo Zheng, Kaifu Zhang
2026NSDIRollPacker: Taming Long-Tail Rollouts for RL Post-Training with Tail Batching.Wei Gao, Yuheng Zhao, Dakai An, Tianyuan Wu, Lunxi Cao, Shaopan Xiong, Ju Huang, Weixun Wang, Siran Yang, Wenbo Su, Jiamang Wang, Lin Qu, Bo Zheng, Wei Wang
2025ACLChinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models.Yancheng He, Shilong Li, Jiaheng Liu, Yingshui Tan, Weixun Wang, Hui Huang, Xingyuan Bu, Hangyu Guo, Chengwei Hu, Boren Zheng, Zhuoran Lin, Dekai Sun, Zhicheng Zheng, Wenbo Su, Bo Zheng
2025ACLCan Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?Yancheng He, Shilong Li, Jiaheng Liu, Weixun Wang, Xingyuan Bu, Ge Zhang, Z. Y. Peng, Zhaoxiang Zhang, Zhicheng Zheng, Wenbo Su, Bo Zheng
2025ACLProgCo: Program Helps Self-Correction of Large Language Models.Xiaoshuai Song, Yanan Wu, Weixun Wang, Jiaheng Liu, Wenbo Su, Bo Zheng
2025EMNLPOpenRLHF: A Ray-based Easy-to-use, Scalable and High-performance RLHF Framework.Jian Hu, Xibin Wu, Wei Shen, Jason Klein Liu, Weixun Wang, Songlin Jiang, Haoran Wang, Hao Chen, Bin Chen, Wenkai Fang, Xianyu, Yu Cao, Haotian Xu, Yiming Liu
2025NAACL2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision.Shilong Li, Yancheng He, Hui Huang, Xingyuan Bu, Jiaheng Liu, Hangyu Guo, Weixun Wang, Jihao Gu, Wenbo Su, Bo Zheng
2024AAAIPORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning.Jizhou Wu, Jianye Hao, Tianpei Yang, Xiaotian Hao, Yan Zheng, Weixun Wang, Matthew E. Taylor
2023ICLRBoosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant Networks.Jianye Hao, Xiaotian Hao, Hangyu Mao, Weixun Wang, Yaodong Yang, Dong Li, Yan Zheng, Zhen Wang
2022ICMLIndividual Reward Assisted Multi-Agent Reinforcement Learning.Li Wang, Yupeng Zhang, Yujing Hu, Weixun Wang, Chongjie Zhang, Yang Gao, Jianye Hao, Tangjie Lv, Changjie Fan
2020AAAIMulti-Agent Game Abstraction via Graph Attention Neural Network.Yong Liu, Weixun Wang, Yujing Hu, Jianye Hao, Xingguo Chen, Yang Gao
2020AAAIFrom Few to More: Large-Scale Dynamic Multiagent Curriculum Learning.Weixun Wang, Tianpei Yang, Yong Liu, Jianye Hao, Xiaotian Hao, Yujing Hu, Yingfeng Chen, Changjie Fan, Yang Gao
2020ICLRAction Semantics Network: Considering the Effects of Actions in Multiagent Systems.Weixun Wang, Tianpei Yang, Yong Liu, Jianye Hao, Xiaotian Hao, Yujing Hu, Yingfeng Chen, Changjie Fan, Yang Gao
2020IJCAILearning to Accelerate Heuristic Searching for Large-Scale Maximum Weighted b-Matching Problems in Online Advertising.Xiaotian Hao, Junqi Jin, Jianye Hao, Jin Li, Weixun Wang, Yi Ma, Zhenzhe Zheng, Han Li, Jian Xu, Kun Gai
2020IJCAIEfficient Deep Reinforcement Learning via Adaptive Policy Transfer.Tianpei Yang, Jianye Hao, Zhaopeng Meng, Zongzhang Zhang, Yujing Hu, Yingfeng Chen, Changjie Fan, Weixun Wang, Wulong Liu, Zhaodong Wang, Jiajie Peng
2020IJCAIKoGuN: Accelerating Deep Reinforcement Learning via Integrating Human Suboptimal Knowledge.Peng Zhang, Jianye Hao, Weixun Wang, Hongyao Tang, Yi Ma, Yihai Duan, Yan Zheng
2019CIKMLearning Adaptive Display Exposure for Real-Time Advertising.Weixun Wang, Junqi Jin, Jianye Hao, Chunjie Chen, Chuan Yu, Weinan Zhang, Jun Wang, Xiaotian Hao, Yixi Wang, Han Li, Jian Xu, Kun Gai
2011DACDynamic cache reconfiguration and partitioning for energy optimization in real-time multi-core systems.Weixun Wang, Prabhat Mishra, Sanjay Ranka
2011VLSIDA General Algorithm for Energy-Aware Dynamic Reconfiguration in Multitasking Systems.Weixun Wang, Sanjay Ranka, Prabhat Mishra
2010DACPreDVS: preemptive dynamic voltage scaling for real-time systems using approximation scheme.Weixun Wang, Prabhat Mishra
2010ISLPEDTemperature- and energy-constrained scheduling in multitasking systems: a model checking approach.Weixun Wang, Xiaoke Qin, Prabhat Mishra
2010VLSIDLeakage-Aware Energy Minimization Using Dynamic Voltage Scaling and Cache Reconfiguration in Real-Time Systems.Weixun Wang, Prabhat Mishra
2009VLSIDSACR: Scheduling-Aware Cache Reconfiguration for Real-Time Embedded Systems.Weixun Wang, Prabhat Mishra, Ann Gordon-Ross