Weixun Wang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
26
Venues
12
Active years
2009–2026
Best venue rank
A*
Where they publish
Papers
26 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Think-J: Learning to Think for Generative LLM-as-a-Judge. | Hui Huang, Yancheng He, Hongli Zhou, Rui Zhang, Wei Liu, Weixun Wang, Jiaheng Liu, Wenbo Su |
| 2026 | ACL | CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria. | Xinyu Hu, Yancheng He, Weixun Wang, Tao Feng, Li Lin, Jiashun Liu, Wenbo Su, Bo Zheng, Xiaojun Wan |
| 2026 | ACL | ShopSimulator: Evaluating and Exploring RL-Driven LLM Agent for Shopping Assistants. | Pei Wang, Yanan Wu, Xiaoshuai Song, Weixun Wang, Gengru Chen, Zhongwen Li, Kezhong Yan, Qi Liu, Ken Deng, Shuaibing Zhao, Shaopan Xiong, Xuepeng Liu, Xuefeng Chen, Wanxi Deng, Wenbo Su, Bo Zheng |
| 2026 | ACL | USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models. | Baolin Zheng, Guanlin Chen, Qingyang Teng, Hongqiong Zhong, Yingshui Tan, Zhendong Liu, Weixun Wang, Jiaheng Liu, Jian Yang, Huiyun Jing, Jincheng Wei, Wenbo Su, Xiaoyong Zhu, Bo Zheng, Kaifu Zhang |
| 2026 | NSDI | RollPacker: Taming Long-Tail Rollouts for RL Post-Training with Tail Batching. | Wei Gao, Yuheng Zhao, Dakai An, Tianyuan Wu, Lunxi Cao, Shaopan Xiong, Ju Huang, Weixun Wang, Siran Yang, Wenbo Su, Jiamang Wang, Lin Qu, Bo Zheng, Wei Wang |
| 2025 | ACL | Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models. | Yancheng He, Shilong Li, Jiaheng Liu, Yingshui Tan, Weixun Wang, Hui Huang, Xingyuan Bu, Hangyu Guo, Chengwei Hu, Boren Zheng, Zhuoran Lin, Dekai Sun, Zhicheng Zheng, Wenbo Su, Bo Zheng |
| 2025 | ACL | Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning? | Yancheng He, Shilong Li, Jiaheng Liu, Weixun Wang, Xingyuan Bu, Ge Zhang, Z. Y. Peng, Zhaoxiang Zhang, Zhicheng Zheng, Wenbo Su, Bo Zheng |
| 2025 | ACL | ProgCo: Program Helps Self-Correction of Large Language Models. | Xiaoshuai Song, Yanan Wu, Weixun Wang, Jiaheng Liu, Wenbo Su, Bo Zheng |
| 2025 | EMNLP | OpenRLHF: A Ray-based Easy-to-use, Scalable and High-performance RLHF Framework. | Jian Hu, Xibin Wu, Wei Shen, Jason Klein Liu, Weixun Wang, Songlin Jiang, Haoran Wang, Hao Chen, Bin Chen, Wenkai Fang, Xianyu, Yu Cao, Haotian Xu, Yiming Liu |
| 2025 | NAACL | 2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision. | Shilong Li, Yancheng He, Hui Huang, Xingyuan Bu, Jiaheng Liu, Hangyu Guo, Weixun Wang, Jihao Gu, Wenbo Su, Bo Zheng |
| 2024 | AAAI | PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning. | Jizhou Wu, Jianye Hao, Tianpei Yang, Xiaotian Hao, Yan Zheng, Weixun Wang, Matthew E. Taylor |
| 2023 | ICLR | Boosting Multiagent Reinforcement Learning via Permutation Invariant and Permutation Equivariant Networks. | Jianye Hao, Xiaotian Hao, Hangyu Mao, Weixun Wang, Yaodong Yang, Dong Li, Yan Zheng, Zhen Wang |
| 2022 | ICML | Individual Reward Assisted Multi-Agent Reinforcement Learning. | Li Wang, Yupeng Zhang, Yujing Hu, Weixun Wang, Chongjie Zhang, Yang Gao, Jianye Hao, Tangjie Lv, Changjie Fan |
| 2020 | AAAI | Multi-Agent Game Abstraction via Graph Attention Neural Network. | Yong Liu, Weixun Wang, Yujing Hu, Jianye Hao, Xingguo Chen, Yang Gao |
| 2020 | AAAI | From Few to More: Large-Scale Dynamic Multiagent Curriculum Learning. | Weixun Wang, Tianpei Yang, Yong Liu, Jianye Hao, Xiaotian Hao, Yujing Hu, Yingfeng Chen, Changjie Fan, Yang Gao |
| 2020 | ICLR | Action Semantics Network: Considering the Effects of Actions in Multiagent Systems. | Weixun Wang, Tianpei Yang, Yong Liu, Jianye Hao, Xiaotian Hao, Yujing Hu, Yingfeng Chen, Changjie Fan, Yang Gao |
| 2020 | IJCAI | Learning to Accelerate Heuristic Searching for Large-Scale Maximum Weighted b-Matching Problems in Online Advertising. | Xiaotian Hao, Junqi Jin, Jianye Hao, Jin Li, Weixun Wang, Yi Ma, Zhenzhe Zheng, Han Li, Jian Xu, Kun Gai |
| 2020 | IJCAI | Efficient Deep Reinforcement Learning via Adaptive Policy Transfer. | Tianpei Yang, Jianye Hao, Zhaopeng Meng, Zongzhang Zhang, Yujing Hu, Yingfeng Chen, Changjie Fan, Weixun Wang, Wulong Liu, Zhaodong Wang, Jiajie Peng |
| 2020 | IJCAI | KoGuN: Accelerating Deep Reinforcement Learning via Integrating Human Suboptimal Knowledge. | Peng Zhang, Jianye Hao, Weixun Wang, Hongyao Tang, Yi Ma, Yihai Duan, Yan Zheng |
| 2019 | CIKM | Learning Adaptive Display Exposure for Real-Time Advertising. | Weixun Wang, Junqi Jin, Jianye Hao, Chunjie Chen, Chuan Yu, Weinan Zhang, Jun Wang, Xiaotian Hao, Yixi Wang, Han Li, Jian Xu, Kun Gai |
| 2011 | DAC | Dynamic cache reconfiguration and partitioning for energy optimization in real-time multi-core systems. | Weixun Wang, Prabhat Mishra, Sanjay Ranka |
| 2011 | VLSID | A General Algorithm for Energy-Aware Dynamic Reconfiguration in Multitasking Systems. | Weixun Wang, Sanjay Ranka, Prabhat Mishra |
| 2010 | DAC | PreDVS: preemptive dynamic voltage scaling for real-time systems using approximation scheme. | Weixun Wang, Prabhat Mishra |
| 2010 | ISLPED | Temperature- and energy-constrained scheduling in multitasking systems: a model checking approach. | Weixun Wang, Xiaoke Qin, Prabhat Mishra |
| 2010 | VLSID | Leakage-Aware Energy Minimization Using Dynamic Voltage Scaling and Cache Reconfiguration in Real-Time Systems. | Weixun Wang, Prabhat Mishra |
| 2009 | VLSID | SACR: Scheduling-Aware Cache Reconfiguration for Real-Time Embedded Systems. | Weixun Wang, Prabhat Mishra, Ann Gordon-Ross |