Jen-tse Huang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
32
Venues
8
Active years
2022–2026
Best venue rank
A*
Where they publish
Papers
32 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | JARVIS or Ultron? A Survey on the Safety and Security Threats of Computer-Using Agents. | Ada Chen, Yongjiang Wu, Junyuan Zhang, Jingyu Xiao, Shu Yang, Jen-tse Huang, Kun Wang, Wenxuan Wang, Shuai Wang |
| 2026 | ACL | Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation. | Jen-tse Huang, Chang Chen, Shiyang Lai, Wenxuan Wang, Michelle R. Kaufman, Mark Dredze |
| 2026 | ACL | FAIRGAMER: Evaluating Social Biases in LLM-Based Video Game NPCs. | Bingkang Shi, Jen-tse Huang, Luo Long, Tianyu Zong, Hongzhu Yi, Yuanxiang Wang, Songlin Hu, Xiaodan Zhang, Zhongjiang Yao |
| 2026 | ACL | Social Welfare Function Leaderboard: On the Emergence of LLM Agents as the Welfare Dictator. | Zhengliang Shi, Ruotian Ma, Jen-tse Huang, Xinbei Ma, Xingyu Chen, Mengru Wang, Qu Yang, Yue Wang, Fanghua Ye, Ziyang Chen, Shanyi Wang, Cixing Li, Wenxuan Wang, Zhaopeng Tu, Xiaolong Li, Zhaochun Ren, Liefeng Bo |
| 2026 | ACL | Identifying the Achilles' Heel: An Iterative Method for Uncovering Factual Errors in Large Language Models. | Wenxuan Wang, Yuk-Kit Chan, Zixuan Ling, Juluan Shi, Youliang Yuan, Jen-tse Huang, Yifei Zhang, Wenxiang Jiao, Zhaopeng Tu, Michael R. Lyu |
| 2026 | ACL | HumanLLM: Benchmarking and Improving LLM Anthropomorphism via Human Cognitive Patterns. | Xintao Wang, Jian Yang, Weiyuan Li, Rui Xie, Jen-tse Huang, Jun Gao, Shuai Huang, Yueping Kang, Yuanli Guo, Hongwei Feng, Yanghua Xiao |
| 2026 | ACL | Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards. | Youliang Yuan, Qiuyang Mang, Jingbang Chen, Hong Wan, Xiaoyuan Liu, Junjielong Xu, Jen-tse Huang, Wenxuan Wang, Wenxiang Jiao, Pinjia He |
| 2025 | ACL | Chain-of-Jailbreak Attack for Image Generation Models via Step by Step Editing. | Wenxuan Wang, Kuiyi Gao, Youliang Yuan, Jen-tse Huang, Qiuzhi Liu, Shuai Wang, Wenxiang Jiao, Zhaopeng Tu |
| 2025 | ACL | Can't See the Forest for the Trees: Benchmarking Multimodal Safety Awareness for Multimodal LLMs. | Wenxuan Wang, Xiaoyuan Liu, Kuiyi Gao, Jen-tse Huang, Youliang Yuan, Pinjia He, Shuai Wang, Zhaopeng Tu |
| 2025 | ACL | Insight Over Sight: Exploring the Vision-Knowledge Conflicts in Multimodal LLMs. | Xiaoyuan Liu, Wenxuan Wang, Youliang Yuan, Jen-tse Huang, Qiuzhi Liu, Pinjia He, Zhaopeng Tu |
| 2025 | ACL | Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training. | Youliang Yuan, Wenxiang Jiao, Wenxuan Wang, Jen-tse Huang, Jiahao Xu, Tian Liang, Pinjia He, Zhaopeng Tu |
| 2025 | EMNLP | AI Sees Your Location - But With A Bias Toward The Wealthy World. | Jingyuan Huang, Jen-tse Huang, Ziyi Liu, Xiaoyuan Liu, Wenxuan Wang, Jieyu Zhao |
| 2025 | EMNLP | Where Fact Ends and Fairness Begins: Redefining AI Bias Evaluation through Cognitive Biases. | Jen-tse Huang, Yuhang Yan, Linqi Liu, Yixin Wan, Wenxuan Wang, Kai-Wei Chang, Michael R. Lyu |
| 2025 | EMNLP | UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging. | Cheryl Lee, Chunqiu Steven Xia, Longji Yang, Jen-tse Huang, Zhouruixin Zhu, Lingming Zhang, Michael R. Lyu |
| 2025 | EMNLP | Learning to Ask: When LLM Agents Meet Unclear Instruction. | Wenxuan Wang, Juluan Shi, Zixuan Ling, Yuk-Kit Chan, Chaozheng Wang, Cheryl Lee, Youliang Yuan, Jen-tse Huang, Wenxiang Jiao, Michael R. Lyu |
| 2025 | ICLR | Competing Large Language Models in Multi-Agent Gaming Environments. | Jen-tse Huang, Eric John Li, Man Ho Lam, Tian Liang, Wenxuan Wang, Youliang Yuan, Wenxiang Jiao, Xing Wang, Zhaopeng Tu, Michael R. Lyu |
| 2025 | ICML | CoSER: Coordinating LLM-Based Persona Simulation of Established Roles. | Xintao Wang, Heng Wang, Yifei Zhang, Xinfeng Yuan, Rui Xu, Jen-tse Huang, Siyu Yuan, Haoran Guo, Jiangjie Chen, Shuchang Zhou, Wei Wang, Yanghua Xiao |
| 2025 | ICML | On the Resilience of LLM-Based Multi-Agent Collaboration with Faulty Agents. | Jen-tse Huang, Jiaxu Zhou, Tailin Jin, Xuhui Zhou, Zixi Chen, Wenxuan Wang, Youliang Yuan, Michael R. Lyu, Maarten Sap |
| 2025 | NAACL | SOTOPIA-S4: a user-friendly system for flexible, customizable, and large-scale social simulation. | Xuhui Zhou, Zhe Su, Sophie Feng, Jiaxu Zhou, Jen-tse Huang, Hsien-Te Kao, Spencer Lynch, Svitlana Volkova, Tongshuang Wu, Anita Woolley, Hao Zhu, Maarten Sap |
| 2024 | ACL | Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models. | Wenxuan Wang, Wenxiang Jiao, Jingyuan Huang, Ruyi Dai, Jen-tse Huang, Zhaopeng Tu, Michael R. Lyu |
| 2024 | ACL | All Languages Matter: On the Multilingual Safety of LLMs. | Wenxuan Wang, Zhaopeng Tu, Chang Chen, Youliang Yuan, Jen-tse Huang, Wenxiang Jiao, Michael R. Lyu |
| 2024 | ACL | InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews. | Xintao Wang, Yunze Xiao, Jen-tse Huang, Siyu Yuan, Rui Xu, Haoran Guo, Quan Tu, Yaying Fei, Ziang Leng, Wei Wang, Jiangjie Chen, Cheng Li, Yanghua Xiao |
| 2024 | EMNLP | On the Reliability of Psychological Scales on Large Language Models. | Jen-tse Huang, Wenxiang Jiao, Man Ho Lam, Eric John Li, Wenxuan Wang, Michael R. Lyu |
| 2024 | EMNLP | InterIntent: Investigating Social Intelligence of LLMs via Intention Understanding in an Interactive Game Context. | Ziyi Liu, Abhishek Anand, Pei Zhou, Jen-tse Huang, Jieyu Zhao |
| 2024 | EMNLP | LogicAsker: Evaluating and Improving the Logical Reasoning Ability of Large Language Models. | Yuxuan Wan, Wenxuan Wang, Yiliu Yang, Youliang Yuan, Jen-tse Huang, Pinjia He, Wenxiang Jiao, Michael R. Lyu |
| 2024 | ICLR | On the Humanity of Conversational AI: Evaluating the Psychological Portrayal of LLMs. | Jen-tse Huang, Wenxuan Wang, Eric John Li, Man Ho Lam, Shujie Ren, Youliang Yuan, Wenxiang Jiao, Zhaopeng Tu, Michael R. Lyu |
| 2024 | ICLR | GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher. | Youliang Yuan, Wenxiang Jiao, Wenxuan Wang, Jen-tse Huang, Pinjia He, Shuming Shi, Zhaopeng Tu |
| 2023 | CVPR | Improving the Transferability of Adversarial Samples by Path-Augmented Method. | Jianping Zhang, Jen-tse Huang, Wenxuan Wang, Yichen Li, Weibin Wu, Xiaosen Wang, Yuxin Su, Michael R. Lyu |
| 2023 | EMNLP | ParroT: Translating during Chat using Large Language Models tuned with Human Translation and Feedback. | Wenxiang Jiao, Jen-tse Huang, Wenxuan Wang, Zhiwei He, Tian Liang, Xing Wang, Shuming Shi, Zhaopeng Tu |
| 2023 | ICSE | MTTM: Metamorphic Testing for Textual Content Moderation Software. | Wenxuan Wang, Jen-tse Huang, Weibin Wu, Jianping Zhang, Yizhan Huang, Shuqing Li, Pinjia He, Michael R. Lyu |
| 2022 | CVPR | Improving Adversarial Transferability via Neuron Attribution-based Attacks. | Jianping Zhang, Weibin Wu, Jen-tse Huang, Yizhan Huang, Wenxuan Wang, Yuxin Su, Michael R. Lyu |
| 2022 | ISSTA | AEON: a method for automatic evaluation of NLP test cases. | Jen-tse Huang, Jianping Zhang, Wenxuan Wang, Pinjia He, Yuxin Su, Michael R. Lyu |