Junxiao Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
5
Venues
2
Active years
2024–2026
Best venue rank
A*
Where they publish
Papers
5 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity. | Shiyao Cui, Xijia Feng, Yingkang Wang, Junxiao Yang, Zhexin Zhang, Biplab Sikdar, Hongning Wang, Han Qiu, Minlie Huang |
| 2026 | ACL | LASA: Language-Agnostic Semantic Alignment at the Semantic Bottleneck for LLM Safety. | Junxiao Yang, Haoran Liu, Jinzhe Tu, Jiale Cheng, Zhexin Zhang, Shiyao Cui, Jiaqi Weng, Jialing Tao, Hui Xue, Hongning Wang, Han Qiu, Minlie Huang |
| 2026 | ACL | How Should We Enhance the Safety of Large Reasoning Models: An Empirical Study. | Zhexin Zhang, Xian Qi Loye, Victor Shea-Jay Huang, Junxiao Yang, Qi Zhu, Shiyao Cui, Fei Mi, Lifeng Shang, Yingkang Wang, Hongning Wang, Minlie Huang |
| 2025 | ACL | Guiding not Forcing: Enhancing the Transferability of Jailbreaking Attacks on LLMs via Removing Superfluous Constraints. | Junxiao Yang, Zhexin Zhang, Shiyao Cui, Hongning Wang, Minlie Huang |
| 2024 | ACL | Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization. | Zhexin Zhang, Junxiao Yang, Pei Ke, Fei Mi, Hongning Wang, Minlie Huang |