| 2022 | Searching for High-Fidelity Builds Using Active Learning. | Harshitha Menon, Konstantinos Parasyris, Tom Scogland, Todd Gamblin |
| 2022 | Maintenance and Evolution: GrimoireLab Graal. | Willem Meijer, David Visscher, Erwin de Haan, Merijn Schrder, Leon Visscher, Andrea Capiluppi, Ioan Botez |
| 2022 | GraphCode2Vec: Generic Code Embedding via Lexical and Program Dependence Analyses. | Wei Ma, Mengjie Zhao, Ezekiel O. Soremekun, Qiang Hu, Jie M. Zhang, Mike Papadakis, Maxime Cordy, Xiaofei Xie, Yves Le Traon |
| 2022 | Methods for Stabilizing Models Across Large Samples of Projects (with case studies on Predicting Defect and Project Health). | Suvodeep Majumder, Tianpei Xia, Rahul Krishna, Tim Menzies |
| 2022 | Beyond Duplicates: Towards Understanding and Predicting Link Types in Issue Tracking Systems. | Clara Marie Lders, Abir Bouraffa, Walid Maalej |
| 2022 | Do Customized Android Frameworks Keep Pace with Android? | Pei Liu, Mattia Fazzini, John C. Grundy, Li Li |
| 2022 | On the Use of Fine-grained Vulnerable Code Statements for Software Vulnerability Assessment Models. | Triet Huynh Minh Le, Muhammad Ali Babar |
| 2022 | AndroOBFS: Time-tagged Obfuscated Android Malware Dataset with Family Information. | Saurabh Kumar, Debadatta Mishra, Biswabandan Panda, Sandeep Kumar Shukla |
| 2022 | Do Small Code Changes Merge Faster? A Multi-Language Empirical Investigation. | Gunnar Kudrjavets, Nachiappan Nagappan, Ayushi Rastogi |
| 2022 | The Unexplored Treasure Trove of Phabricator Code Reviews. | Gunnar Kudrjavets, Nachiappan Nagappan, Ayushi Rastogi |
| 2022 | Mining Code Review Data to Understand Waiting Times Between Acceptance and Merging: An Empirical Analysis. | Gunnar Kudrjavets, Aditya Kumar, Nachiappan Nagappan, Ayushi Rastogi |
| 2022 | SOSum: A Dataset of Stack Overflow Post Summaries. | Bonan Kou, Yifeng Di, Muhao Chen, Tianyi Zhang |
| 2022 | Multimodal Recommendation of Messenger Channels. | Ekaterina Koshchenko, Egor Klimov, Vladimir Kovalenko |
| 2022 | Challenges and Future Research Direction for Microtask Programming in Industry. | Masanari Kondo, Shinobu Saito, Yukako Iimura, Eunjong Choi, Osamu Mizuno, Yasutaka Kamei, Naoyasu Ubayashi |
| 2022 | Painting the Landscape of Automotive Software in GitHub. | Sangeeth Kochanthara, Yanja Dajsuren, Loek Cleophas, Mark van den Brand |
| 2022 | ECench: An Energy Bug Benchmark of Ethereum Client Software. | Jinyoung Kim, Misoo Kim, Eunseok Lee |
| 2022 | Which bugs are missed in code reviews: An empirical study on SmartSHARK dataset. | Fatemeh Khoshnoud, Ali Rezaei Nasab, Zahra Toudeji, Ashkan Sami |
| 2022 | The General Index of Software Engineering Papers. | Zeinab Abou Khalil, Stefano Zacchiroli |
| 2022 | ApacheJIT: A Large Dataset for Just-In-Time Defect Prediction. | Hossein Keshavarz, Meiyappan Nagappan |
| 2022 | On the Naturalness of Fuzzer-Generated Code. | Rajeswari Hita Kambhamettu, John Billos, Tomi Oluwaseun-Apo, Benjamin Gafford, Rohan Padhye, Vincent J. Hellendoorn |
| 2022 | ManyTypes4TypeScript: A Comprehensive TypeScript Dataset for Sequence-Based Type Inference. | Kevin Jesse, Premkumar T. Devanbu |
| 2022 | Starting the InnerSource Journey: Key Goals and Metrics to Measure Collaboration. | Daniel Izquierdo-Cortazar, Jess Alonso-Gutirrez, Alberto Prez Garca-Plaza, Gregorio Robles, Jess M. Gonzlez-Barahona |
| 2022 | LineVD: Statement-level Vulnerability Detection using Graph Neural Networks. | David Hin, Andrey Kan, Huaming Chen, Muhammad Ali Babar |
| 2022 | Constructing Dataset of Functionally Equivalent Java Methods Using Automated Test Generation Techniques. | Yoshiki Higo, Shinsuke Matsumoto, Shinji Kusumoto, Kazuya Yasuda |
| 2022 | Tooling for Time- and Space-efficient git Repository Mining. | Fabian Heseding, Willy Scheibel, Jrgen Dllner |