Software Engineering Empirical Research Radar
AI / LLM for SE Papers
Papers tagged as AI / LLM for SE.
| Paper | Venue | Year | Topics |
|---|---|---|---|
| LLM Agents Can See Code Repositories Dongjian Ma, Silin Chen, Yufei Yang, Yulin Shi, Yanfu Yan | arXiv | 2026 | Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Program Comprehension |
| ARISE: A Repository-level Graph Representation and Toolset for Agentic Fault Localization and Program Repair Shahd Seddik, Fatemeh Fard | arXiv | 2026 | Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods; AI / LLM for SE |
| Measure Twice, Locate Once: Mitigating Hallucinations in LLM-based Agents for Repository-Scale Fault Localization Feiyue Chen, Guowei Yang, Cheryl Lee, Zhanming Jie, Yuqi Chen | TOSEM | 2026 | Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Software Agents |
| Assessing the Impact of Code Changes on the Fault Localizability of Large Language Models Sabaat Haroon, Ahmand Faraz Khan, Ahmad Humayun, Waris Gill, Abdul Haddi Amjad | ICST | 2026 | Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Testing / QA |
| Finding the Needle in the Crash Stack: Industrial-Scale Crash Root Cause Localization with AutoCrashFL Sungmin Kang, Sumi Yun, Jingun Hong, Shin Yoo, Gabin An | ICSE-SEIP | 2026 | Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Industrial Software Engineering |
| You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects. Islem Bouzenia; Michael Pradel | ISSTA | 2025 | Testing / QA; AI / LLM for SE |
| Top Score on the Wrong Exam: On Benchmarking in Machine Learning for Vulnerability Detection. Niklas Risse; Jing Liu; Marcel Böhme | ISSTA | 2025 | AI / LLM for SE |
| Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection. Lei Yu; Zhirong Huang; Hang Yuan; Shiqi Cheng; Li Yang 0015; Fengjun Zhang; Chenjie Shen; Jiajia Ma; Jingyuan Zhang; Junyi Lu; Chun Zuo | ISSTA | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability |
| SWE-GPT: A Process-Centric Language Model for Automated Software Improvement. Yingwei Ma; Rongyu Cao; Yongchang Cao; Yue Zhang 0004; Jue Chen; Yibo Liu; Yuchen Liu; Binhua Li; Fei Huang 0002; Yongbin Li 0001 | ISSTA | 2025 | AI / LLM for SE |
| Robust Vulnerability Detection across Compilations: LLVM-IR vs. Assembly with Transformer Model. Rony Shir; Priyanka Prakash Surve; Yuval Elovici; Asaf Shabtai | ISSTA | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| Reinforcement Learning-Based Fuzz Testing for the Gazebo Robotic Simulator. Zhilei Ren; Yitao Li; Xiaochen Li; Guanxiao Qi; Jifeng Xuan; He Jiang 0001 | ISSTA | 2025 | Testing / QA; AI / LLM for SE |
| PatchScope: LLM-Enhanced Fine-Grained Stable Patch Classification for Linux Kernel. Rongkai Liu; Heyuan Shi; Shuning Liu; Chao Hu; Sisheng Li; Yuheng Shen; Runzhe Wang; Xiaohai Shi; Yu Jiang 0001 | ISSTA | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| OpDiffer: LLM-Assisted Opcode-Level Differential Testing of Ethereum Virtual Machine. Jie Ma; Ningyu He; Jinwen Xi; Mingzhe Xing; Haoyu Wang 0001; Ying Gao 0006; Yinliang Yue | ISSTA | 2025 | Testing / QA; AI / LLM for SE |
| NADA: Neural Acceptance-Driven Approximate Specification Mining. Weilin Luo; Tingchen Han; Junming Qiu; Hai Wan; Jianfeng Du; Bo Peng 0041; Guohui Xiao 0001; Yanan Liu | ISSTA | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture |
| LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation. Ziyao Zhang 0004; Chong Wang 0013; Yanlin Wang 0001; Ensheng Shi; Yuchi Ma; Wanjun Zhong; Jiachi Chen; Mingzhi Mao; Zibin Zheng | ISSTA | 2025 | AI / LLM for SE |
| Improving Graph Learning-Based Fault Localization with Tailored Semi-supervised Learning. Chun Li; Hui Li 0104; Zhong Li; Minxue Pan; Xuandong Li | ISSTA | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Improving Deep Learning Framework Testing with Model-Level Metamorphic Testing. Yanzhou Mu; Juan Zhai; Chunrong Fang; Xiang Chen 0005; Zhixiang Cao; Peiran Yang; Kexin Zhao; An Guo 0002; Zhenyu Chen 0001 | ISSTA | 2025 | Testing / QA; AI / LLM for SE |
| DecLLM: LLM-Augmented Recompilable Decompilation for Enabling Programmatic Use of Decompiled Code. Wai Kin Wong; Daoyuan Wu; Huaijin Wang 0001; Zongjie Li; Zhibo Liu 0001; Shuai Wang 0011; Qiyi Tang 0003; Sen Nie; Shi Wu | ISSTA | 2025 | AI / LLM for SE |
| CrossProbe: LLM-Empowered Cross-Project Bug Detection for Deep Learning Frameworks. Hao Guan 0001; Guangdong Bai; Yepang Liu 0001 | ISSTA | 2025 | AI / LLM for SE |
| ConTested: Consistency-Aided Tested Code Generation with LLM. Jinhao Dong; Jun Sun 0001; Wenjie Zhang 0007; Jin Song Dong 0001; Dan Hao 0001 | ISSTA | 2025 | AI / LLM for SE |
| Causality-Aided Evaluation and Explanation of Large Language Model-Based Code Generation. Zhenlan Ji; Pingchuan Ma 0004; Zongjie Li; Zhaoyu Wang 0006; Shuai Wang 0011 | ISSTA | 2025 | AI / LLM for SE |
| Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering. Ruiqi Wang; Jiyu Guo; Cuiyun Gao 0001; Guodong Fan; Chun Yong Chong; Xin Xia 0001 | ISSTA | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Bridging the Gaps between Graph Neural Networks and Data-Flow Analysis: The Closer, the Better. Qingchen Yu; Xin Liu 0050; Qingguo Zhou; Chunming Wu 0001 | ISSTA | 2025 | AI / LLM for SE |
| Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar. Yuanliang Zhang, Yifan Xie, Shanshan Li 0001, Ke Liu, Chong Wang | ICSE | 2025 | AI / LLM for SE |
| Trust Dynamics in AI-Assisted Development: Definitions, Factors, and Implications. Sadra Sabouri, Philipp Eibl, Xinyi Zhou, Morteza Ziyadi, Nenad Medvidovic | ICSE | 2025 | AI / LLM for SE |
| Towards Neural Synthesis for SMT-Assisted Proof-Oriented Programming. Saikat Chakraborty 0001, Gabriel Ebner, Siddharth Bhat, Sarah Fakhoury, Sakina Fatima | ICSE | 2025 | AI / LLM for SE |
| The Power of Types: Exploring the Impact of Type Checking on Neural Bug Detection in Dynamically Typed Languages. Boqi Chen, José Antonio Hernández López, Gunter Mussbacher, Dániel Varró | ICSE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| The Fact Selection Problem in LLM-Based Program Repair. Nikhil Parasaram, Huijie Yan, Boyu Yang, Zineb Flahy, Abriele Qudsi | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Testing and Understanding Deviation Behaviors in FHE-Hardened Machine Learning Models. Yiteng Peng, Daoyuan Wu, Zhibo Liu, Dongwei Xiao, Zhenlan Ji | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| Test Intention Guided LLM-Based Unit Test Generation. Zifan Nan, Zhaoqiang Guo, Kui Liu 0001, Xin Xia 0001 | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents. Feng Lin, Dong Jae Kim, Tse-Hsun Chen | ICSE | 2025 | AI / LLM for SE |
| Rug: Turbo Llm for Rust Unit Test Generation. Xiang Cheng, Fan Sang, Yizhuo Zhai, Xiaokuan Zhang, Taesoo Kim | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| RepairAgent: An Autonomous, LLM-Based Agent for Program Repair. Islem Bouzenia, Premkumar T. Devanbu, Michael Pradel | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Reasoning Runtime Behavior of a Program with LLM: How Far are We? Junkai Chen, Zhiyuan Pan, Xing Hu 0008, Zhenhao Li 0002, Ge Li 0001 | ICSE | 2025 | AI / LLM for SE |
| Prompt-to-SQL Injections in LLM-Integrated Web Applications: Risks and Defenses. Rodrigo Pedro, Miguel E. Coimbra, Daniel Castro 0004, Paulo Carreira 0001, Nuno Santos 0001 | ICSE | 2025 | AI / LLM for SE; Mobile / Web / GUI / Android |
| Planning a Large Language Model for Static Detection of Runtime Errors in Code Snippets. Smit Patel, Aashish Yadavally, Hridya Dhulipala, Tien N. Nguyen | ICSE | 2025 | AI / LLM for SE |
| Patch Synthesis for Property Repair of Deep Neural Networks. Zhiming Chi, Jianan Ma, Pengfei Yang 0002, Cheng-Chao Huang, Renjue Li | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Navigating the Testing of Evolving Deep Learning Systems: An Exploratory Interview Study. Hanmo You, Zan Wang, Bin Lin 0008, Junjie Chen 0003 | ICSE | 2025 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review |
| NIODebugger: A Novel Approach to Repair Non-Idempotent-Outcome Tests with LLM-Based Agent. Kaiyao Ke | ICSE | 2025 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Mock Deep Testing: Toward Separate Development of Data and Models for Deep Learning. Ruchira Manke, Mohammad Wardat, Foutse Khomh, Hridesh Rajan | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| MARQ: Engineering Mission-Critical AI-Based Software with Automated Result Quality Adaptation. Uwe Gropengießer, Elias Dietz, Florian Brandherm, Achref Doula, Osama Abboud | ICSE | 2025 | AI / LLM for SE |
| MAGIKA: AI-Powered Content-Type Detection. Yanick Fratantonio, Luca Invernizzi, Loua Farah, Kurt Thomas, Marina Zhang | ICSE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Lightweight Concolic Testing via Path-Condition Synthesis for Deep Learning Libraries. Sehoon Kim, Yonghyeon Kim, Dahyeon Park, Yuseok Jeon, Jooyong Yi | ICSE | 2025 | Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| LWDIFF: an LLM-Assisted Differential Testing Framework for Webassembly Runtimes. Shiyao Zhou, Jincheng Wang, He Ye, Hao Zhou 0043, Claire Le Goues | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| LLMs Meet Library Evolution: Evaluating Deprecated API Usage in LLM-Based Code Completion. Chong Wang 0013, Kaifeng Huang 0001, Jian Zhang 0087, Yebo Feng, Lyuye Zhang | ICSE | 2025 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| LLM-Aided Automatic Modeling for Security Protocol Verification. Ziyu Mao, Jingyi Wang 0004, Jun Sun 0001, Shengchao Qin, Jiawen Xiong | ICSE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture |
| LLM-Agents Driven Automated Simulation Testing and Analysis of small Uncrewed Aerial Systems. Venkata Sai Aswath Duvvuru, Bohan Zhang, Michael Vierhauser, Ankit Agrawal 0002 | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| LLM Based Input Space Partitioning Testing for Library APIs. Jiageng Li, Zhen Dong, Chong Wang, Haozhen You, Cen Zhang | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| LLM Assistance for Memory Safety. J. Nausheen Mohammed, Akash Lal, Aseem Rastogi, Rahul Sharma 0001, Subhajit Roy 0001 | ICSE | 2025 | AI / LLM for SE |
| Improved Detection and Diagnosis of Faults in Deep Neural Networks Using Hierarchical and Explainable Classification. Sigma Jahan, Mehil B. Shah, Parvez Mahbub, Mohammad Masudur Rahman 0001 | ICSE | 2025 | AI / LLM for SE |
| INTERTRANS: Leveraging Transitive Intermediate Translations to Enhance LLM-Based Code Translation. Marcos Macedo, Yuan Tian 0008, Pengyu Nie 0001, Filipe Roseiro Côgo, Bram Adams | ICSE | 2025 | AI / LLM for SE |
| Hyperion: Unveiling DApp Inconsistencies Using LLM and Dataflow-Guided Symbolic Execution. Shuo Yang 0012, Xingwei Lin, Jiachi Chen, Qingyuan Zhong, Lei Xiao 0015 | ICSE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Gpass: A Goal-Adaptive Neural Theorem Prover Based on Coq for Automated Formal Verification. Yizhou Chen, Zeyu Sun 0004, Guoqing Wang 0004, Dan Hao 0001 | ICSE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Faster Configuration Performance Bug Testing with Neural Dual-Level Prioritization. Youpeng Ma, Tao Chen 0001, Ke Li 0001 | ICSE | 2025 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability |
| Fairquant: Certifying and Quantifying Fairness of Deep Neural Networks. Brian Hyeongseok Kim, Jingbo Wang 0006, Chao Wang 0001 | ICSE | 2025 | AI / LLM for SE |
| Execution Trace Reconstruction Using Diffusion-Based Generative Models. Madeline Janecek, Naser Ezzati-Jivan, Abdelwahab Hamou-Lhadj | ICSE | 2025 | AI / LLM for SE |
| Diversity Drives Fairness: Ensemble of Higher Order Mutants for Intersectional Fairness of Machine Learning Software. Zhenpeng Chen, Xinyue Li, Jie M. Zhang, Federica Sarro, Yang Liu 0003 | ICSE | 2025 | AI / LLM for SE |
| Deep Learning-based Code Reviews: A Paradigm Shift or a Double-Edged Sword? Rosalia Tufano, Alberto Martin-Lopez, Ahmad Tayeb, Ozren Dabic, Sonia Haiduc | ICSE | 2025 | AI / LLM for SE |
| Context Conquers Parameters: Outperforming Proprietary Llm in Commit Message Generation. Aaron Imani, Iftekhar Ahmed 0001, Mohammad Moshirpour | ICSE | 2025 | AI / LLM for SE; DevOps / CI / Build / Release |
| Combining Fine-Tuning and LLM-Based Agents for Intuitive Smart Contract Auditing with Justifications. Wei Ma 0014, Daoyuan Wu, Yuqiang Sun 0001, Tianwen Wang, Shangqing Liu | ICSE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Code Comment Inconsistency Detection and Rectification Using a Large Language Model. Guoping Rong, Yongda Yu, Song Liu, Xin Tan, Tianyi Zhang | ICSE | 2025 | AI / LLM for SE |
| Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE. Benjamin Steenhoek, Kalpathy Sivaraman, Renata Saldivar Gonzalez, Yevhen Mohylevskyy, Roshanak Zilouchian Moghaddam | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical |
| Chatgpt-Based Test Generation for Refactoring Engines Enhanced by Feature Analysis on Examples. Chunhao Dong, Yanjie Jiang, Yuxia Zhang, Yang Zhang, Hui Liu | ICSE | 2025 | Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Chatgpt Inaccuracy Mitigation During Technical Report Understanding: Are we There Yet? Salma Begum Tamanna, Gias Uddin 0001, Song Wang 0009, Lan Xia, Longyu Zhang | ICSE | 2025 | AI / LLM for SE |
| Can an LLM Find Its Way Around a Spreadsheet? Cho-Ting Lee, Andrew Neeser, Shengzhe Xu, Jay Katyan, Patrick Cross | ICSE | 2025 | AI / LLM for SE |
| COCA: Generative Root Cause Analysis for Distributed Systems with Code Knowledge. Yichen Li 0003, Yulun Wu, Jinyang Liu 0002, Zhihan Jiang, Zhuangbin Chen | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems |
| Boosting Static Resource Leak Detection via LLM-based Resource-Oriented Intention Inference. Chong Wang, Jianan Liu, Xin Peng, Yang Liu, Yiling Lou | ICSE | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| BDefects4NN: A Backdoor Defect Database for Controlled Localization Studies in Neural Networks. Yisong Xiao, Aishan Liu, Xinwei Zhang 0010, Tianyuan Zhang 0004, Tianlin Li | ICSE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Answering User Questions About Machine Learning Models Through Standardized Model Cards. Tajkia Rahman Toma, Balreet Grewal, Cor-Paul Bezemer | ICSE | 2025 | AI / LLM for SE |
| An LLM-Based Agent-Oriented Approach for Automated Code Design Issue Localization. Fraol Batole, David O'Brien, Tien N. Nguyen, Robert Dyer 0001, Hridesh Rajan | ICSE | 2025 | AI / LLM for SE; Requirements / Modeling / Architecture |
| An Empirical Study on Automatically Detecting AI-Generated Source Code: How Far are We? Hyunjae Suh, Mahan Tafreshipour, Jiawei Li 0013, Adithya Bhattiprolu, Iftekhar Ahmed 0001 | ICSE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Aligning the Objective of LLM-Based Program Repair. Junjielong Xu, Ying Fu, Shin Hwei Tan, Pinjia He | ICSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| A Multiple Representation Transformer with Optimized Abstract Syntax Tree for Efficient Code Clone Detection. Tianchen Yu, Li Yuan, Liannan Lin, Hongkui He | ICSE | 2025 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| A Multi-Agent Approach for REST API Testing with Semantic Graphs and LLM-Driven Inputs. Myeongsoo Kim, Tyler Stennett, Saurabh Sinha 0003, Alessandro Orso | ICSE | 2025 | Testing / QA; AI / LLM for SE |
| 3DGen: AI-Assisted Generation of Provably Correct Binary Format Parsers. Sarah Fakhoury, Markus Kuppe 0001, Shuvendu K. Lahiri, Tahina Ramananandro, Nikhil Swamy | ICSE | 2025 | AI / LLM for SE |
| $\mu \text{PRL}$: A Mutation Testing Pipeline for Deep Reinforcement Learning Based on Real Faults. Deepak-George Thomas, Matteo Biagiola, Nargiz Humbatova, Mohammad Wardat, Gunel Jahangirova | ICSE | 2025 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| Teaching AI the 'Why' and 'How' of Software Vulnerability Fixes. Amiao Gao; Zenong Zhang; Simin Wang; Liguo Huang; Shiyi Wei; Vincent Ng 0001 | FSE | 2025 | AI / LLM for SE |
| SmartNote: An LLM-Powered, Personalised Release Note Generator That Just Works. Farbod Daneshyan; Runzhi He; Jianyu Wu; Minghui Zhou 0001 | FSE | 2025 | AI / LLM for SE; DevOps / CI / Build / Release |
| Revolutionizing Newcomers' Onboarding Process in OSS Communities: The Future AI Mentor. Xin Tan 0003; Xiao Long; Yinghao Zhu; Lin Shi 0006; Xiaoli Lian; Li Zhang 0029 | FSE | 2025 | AI / LLM for SE |
| ReproCopilot: LLM-Driven Failure Reproduction with Dynamic Refinement. Tanakorn Leesatapornwongsa; Fazle Elahi Faisal; Suman Nath | FSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| RegTrieve: Reducing System-Level Regression Errors for Machine Learning Systems via Retrieval-Enhanced Ensemble. Junming Cao; Xuwen Xiang; Mingfei Cheng; Bihuan Chen 0001; Xinyan Wang; You Lu 0005; Chaofeng Sha; Xiaofei Xie; Xin Peng 0001 | FSE | 2025 | Testing / QA; AI / LLM for SE |
| Mystique: Automated Vulnerability Patch Porting with Semantic and Syntactic-Enhanced LLM. Susheng Wu; Ruisi Wang; Yiheng Cao; Bihuan Chen 0001; Zhuotong Zhou; Yiheng Huang; Junpeng Zhao; Xin Peng 0001 | FSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| LLMDroid: Enhancing Automated Mobile App GUI Testing Coverage with Large Language Model Guidance. Chenxu Wang 0011; Tianming Liu 0002; Yanjie Zhao 0001; Minghui Yang; Haoyu Wang 0001 | FSE | 2025 | Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android |
| LLM-Based Method Name Suggestion with Automatically Generated Context-Rich Prompts. Waseem Akram 0007; Yanjie Jiang; Yuxia Zhang; Haris Ali Khan; Hui Liu 0003 | FSE | 2025 | AI / LLM for SE |
| How Do Programming Students Use Generative AI? Christian Rahe; Walid Maalej | FSE | 2025 | AI / LLM for SE |
| Enhancing Web Accessibility: Automated Detection of Issues with Generative AI. Ziyao He; Syed Fatiul Huq; Sam Malek | FSE | 2025 | AI / LLM for SE; Mobile / Web / GUI / Android |
| Eliminating Backdoors in Neural Code Models for Secure Code Understanding. Weisong Sun; Yuchen Chen; Chunrong Fang; Yebo Feng; Yuan Xiao 0003; An Guo 0002; Quanjun Zhang; Zhenyu Chen 0001; Baowen Xu; Yang Liu 0003 | FSE | 2025 | AI / LLM for SE |
| Doc2OracLL: Investigating the Impact of Documentation on LLM-Based Test Oracle Generation. Soneya Binta Hossain; Raygan Taylor; Matthew B. Dwyer | FSE | 2025 | Testing / QA; AI / LLM for SE |
| Demystifying Memorization in LLM-Based Program Repair via a General Hypothesis Testing Framework. Jiaolong Kong; Xiaofei Xie; Shangqing Liu | FSE | 2025 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Demystifying LLM-Based Software Engineering Agents. Chunqiu Steven Xia; Yinlin Deng; Soren Dunn; Lingming Zhang 0001 | FSE | 2025 | AI / LLM for SE |
| Code Change Intention, Development Artifact, and History Vulnerability: Putting Them Together for Vulnerability Fix Detection by LLM. Xu Yang; Wenhan Zhu; Michael Pacheco; Jiayuan Zhou; Shaowei Wang 0002; Xing Hu 0008; Kui Liu 0001 | FSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Maintenance / Evolution / Refactoring / Review |
| CXXCrafter: An LLM-Based Agent for Automated C/C++ Open Source Software Building. Zhengmin Yu; Yuan Zhang 0009; Ming Wen 0001; Yinan Nie; Wenhui Zhang; Min Yang 0002 | FSE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Beyond PEFT: Layer-Wise Optimization for More Effective and Efficient Large Code Model Tuning. Chaozheng Wang; Jia Feng; Shuzheng Gao; Cuiyun Gao 0001; Zongjie Li; Ting Peng; Hailiang Huang 0004; Yuetang Deng; Michael R. Lyu | FSE | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| Automatically Detecting Numerical Instability in Machine Learning Applications via Soft Assertions. Shaila Sharmin; Anwar Hossain Zahid; Subhankar Bhattacharjee; Chiamaka Igwilo; Miryung Kim; Wei Le | FSE | 2025 | AI / LLM for SE |
| Automated Trustworthiness Oracle Generation for Machine Learning Text Classifiers. Lam Nguyen Tung; Steven Cho; Xiaoning Du 0001; Neelofar; Valerio Terragni; Stefano Ruberto; Aldeida Aleti | FSE | 2025 | Testing / QA; AI / LLM for SE |
| An Empirical Study of Code Clones from Commercial AI Code Generators. Weibin Wu 0002; Haoxuan Hu; Zhaoji Fan; Yitong Qiao; Yizhan Huang; Yichen Li 0003; Zibin Zheng; Michael R. Lyu | FSE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| A Knowledge Enhanced Large Language Model for Bug Localization. Yue Li 0047; Bohan Liu 0003; Ting Zhang 0011; Zhiqi Wang; David Lo 0001; Lanxin Yang; Jun Lyu; He Zhang 0001 | FSE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| evalSmarT: An LLM-Based Framework for Evaluating Smart Contract Generated Comments. Fatou Ndiaye Mbodji, Mame Marieme C. Sougoufara, Wendkûuni C. Ouédraogo, Alioune Diallo, Kui Liu 0001 | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Wired for Reuse: Automating Context-Aware Code Adaptation in IDEs via LLM-Based Agent. Taiming Wang, Yanjie Jiang, Chunhao Dong, Yuxia Zhang, Hui Liu 0003 | ASE | 2025 | AI / LLM for SE |
| Why AI Agents Still Need You: Findings from Developer-Agent Collaborations in the Wild. Aayush Kumar, Yasharth Bajpai, Sumit Gulwani, Gustavo Soares, Emerson R. Murphy-Hill | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| When Faster Isn't Greener: The Hidden Costs of LLM-Based Code Optimization. Tristan Coignion, Clément Quinton, Romain Rouvoy | ASE | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| When AllClose Fails: Round-Off Error Estimation for Deep Learning Programs. Qi Zhan, Xing Hu 0008, Yuanyi Lin, Tongtong Xu, Xin Xia 0001 | ASE | 2025 | AI / LLM for SE |
| Watson: A Cognitive Observability Framework for the Reasoning of LLM-Powered Agents. Benjamin Rombaut 0002, Sogol Masoumzadeh, Kirill Vasilevski, Dayi Lin, Ahmed E. Hassan | ASE | 2025 | AI / LLM for SE; Cloud / Microservices / Distributed Systems |
| Vul-R2: A Reasoning LLM for Automated Vulnerability Repair. Xin-Cheng Wen, Zirui Lin, Yijun Yang, Cuiyun Gao 0001, Deheng Ye | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Unit Test Update through LLM-Driven Context Collection and Error-Type-Aware Refinement. Yuanhe Zhang, Zhiquan Yang, Shengyi Pan, Zhongxin Liu 0002 | ASE | 2025 | Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Tuning LLM-based Code Optimization via Meta-Prompting: An Industrial Perspective. Jingzhi Gong, Rafail Giavrimis, Paul Brookes, Vardan Voskanyan, Fan Wu 0009 | ASE | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| Towards Reliable LLM-based Exam Generation Lessons Learned and Open Challenges in an Industrial Project. Renzo Degiovanni, Jordi Cabot | ASE | 2025 | AI / LLM for SE |
| Towards Generalizable Instruction Vulnerability Prediction via LLM-Enhanced Code Representation. Bao Wen, Jingjing Gu, Jingxuan Zhang, Yang Liu 0390, Pengfei Yu 0002 | ASE | 2025 | AI / LLM for SE |
| TensorGuard: Gradient-Based Model Fingerprinting for LLM Similarity Detection and Family Classification. Zehao Wu, Yanjie Zhao 0001, Haoyu Wang 0001 | ASE | 2025 | AI / LLM for SE |
| Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems. Dany Moshkovich, Sergey Zeltyn | ASE | 2025 | AI / LLM for SE |
| StackPlagger: A System for Identifying AI-Code Plagiarism on Stack Overflow. Aman Swaraj, Harsh Goyal, Sumit Chadgal, Sandeep Kumar 0004 | ASE | 2025 | AI / LLM for SE |
| Speculative Automated Refactoring of Imperative Deep Learning Programs to Graph Execution. Raffi Khatchadourian, Tatiana Castro Vélez, Mehdi Bagherzadeh 0001, Nan Jia, Anita Raja | ASE | 2025 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Should We Evaluate LLM Based Security Analysis Approaches on Open Source Systems? Kohei Dozono, Jonas Engesser, Benjamin Hummel, Tobias Roehm, Alexander Pretschner | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical |
| SemGuard: Real-Time Semantic Evaluator for Correcting LLM-Generated Code. Qinglin Wang, Zhihong Sun, Ruyun Wang, Tao Huang, Zhi Jin 0001 | ASE | 2025 | AI / LLM for SE |
| Security Debt in LLM Agent Applications: A Measurement Study of Vulnerabilities and Mitigation Trade-offs. Zhuoxiang Shen, Jiarun Dai, Yuan Zhang 0009, Min Yang 0002 | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical |
| STaint: Detecting Second-Order Vulnerabilities in PHP Applications with LLM-Assisted Bi-Directional Static Taint Analysis. Yuchen Ji, Hongchen Cao, Jingzhu He | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability |
| SGCR: A Specification-Grounded Framework for Trustworthy LLM Code Review. Kai Wang, Bingcheng Mao, Shuai Jia, Yujie Ding, Dongming Han | ASE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Maintenance / Evolution / Refactoring / Review |
| SE-Jury: An LLM-as-Ensemble-Judge Metric for Narrowing the Gap with Human Evaluation in SE. Xin Zhou 0014, Kisub Kim, Ting Zhang 0011, Martin Weyssow, Luís F. Gomes | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| RustAssure: Differential Symbolic Testing for LLM-Transpiled C-to-Rust Code. Yubo Bai, Tapti Palit | ASE | 2025 | Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Root Cause Analysis of RISC-V Build Failures via LLM and MCTS Reasoning. Weipeng Shuai, Jie Liu 0008, Zhirou Ma, Liangyi Kang, Zehua Wang | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release |
| ReFuzzer: Feedback-Driven Approach to Enhance Validity of LLM-Generated Test Programs. Iti Shree, Karine Even-Mendoza, Tomasz Radzik | ASE | 2025 | Testing / QA; AI / LLM for SE |
| RFCAudit: AI Agent for Auditing Protocol Implementations Against RFC Specifications. Mingwei Zheng, Chengpeng Wang 0001, Xuwei Liu, Jinyao Guo, Shiwei Feng 0002 | ASE | 2025 | AI / LLM for SE |
| Quirx: A Mutation-Based Framework for Evaluating Prompt Robustness in LLM-based Software. Souhaila Serbout | ASE | 2025 | Testing / QA; AI / LLM for SE |
| Quantum Machine Learning-based Test Oracle for Autonomous Mobile Robots. Xinyi Wang 0004, Qinghua Xu, Paolo Arcaini, Shaukat Ali 0001, Thomas Peyrucain | ASE | 2025 | Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android |
| Provable Fairness Repair for Deep Neural Networks. Jianan Ma, Jingyi Wang, Qi Xuan, Zhen Wang | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Prompt-with-Me: in-IDE Structured Prompt Management for LLM-Driven Software Engineering. Ziyou Li, Agnia Sergeyuk, Maliheh Izadi | ASE | 2025 | AI / LLM for SE |
| PromFuzz: Leveraging LLM-Driven and Bug-Oriented Composite Analysis for Detecting Functional Bugs in Smart Contracts. Xingshuang Lin, Qinge Xie, Binbin Zhao, Yuan Tian 0001, Saman A. Zonouz | ASE | 2025 | Testing / QA; AI / LLM for SE |
| Out of Distribution Detection in Self-adaptive Robots with AI-powered Digital Twins. Erblin Isaku, Hassan Sartaj, Shaukat Ali 0001, Beatriz Sanguino, Tongtong Wang | ASE | 2025 | AI / LLM for SE |
| OSSPREY: AI-Driven Forecasting and Intervention for OSS Project Sustainability. Nafiz Imtiaz Khan, Priyal Soni, Arjun Ashok, Vladimir Filkov | ASE | 2025 | AI / LLM for SE |
| ORFuzz: Fuzzing the "Other Side" of LLM Safety - Testing Over-Refusal. Haonan Zhang 0007, Dongxia Wang 0002, Yi Liu, Kexin Chen, Jiashui Wang | ASE | 2025 | Testing / QA; AI / LLM for SE |
| Not Every Patch is an Island: LLM-Enhanced Identification of Multiple Vulnerability Patches. Yi Song, Dongchen Xie, Lin Xu, He Zhang, Chunying Zhou | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Measuring LLM Code Generation Stability via Structural Entropy. Yewei Song, Tiezhu Sun, Xunzhu Tang, Prateek Rajput, Tegawendé F. Bissyandé | ASE | 2025 | AI / LLM for SE |
| MIMIC: Integrating Diverse Personality Traits for Better Game Testing Using Large Language Model. Yifei Chen, Sarra Habchi, Lili Wei | ASE | 2025 | Testing / QA; AI / LLM for SE |
| MCTS-Refined CoT: High-Quality Fine-Tuning Data for LLM-Based Repository Issue Resolution. Yibo Wang 0008, Zhihao Peng 0009, Ying Wang 0038, Zhao Wei, Hai Yu 0001 | ASE | 2025 | AI / LLM for SE; DevOps / CI / Build / Release |
| LogSage: An LLM-Based Framework for CI/CD Failure Detection and Remediation with Industrial Validation. Weiyuan Xu, Juntao Luo, Tao Huang, Kaixin Sui, Jie Geng | ASE | 2025 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release |
| Leveraging Mixture-of-Experts Framework for Smart Contract Vulnerability Repair with Large Language Model. Hang Yuan, Xizhi Hou, Lei Yu, Li Yang 0015, Jiayue Tang | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability |
| Learning Project-wise Subsequent Code Edits via Interleaving Neural-based Induction and Tool-based Deduction. Chenyan Liu, Yun Lin 0001, Yuhuan Huang, Jiaxin Chang, Binhang Qi | ASE | 2025 | AI / LLM for SE |
| Lares: LLM-driven Code Slice Semantic Search for Patch Presence Testing. Siyuan Li 0014, Yaowen Zheng, Hong Li 0004, Jingdong Guo, Chaopeng Dong | ASE | 2025 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| LLM-based Dynamic Differential Testing for Database Connectors with Reinforcement Learning-Guided Prompt Selection. Ce Lyu, Yanhao Wang 0001, Jie Liang, Minghao Zhao 0001 | ASE | 2025 | Testing / QA; AI / LLM for SE |
| LLM-assisted Industrial-Scale Differential Testing of Package Incompatibilities in Linux Distributions. Yuhao Yang, Chijin Zhou, Runzhe Wang, Weibo Zhang, Yuheng Shen | ASE | 2025 | Testing / QA; AI / LLM for SE |
| LLM-Powered Multi-Agent Collaboration for Intelligent Industrial On-Call Automation. Ruowei Fu, Yang Zhang, Zeyu Che, Xin Wu, Zhenyu Zhong | ASE | 2025 | AI / LLM for SE |
| LLM-Powered Fully Automated Chaos Engineering: Towards Enabling Anyone to Build Resilient Software Systems at Low Cost. Daisuke Kikuta, Hiroki Ikeuchi, Kengo Tajiri | ASE | 2025 | AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability |
| LLM-Guided Genetic Improvement: Envisioning Semantic Aware Automated Software Evolution. Karine Even-Mendoza, Alexander E. I. Brownlee, Alina Geiger, Carol Hanna, Justyna Petke | ASE | 2025 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| LLM-Based Identification of Null Pointer Exception Patches. Tahir Ullah, Waseem Akram 0005, Fiza Khaliq, Hui Liu | ASE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| LLM-Assisted Synthesis of High-Assurance C Programs. Prasita Mukherjee, Minghai Lu, Benjamin Delaware | ASE | 2025 | AI / LLM for SE |
| LAURA: Enhancing Code Review Generation with Context-Enriched Retrieval-Augmented LLM. Yuxin Zhang, Yuxia Zhang, Zeyu Sun 0004, Yanjie Jiang, Hui Liu 0003 | ASE | 2025 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| KAIOPS: A Platform Solution of End-to-End Multi-Modal AIOps for AI Training at Scale. Zeying Wang, Junhong Liu, Penghao Zhang, Xiaoyang Sun, Xu Wang | ASE | 2025 | AI / LLM for SE |
| Issue Localization via LLM-Driven Iterative Code Graph Searching. Zhonghao Jiang, Xiaoxue Ren, Meng Yan 0001, Wei Jiang 0041, Yong Li 0004 | ASE | 2025 | AI / LLM for SE |
| Industry Practice of LLM-Assisted Protocol Fuzzing for Commercial Communication Modules. Qiang Fu, Changjian Liu, Yuan Ding, Chao Fan, Yulai Fu | ASE | 2025 | Testing / QA; AI / LLM for SE |
| Improving Quality of LLM Code Generation in Low-Resource Programming Languages via Uncertainty Estimation. Georgii Andriushchenko | ASE | 2025 | AI / LLM for SE; Performance / Energy / Reliability |
| Improving LLM-based Log Parsing by Learning from Errors in Reasoning Traces. Jialai Wang, Juncheng Lu, Jie Yang, Junjie Wang 0001, Zeyu Gao | ASE | 2025 | AI / LLM for SE |
| Hypergraph Neural Network-based Multi-Granular Root Cause Localization for Microservice Systems. Yaxiao Li, Lu Wang 0014, Chenxi Zhang 0003, Qingshan Li, Siming Rong | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems |
| How Does ChatGPT Make Assumptions When Creating Erroneous Programs? Sadia Jahan, Xiaoyin Wang | ASE | 2025 | AI / LLM for SE |
| Hierarchical Knowledge Injection for Improving LLM-based Program Repair. Ramtin Ehsani, Esteban Parra, Sonia Haiduc, Preetha Chatterjee | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| GUI-ReRank: Enhancing GUI Retrieval with Multi-Modal LLM-based Reranking. Kristian Kolthoff, Felix Kretzer, Alexander Maedche, Simone Paolo Ponzetto, Christian Bartelt | ASE | 2025 | AI / LLM for SE; Mobile / Web / GUI / Android |
| From Redundancy to Efficiency: Exploiting Shared UI Interactions towards Efficient LLM-Based Testing. Xuan Wang, Yingchuan Wang, Yongxiang Hu 0003, Yu Zhang 0165, Hailiang Jin | ASE | 2025 | Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android; Performance / Energy / Reliability |
| Fixing Broken Graphs: LLM-Powered Automatic Code Optimization for DNN Programs. Haotian Wang, Yicheng Sui, Yudong Xie, Yicong Liu, Yufei Sun | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability |
| Faultseeker: LLM-Empowered Framework for Blockchain Transaction Fault Localization. Kairan Sun, Zhengzi Xu, Kaixuan Li 0002, Lyuye Zhang, Yuqiang Sun 0001 | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability |
| Explainable Fault Localization for Programming Assignments via LLM-Guided Annotation. Fang Liu, Tianze Wang, Li Zhang, Zheyu Yang, Jing Jiang | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Enhancing LLM's Ability to Generate More Repository-Aware Unit Tests Through Precise Context Injection. Xin Yin, Chao Ni 0001, Xinrui Li, Liushan Chen, Guojun Ma | ASE | 2025 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| Enhancing LLM to Decompile Optimized PTX to Readable CUDA for Tensor Programs. Xinyu Sun, Fugen Tang, Yu Zhang, Han Shen, Chengru Song | ASE | 2025 | AI / LLM for SE |
| Efficient Understanding of Machine Learning Model Mispredictions. Martin Eberlein, Jürgen Cito, Lars Grunske | ASE | 2025 | AI / LLM for SE |
| Detecting and Repairing Incomplete Software Requirements with Multi-LLM Ensembles. Mohamad Kassab, Marwan AbdElhameed | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Requirements / Modeling / Architecture |
| Detecting Various DeFi Price Manipulations with LLM Reasoning. Juantao Zhong, Daoyuan Wu, Ye Liu 0012, Maoyi Xie, Yang Liu 0003 | ASE | 2025 | AI / LLM for SE |
| Destabilizing Neurons to Generate Challenging Neural Network Verification Benchmarks. Linhan Li, ThanhVu Nguyen | ASE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Demystifying the Evolution of Neural Networks with BOM Analysis: Insights from a Large-Scale Study of 55,997 GitHub Repositories. Xiaoning Ren, Yuhang Ye 0004, Xiongfei Wu, Yueming Wu 0001, Yinxing Xue | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review |
| Defects4C: Benchmarking Large Language Model Repair Capability with C/C++ Bugs. Jian Wang 0067, Xiaofei Xie, Qiang Hu, Shangqing Liu, Jiongchi Yu | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| DeepTx: Real-Time Transaction Risk Analysis via Multi-Modal Features and LLM Reasoning. Yixuan Liu, Xinlei Li, Yi Li | ASE | 2025 | AI / LLM for SE |
| DeepExploitor: LLM-Enhanced Automated Exploitation of DeepLink Attack in Hybrid Apps. Zhangyue Zhang, Lei Zhang 0096, Zhibo Zhang 0006, Yongheng Liu, Zhemin Yang | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android |
| Coverage-Based Harmfulness Testing for LLM Code Transformation. Honghao Tan, Haibo Wang, Diany Pressato, Yisen Xu, Shin Hwei Tan | ASE | 2025 | Testing / QA; AI / LLM for SE |
| Context-Aware CodeLLM Eviction for AI-assisted Coding. Kishanthan Thangarajah, Boyuan Chen 0002, Shi Chang, Ahmed E. Hassan | ASE | 2025 | AI / LLM for SE |
| Characterizing Multi-Hunk Patches: Divergence, Proximity, and LLM Repair Challenges. Noor Nashid, Daniel Ding, Keheliya Gallaba, Ahmed E. Hassan, Ali Mesbah 0001 | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| BuilDroid: A Self-Correcting LLM Agent for Automated Android Builds. Jaehyeon Kim, Rui Rua, Karim Ali 0001 | ASE | 2025 | AI / LLM for SE; DevOps / CI / Build / Release; Mobile / Web / GUI / Android |
| BitsAI-Fix: LLM-Driven Approach for Automated Lint Error Resolution in Practice. Yuanpeng Li, Qi Long, Zhiyuan Yao, Jian Xu, Lintao Xie | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Beyond Static GUI Agent: Evolving LLM-based GUI Testing via Dynamic Memory. Mengzhuo Chen, Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Yangguang Xue | ASE | 2025 | Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review; Mobile / Web / GUI / Android |
| Automated Repair of Ambiguous Problem Descriptions for LLM-Based Code Generation. Haoxiang Jia, Robbie Morris, He Ye, Federica Sarro, Sergey Mechtaev | ASE | 2025 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| AppBDS: LLM-Powered Description Synthesis for Sensitive Behaviors in Mobile Apps. Zichen Liu, Xusheng Xiao | ASE | 2025 | AI / LLM for SE; Mobile / Web / GUI / Android |
| An LLM-based multi-agent framework for agile effort estimation. Thanh-Long Bui, Hoa Khanh Dam, Rashina Hoda | ASE | 2025 | AI / LLM for SE |
| An Empirical Study of Knowledge Transfer in AI Pair Programming. Alisa Welter, Niklas Schneider, Tobias Dick, Kallistos Weis, Christof Tinnes | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Advancing Binary Code Similarity Detection via Context-Content Fusion and LLM Verification. Chaopeng Dong, Jingdong Guo, Shouguo Yang, Yi Li, Dongliang Fang | ASE | 2025 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Advancing Automated Ethical Profiling in SE: a Zero-Shot Evaluation of LLM Reasoning. Patrizio Migliarini, Mashal Afzal Memon, Marco Autili, Paola Inverardi | ASE | 2025 | AI / LLM for SE |
| AdaptiveGuard: Towards Adaptive Runtime Safety for LLM-Powered Software. Rui Yang, Michael Fu, Chakkrit Tantithamthavorn, Chetan Arora 0002, Gunel Gulmammadova | ASE | 2025 | AI / LLM for SE |
| A Large Scale Study of AI-based Binary Function Similarity Detection Techniques for Security Researchers and Practitioners. Jingyi Shi, Yufeng Chen, Yang Xiao 0011, Yuekang Li, Zhengzi Xu | ASE | 2025 | AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical |
| A Characterization Study of Bugs in LLM Agent Workflow Orchestration Frameworks. Ziluo Xue, Yanjie Zhao 0001, Shenao Wang 0001, Kai Chen 0012, Haoyu Wang 0001 | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| "My productivity is boosted, but ..." Demystifying Users' Perception on AI Coding Assistants. Yunbo Lyu, Zhou Yang 0003, Jieke Shi, Jianming Chang, Yue Liu 0011 | ASE | 2025 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Towards More Complete Constraints for Deep Learning Library Testing via Complementary Set Guided Refinement. Gwihwan Go, Chijin Zhou, Quan Zhang 0003, Xiazijian Zou, Heyuan Shi | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Test Selection for Deep Neural Networks using Meta-Models with Uncertainty Metrics. Demet Demir, Aysu Betin Can, Elif Sürer | ISSTA | 2024 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| TeDA: A Testing Framework for Data Usage Auditing in Deep Learning Model Development. Xiangshan Gao, Jialuo Chen, Jingyi Wang 0004, Jie Shi 0013, Peng Cheng 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Synthesizing Boxes Preconditions for Deep Neural Networks. Zengyu Liu, Liqian Chen, Wanwei Liu, Ji Wang 0001 | ISSTA | 2024 | AI / LLM for SE |
| See the Forest, not Trees: Unveiling and Escaping the Pitfalls of Error-Triggering Inputs in Neural Network Testing. Yuanyuan Yuan 0001, Shuai Wang 0011, Zhendong Su 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| One-to-One or One-to-Many? Suggesting Extract Class Refactoring Opportunities with Intra-class Dependency Hypergraph Neural Network. Di Cui, Qiangqiang Wang, Yutong Zhao, Jiaqi Wang, Minjie Wei | ISSTA | 2024 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| NeuFair: Neural Network Fairness Repair with Dropout. Vishnu Asutosh Dasu, Ashish Kumar, Saeid Tizpaz-Niari, Gang Tan | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Maltracker: A Fine-Grained NPM Malware Tracker Copiloted by LLM-Enhanced Dataset. Zeliang Yu, Ming Wen 0001, Xiaochen Guo, Hai Jin 0001 | ISSTA | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability |
| LLM4Fin: Fully Automating LLM-Powered Test Case Generation for FinTech Software Acceptance Testing. Zhiyi Xue, Liangguo Li, Senyue Tian, Xiaohong Chen 0007, Pingping Li | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Isolation-Based Debugging for Neural Networks. Jialuo Chen, Jingyi Wang 0004, Youcheng Sun, Peng Cheng 0001, Jiming Chen 0001 | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Interpretability Based Neural Network Repair. Zuohui Chen, Jun Zhou, Youcheng Sun, Jingyi Wang 0004, Qi Xuan 0001 | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Interoperability in Deep Learning: A User Survey and Failure Analysis of ONNX Model Converters. Purvish Jajal, Wenxin Jiang 0001, Arav Tewari, Erik Kocinare, Joseph Woo | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical |
| How Effective Are They? Exploring Large Language Model Based Fuzz Driver Generation. Cen Zhang, Yaowen Zheng, Mingqiang Bai, Yeting Li, Wei Ma 0014 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| HECS: A Hypergraph Learning-Based System for Detecting Extract Class Refactoring Opportunities. Luqiao Wang, Qiangqiang Wang, Jiaqi Wang, Yutong Zhao, Minjie Wei | ISSTA | 2024 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Guardian: A Runtime Framework for LLM-Based UI Exploration. Dezhi Ran, Hao Wang 0112, Zihe Song, Mengzhou Wu, Yuan Cao | ISSTA | 2024 | AI / LLM for SE; Mobile / Web / GUI / Android |
| Graph Neural Networks for Vulnerability Detection: A Counterfactual Explanation. Zhaoyang Chu, Yao Wan 0001, Qian Li 0003, Yang Wu 0010, Hongyu Zhang 0002 | ISSTA | 2024 | AI / LLM for SE |
| Fuzzing JavaScript Interpreters with Coverage-Guided Reinforcement Learning for LLM-Based Mutation. Jueon Eom, Seyeon Jeong, Taekyoung Kwon 0002 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Face It Yourselves: An LLM-Based Two-Stage Strategy to Localize Configuration Errors via Logs. Shiwen Shan, Yintong Huo, Yuxin Su 0001, Yichen Li 0003, Dan Li 0016 | ISSTA | 2024 | AI / LLM for SE; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems |
| FDI: Attack Neural Code Generation Systems through User Feedback Channel. Zhensu Sun, Xiaoning Du 0001, Xiapu Luo, Fu Song, David Lo 0001 | ISSTA | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Evaluating Deep Neural Networks in Deployment: A Comparative Study (Replicability Study). Eduard Pinconschi, Divya Gopinath, Rui Abreu 0001, Corina S. Pasareanu | ISSTA | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release |
| Domain Adaptation for Code Model-Based Unit Test Case Generation. Jiho Shin, Sepehr Hashtroudi, Hadi Hemmati, Song Wang 0009 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Distance-Aware Test Input Selection for Deep Neural Networks. Zhong Li, Zhengfeng Xu, Ruihua Ji, Minxue Pan, Tian Zhang 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| DiaVio: LLM-Empowered Diagnosis of Safety Violations in ADS Simulation Testing. You Lu 0005, Yifan Tian, Yuyang Bi, Bihuan Chen 0001, Xin Peng 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Decomposition of Deep Neural Networks into Modules via Mutation Analysis. Ali Ghanbari 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Certified Continual Learning for Neural Network Regression. Long H. Pham, Jun Sun 0001 | ISSTA | 2024 | Testing / QA; AI / LLM for SE |
| Calico: Automated Knowledge Calibration and Diagnosis for Elevating AI Mastery in Code Tasks. Yuxin Qiu, Jie Hu 0031, Qian Zhang 0020, Heng Yin 0001 | ISSTA | 2024 | AI / LLM for SE |
| CREF: An LLM-Based Conversational Software Repair Framework for Programming Tutors. Boyang Yang, Haoye Tian, Weiguo Pian, Haoran Yu, Haitao Wang | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Automated Program Repair via Conversation: Fixing 162 out of 337 Bugs for $0.42 Each using ChatGPT. Chunqiu Steven Xia, Lingming Zhang 0001 | ISSTA | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Automated Deep Learning Optimization via DSL-Based Source Code Transformation. Ruixin Wang, Minghai Lu, Cody Hao Yu, Yi-Hsiang Lai, Tianyi Zhang 0001 | ISSTA | 2024 | AI / LLM for SE; Performance / Energy / Reliability |
| AI Coders Are among Us: Rethinking Programming Language Grammar towards Efficient Code Generation. Zhensu Sun, Xiaoning Du 0001, Zhou Yang 0003, Li Li 0029, David Lo 0001 | ISSTA | 2024 | AI / LLM for SE |
| When Neural Code Completion Models Size up the Situation: Attaining Cheaper and Faster Completion through Dynamic Model Inference. Zhensu Sun, Xiaoning Du 0001, Fu Song, Shangwen Wang, Li Li 0029 | ICSE | 2024 | AI / LLM for SE |
| VeRe: Verification Guided Synthesis for Repairing Deep Neural Networks. Jianan Ma, Pengfei Yang 0002, Jingyi Wang 0004, Youcheng Sun, Cheng-Chao Huang | ICSE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| VGX: Large-Scale Sample Generation for Boosting Learning-Based Software Vulnerability Analyses. Yu Nong, Richard Fang, Guangbei Yi, Kunsong Zhao, Xiapu Luo | ICSE | 2024 | AI / LLM for SE |
| Using an LLM to Help With Code Understanding. Daye Nam, Andrew Macvean, Vincent J. Hellendoorn, Bogdan Vasilescu, Brad A. Myers | ICSE | 2024 | AI / LLM for SE |
| UniLog: Automatic Logging via LLM and In-Context Learning. Junjielong Xu, Ziang Cui, Yuan Zhao 0014, Xu Zhang 0024, Shilin He | ICSE | 2024 | AI / LLM for SE |
| Towards Causal Deep Learning for Vulnerability Detection. Md Mahbubur Rahman, Ira Ceka, Chengzhi Mao, Saikat Chakraborty 0001, Baishakhi Ray | ICSE | 2024 | AI / LLM for SE |
| Toward Improved Deep Learning-based Vulnerability Detection. Adriana Sejfia, Satyaki Das, Saad Shafiq, Nenad Medvidovic | ICSE | 2024 | AI / LLM for SE |
| Testing the Limits: Unusual Text Inputs Generation for Mobile App Crash Detection with Large Language Model. Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Mengzhuo Chen, Boyu Wu | ICSE | 2024 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Mobile / Web / GUI / Android |
| Software Engineering Research in a World with Generative Artificial Intelligence. Martin C. Rinard | ICSE | 2024 | AI / LLM for SE |
| RUNNER: Responsible UNfair NEuron Repair for Enhancing Deep Neural Network Fairness. Tianlin Li, Yue Cao, Jian Zhang 0087, Shiqian Zhao, Yihao Huang 0001 | ICSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Out of Context: How important is Local Context in Neural Program Repair? Julian Aron Prenner, Romain Robbes | ICSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| MalCertain: Enhancing Deep Neural Network Based Android Malware Detection by Tackling Prediction Uncertainty. Haodong Li, Guosheng Xu 0001, Liu Wang 0002, Xusheng Xiao, Xiapu Luo | ICSE | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android |
| Make LLM a Testing Expert: Bringing Human-like Interaction to Mobile GUI Testing via Functionality-aware Decisions. Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Mengzhuo Chen, Boyu Wu | ICSE | 2024 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android |
| Machine Learning is All You Need: A Simple Token-based Approach for Effective Code Clone Detection. Siyue Feng, Wenqi Suo, Yueming Wu 0001, Deqing Zou, Yang Liu 0003 | ICSE | 2024 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| MAFT: Efficient Model-Agnostic Fairness Testing for Deep Neural Networks via Zero-Order Gradient Search. Zhaohui Wang, Min Zhang 0007, Jingran Yang, Bojie Shao, Min Zhang 0002 | ICSE | 2024 | Testing / QA; AI / LLM for SE |
| Learning-based Widget Matching for Migrating GUI Test Cases. Yakun Zhang 0001, Wenjie Zhang 0007, Dezhi Ran, Qihao Zhu, Chengfeng Dou | ICSE | 2024 | Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android |
| Large Language Models are Edge-Case Generators: Crafting Unusual Programs for Fuzzing Deep Learning Libraries. Yinlin Deng, Chunqiu Steven Xia, Chenyuan Yang, Shizhuo Dylan Zhang, Shujing Yang | ICSE | 2024 | Testing / QA; AI / LLM for SE |
| Inferring Data Preconditions from Deep Learning Models for Trustworthy Prediction in Deployment. Shibbir Ahmed, Hongyang Gao, Hridesh Rajan | ICSE | 2024 | AI / LLM for SE; DevOps / CI / Build / Release |
| Improving Smart Contract Security with Contrastive Learning-based Vulnerability Detection. Yizhou Chen, Zeyu Sun 0004, Zhihao Gong, Dan Hao 0001 | ICSE | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability |
| ITER: Iterative Neural Repair for Multi-Location Patches. He Ye, Martin Monperrus | ICSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| How Far Are We? The Triumphs and Trials of Generative AI in Learning Software Engineering. Rudrajit Choudhuri, Dylan Liu, Igor Steinmacher, Marco Aurélio Gerosa, Anita Sarma | ICSE | 2024 | AI / LLM for SE |
| GrammarT5: Grammar-Integrated Pretrained Encoder-Decoder Neural Model for Code. Qihao Zhu, Qingyuan Liang, Zeyu Sun 0004, Yingfei Xiong 0001, Lu Zhang 0023 | ICSE | 2024 | AI / LLM for SE |
| GPTScan: Detecting Logic Vulnerabilities in Smart Contracts by Combining GPT with Program Analysis. Yuqiang Sun 0001, Daoyuan Wu, Yue Xue, Han Liu 0012, Haijun Wang 0002 | ICSE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Exploring the Potential of ChatGPT in Automated Code Refinement: An Empirical Study. Qi Guo, Junming Cao, Xiaofei Xie, Shangqing Liu, Xiaohong Li 0001 | ICSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Enhancing Exploratory Testing by Large Language Model and Knowledge Graph. Yanqi Su, Dianshu Liao, Zhenchang Xing, Qing Huang, Mulong Xie | ICSE | 2024 | Testing / QA; AI / LLM for SE |
| Development in times of hype: How freelancers explore Generative AI? Mateusz Dolata, Norbert Lange, Gerhard Schwabe | ICSE | 2024 | AI / LLM for SE |
| Demystifying and Detecting Misuses of Deep Learning APIs. Moshi Wei, Nima Shiri Harzevili, Yuekai Huang, Jinqiu Yang 0001, Junjie Wang 0001 | ICSE | 2024 | AI / LLM for SE |
| Deep Learning or Classical Machine Learning? An Empirical Study on Log-Based Anomaly Detection. Boxi Yu, Jiayi Yao, Qiuai Fu, Zhiqing Zhong, Haotian Xie | ICSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical; Cloud / Microservices / Distributed Systems |
| Dataflow Analysis-Inspired Deep Learning for Efficient Vulnerability Detection. Benjamin Steenhoek, Hongyang Gao, Wei Le | ICSE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| DEMISTIFY: Identifying On-device Machine Learning Models Stealing and Reuse Vulnerabilities in Mobile Apps. Pengcheng Ren, Chaoshun Zuo, Xiaofeng Liu 0013, Wenrui Diao, Qingchuan Zhao | ICSE | 2024 | AI / LLM for SE; Mobile / Web / GUI / Android |
| CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models. Hao Yu 0016, Bo Shen, Dezhi Ran, Jiaxin Zhang 0029, Qi Zhang 0020 | ICSE | 2024 | AI / LLM for SE |
| Coca: Improving and Explaining Graph Neural Network-Based Vulnerability Detection Systems. Sicong Cao, Xiaobing Sun 0001, Xiaoxue Wu 0001, David Lo 0001, Lili Bo | ICSE | 2024 | AI / LLM for SE |
| ChatGPT-Resistant Screening Instrument for Identifying Non-Programmers. Raphael Serafini, Clemens Otto, Stefan Albert Horstmann, Alena Naiakshina | ICSE | 2024 | AI / LLM for SE |
| ChatGPT Incorrectness Detection in Software Reviews. Minaoar Hossain Tanzil, Junaed Younus Khan, Gias Uddin 0001 | ICSE | 2024 | AI / LLM for SE |
| CIT4DNN: Generating Diverse and Rare Inputs for Neural Networks Using Latent Space Combinatorial Testing. Swaroopa Dola, Rory McDaniel, Matthew B. Dwyer, Mary Lou Soffa | ICSE | 2024 | Testing / QA; AI / LLM for SE |
| An Empirical Study on Low GPU Utilization of Deep Learning Jobs. Yanjie Gao, Yichen He, Xinze Li, Bo Zhao, Haoxiang Lin | ICSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| A Large-Scale Survey on the Usability of AI Programming Assistants: Successes and Challenges. Jenny T. Liang, Chenyang Yang 0002, Brad A. Myers | ICSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| A Comprehensive Study of Learning-based Android Malware Detectors under Challenging Environments. Cuiying Gao, Gaozhun Huang, Heng Li 0008, Bang Wu 0003, Yueming Wu 0001 | ICSE | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android |
| Your Code Secret Belongs to Me: Neural Code Completion Tools Can Memorize Hard-Coded Credentials. Yizhan Huang; Yichen Li 0003; Weibin Wu 0002; Jianping Zhang 0002; Michael R. Lyu | FSE | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Towards Better Graph Neural Network-Based Fault Localization through Enhanced Code Representation. Md Nakhla Rafi; Dong Jae Kim; An Ran Chen; Tse-Hsun (Peter) Chen; Shaowei Wang 0002 | FSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Towards AI-Assisted Synthesis of Verified Dafny Methods. Md Rakib Hossain Misu; Cristina V. Lopes; Iris Ma; James Noble 0001 | FSE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| SimLLM: Calculating Semantic Similarity in Code Summaries using a Large Language Model-Based Approach. Xin Jin; Zhiqiang Lin 0001 | FSE | 2024 | AI / LLM for SE |
| Rocks Coding, Not Development: A Human-Centric, Experimental Evaluation of LLM-Supported SE Tasks. Wei Wang 0353; Huilong Ning; Gaowei Zhang; Libo Liu; Yi Wang 0013 | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Predicting Code Comprehension: A Novel Approach to Align Human Gaze with Code using Deep Neural Networks. Tarek Alakmeh; David R. Reich; Lena A. Jäger; Thomas Fritz 0001 | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical; Education / Program Comprehension |
| Only diff Is Not Enough: Generating Commit Messages Leveraging Reasoning and Action of Large Language Model. Jiawei Li 0013; David Faragó; Christian Petrov; Iftekhar Ahmed 0001 | FSE | 2024 | AI / LLM for SE; DevOps / CI / Build / Release |
| On Reducing Undesirable Behavior in Deep-Reinforcement-Learning-Based Software. Ophir M. Carmel; Guy Katz | FSE | 2024 | AI / LLM for SE |
| MirrorFair: Fixing Fairness Bugs in Machine Learning Software via Counterfactual Predictions. Ying Xiao; Jie M. Zhang; Yepang Liu 0001; Mohammad Reza Mousavi 0001; Sicen Liu; Dingyuan Xue | FSE | 2024 | AI / LLM for SE |
| Generative AI for Pull Request Descriptions: Adoption, Impact, and Developer Interventions. Tao Xiao 0001; Hideaki Hata; Christoph Treude; Kenichi Matsumoto | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| EyeTrans: Merging Human and Machine Attention for Neural Code Summarization. Yifan Zhang 0013; Jiliang Li; Zachary Karas; Aakash Bansal; Toby Jia-Jun Li; Collin McMillan; Kevin Leach; Yu Huang 0015 | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Evaluating and Improving ChatGPT for Unit Test Generation. Zhiqiang Yuan; Mingwei Liu 0002; Shiji Ding; Kaixin Wang; Yixuan Chen 0012; Xin Peng 0001; Yiling Lou | FSE | 2024 | Testing / QA; AI / LLM for SE |
| DiffCoder: Enhancing Large Language Model on API Invocation via Analogical Code Exercises. Daoguang Zan; Ailun Yu; Bo Shen; Bei Chen 0008; Wei Li 0326; Yongshun Gong; Xiaolin Chen; Yafen Yao; Weihua Luo; Bei Guan; Yan Liu; Yongji Wang 0002; Qianxiang Wang; Lizhen Cui 0001 | FSE | 2024 | AI / LLM for SE |
| DeciX: Explain Deep Learning Based Code Generation Applications. Simin Chen; Zexin Li 0001; Wei Yang 0013; Cong Liu 0005 | FSE | 2024 | AI / LLM for SE |
| CrossCert: A Cross-Checking Detection Approach to Patch Robustness Certification for Deep Learning Models. Qilin Zhou; Zhengyuan Wei; Haipeng Wang 0005; Bo Jiang 0001; Wing-Kwong Chan | FSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Code-Aware Prompting: A Study of Coverage-Guided Test Generation in Regression Setting using LLM. Gabriel Ryan; Siddhartha Jain 0001; Mingyue Shang; Shiqi Wang 0002; Xiaofei Ma 0001; Murali Krishna Ramanathan; Baishakhi Ray | FSE | 2024 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical |
| ClarifyGPT: A Framework for Enhancing LLM-Based Code Generation via Requirements Clarification. Fangwen Mu; Lin Shi 0006; Song Wang 0009; Zhuohao Yu 0002; Binquan Zhang; Chenxue Wang; Shichao Liu; Qing Wang 0001 | FSE | 2024 | AI / LLM for SE; Requirements / Modeling / Architecture |
| Can GPT-4 Replicate Empirical Software Engineering Research? Jenny T. Liang; Carmen Badea; Christian Bird; Robert DeLine; Denae Ford; Nicole Forsgren; Thomas Zimmermann 0001 | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| COSTELLO: Contrastive Testing for Embedding-Based Large Language Model as a Service Embeddings. Weipeng Jiang; Juan Zhai; Shiqing Ma; Xiaoyu Zhang 0013; Chao Shen 0001 | FSE | 2024 | Testing / QA; AI / LLM for SE |
| Beyond Code Generation: An Observational Study of ChatGPT Usage in Software Engineering Practice. Ranim Khojah; Mazen Mohamad; Philipp Leitner 0001; Francisco Gomes de Oliveira Neto | FSE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical |
| An Empirical Study on Focal Methods in Deep-Learning-Based Approaches for Assertion Generation. Yibo He; Jiaming Huang; Hao Yu 0016; Tao Xie 0001 | FSE | 2024 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical |
| AI-Assisted Code Authoring at Scale: Fine-Tuning, Deploying, and Mixed Methods Evaluation. Vijayaraghavan Murali; Chandra Shekhar Maddila; Imad Ahmad; Michael Bolin; Daniel Cheng; Negar Ghorbani; Renuka Fernandez; Nachiappan Nagappan; Peter C. Rigby | FSE | 2024 | AI / LLM for SE |
| A Quantitative and Qualitative Evaluation of LLM-Based Explainable Fault Localization. Sungmin Kang; Gabin An; Shin Yoo | FSE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| A Miss Is as Good as A Mile: Metamorphic Testing for Deep Learning Operators. Jinyin Chen; Chengyu Jia 0001; Yunjie Yan; Jie Ge; Haibin Zheng; Yao Cheng 0002 | FSE | 2024 | Testing / QA; AI / LLM for SE |
| WaDec: Decompiling WebAssembly Using Large Language Model. Xinyu She, Yanjie Zhao 0001, Haoyu Wang 0001 | ASE | 2024 | AI / LLM for SE |
| Using LLM for Mining and Testing Constraints in API Testing. Hieu Huynh, Quoc-Tri Le, Tien N. Nguyen, Vu Nguyen 0003 | ASE | 2024 | Testing / QA; AI / LLM for SE |
| Using AI to Automate the Modernization of Legacy Software Applications. Vikram Nitin | ASE | 2024 | AI / LLM for SE |
| Unity Is Strength: Collaborative LLM-Based Agents for Code Reviewer Recommendation. Luqiao Wang, Yangtao Zhou, Huiying Zhuang, Qingshan Li, Di Cui | ASE | 2024 | AI / LLM for SE |
| UFront: Toward A Unified MLIR Frontend for Deep Learning. Guoqing Bao, Heng Shi 0005, Chengyi Cui, Yalin Zhang 0004, Jianguo Yao 0002 | ASE | 2024 | AI / LLM for SE |
| Trident: Detecting SQL Injection Attacks via Abstract Syntax Tree-based Neural Network. Yuanlin Li, Zhiwei Xu, Min Zhou 0001, Hai Wan, Xibin Zhao | ASE | 2024 | AI / LLM for SE |
| Towards LLM-augmented multiagent systems for agile software engineering. Konrad Cinkusz, Jaroslaw A. Chudziak | ASE | 2024 | AI / LLM for SE |
| Three Heads Are Better Than One: Suggesting Move Method Refactoring Opportunities with Inter-class Code Entity Dependency Enhanced Hybrid Hypergraph Neural Network. Di Cui, Jiaqi Wang, Qiangqiang Wang, Peng Ji, Minglang Qiao | ASE | 2024 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| The Potential of One-Shot Failure Root Cause Analysis: Collaboration of the Large Language Model and Small Classifier. Yongqi Han 0001, Qingfeng Du, Ying Huang, Jiaqi Wu, Fulong Tian | ASE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Test-Driven Development and LLM-based Code Generation. Noble Saji Mathews, Meiyappan Nagappan | ASE | 2024 | Testing / QA; AI / LLM for SE |
| PatchTrack: Analyzing ChatGPT's Impact on Software Patch Decision-Making in Pull Requests. Daniel Ogenrwot, John Businge | ASE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Mutual Learning-Based Framework for Enhancing Robustness of Code Models via Adversarial Training. Yangsen Wang, Yizhou Chen, Yifan Zhao, Zhihao Gong, Junjie Chen 0003 | ASE | 2024 | AI / LLM for SE |
| Mutation-Based Deep Learning Framework Testing Method in JavaScript Environment. Yinglong Zou, Juan Zhai, Chunrong Fang, Jiawei Liu, Tao Zheng | ASE | 2024 | Testing / QA; AI / LLM for SE |
| Magneto: A Step-Wise Approach to Exploit Vulnerabilities in Dependent Libraries via LLM-Empowered Directed Fuzzing. Zhuotong Zhou, Yongzhuo Yang, Susheng Wu, Yiheng Huang, Bihuan Chen 0001 | ASE | 2024 | Testing / QA; AI / LLM for SE; Security / Privacy / Vulnerability |
| MLOLET - Machine Learning Optimized Load and Endurance Testing: An industrial experience report. Arthur Vitui, Tse-Hsun Chen | ASE | 2024 | Testing / QA; AI / LLM for SE |
| Leveraging Large Language Model to Assist Detecting Rust Code Comment Inconsistency. Yichi Zhang, Zixi Liu, Yang Feng 0003, Baowen Xu | ASE | 2024 | AI / LLM for SE |
| LLM4Workflow: An LLM-based Automated Workflow Model Generation Tool. Jia Xu 0010, Weilin Du, Xiao Liu 0004, Xuejun Li 0001 | ASE | 2024 | AI / LLM for SE |
| LLM-Generated Invariants for Bounded Model Checking Without Loop Unrolling. Muhammad A. A. Pirzada, Giles Reger, Ahmed Bhayat, Lucas C. Cordeiro | ASE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| LLM-Based Java Concurrent Program to ArkTS Converter. Runlin Liu, Yuhang Lin, Yunge Hu, Zhe Zhang, Xiang Gao 0012 | ASE | 2024 | AI / LLM for SE |
| LLM Meets Bounded Model Checking: Neuro-symbolic Loop Invariant Inference. Guangyuan Wu, Weining Cao, Yuan Yao 0001, Hengfeng Wei, Taolue Chen 0001 | ASE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Instructive Code Retriever: Learn from Large Language Model's Feedback for Code Intelligence Tasks. Jiawei Lu, Haoye Wang, Zhongxin Liu 0002, Keyu Liang, Lingfeng Bao | ASE | 2024 | AI / LLM for SE |
| In-Simulation Testing of Deep Learning Vision Models in Autonomous Robotic Manipulators. Dmytro Humeniuk, Houssem Ben Braiek, Thomas Reid, Foutse Khomh | ASE | 2024 | Testing / QA; AI / LLM for SE |
| Imperceptible Content Poisoning in LLM-Powered Applications. Quan Zhang 0003, Chijin Zhou, Gwihwan Go, Binqi Zeng, Heyuan Shi | ASE | 2024 | AI / LLM for SE |
| HITS: High-coverage LLM-based Unit Test Generation via Method Slicing. Zejun Wang, Kaibo Liu, Ge Li 0001, Zhi Jin 0001 | ASE | 2024 | Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Getting Inspiration for Feature Elicitation: App Store- vs. LLM-based Approach. Jialiang Wei, Anne-Lise Courbis, Thomas Lambolais, Binbin Xu 0002, Pierre-Louis Bernard | ASE | 2024 | AI / LLM for SE; Mobile / Web / GUI / Android |
| FAST: Boosting Uncertainty-based Test Prioritization Methods for Neural Networks via Feature Selection. Jialuo Chen, Jingyi Wang 0004, Xiyue Zhang 0001, Youcheng Sun, Marta Kwiatkowska | ASE | 2024 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| Exploring Parameter-Efficient Fine-Tuning of Large Language Model on Automated Program Repair. Guochang Li, Chen Zhi, Jialiang Chen, Junxiao Han, Shuiguang Deng | ASE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Exploring ChatGPT App Ecosystem: Distribution, Deployment and Security. Chuan Yan, Ruomai Ren, Mark Huasong Meng, Liuhuo Wan, Tian Yang Ooi | ASE | 2024 | AI / LLM for SE; Security / Privacy / Vulnerability; DevOps / CI / Build / Release; Mobile / Web / GUI / Android |
| Emergence of A Novel Domain Expert: A Generative AI-based Framework for Software Function Point Analysis. Zheng Zhao, Hongxiang Jiang, Ran Zhao, Bing He | ASE | 2024 | AI / LLM for SE |
| DevMuT: Testing Deep Learning Framework via Developer Expertise-Based Mutation. Yanzhou Mu, Juan Zhai, Chunrong Fang, Xiang Chen 0005, Zhixiang Cao | ASE | 2024 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical |
| Cross-lingual Code Clone Detection: When LLMs Fail Short Against Embedding-based Classifier. Micheline Bénédicte Moumoula, Abdoul Kader Kaboré, Jacques Klein, Tegawendé F. Bissyandé | ASE | 2024 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| CoqPilot, a plugin for LLM-based generation of proofs. Andrei Kozyrev, Gleb Solovev, Nikita Khramov, Anton Podkopaev | ASE | 2024 | AI / LLM for SE |
| ContractTinker: LLM-Empowered Vulnerability Repair for Real-World Smart Contracts. Che Wang, Jiashuo Zhang 0001, Jianbo Gao 0003, Libin Xia, Zhi Guan | ASE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Constructing Surrogate Models in Machine Learning Using Combinatorial Testing and Active Learning. Sunny Shree, Krishna Khadka, Yu Lei 0001, Raghu N. Kacker, D. Richard Kuhn | ASE | 2024 | Testing / QA; AI / LLM for SE |
| Coding-PTMs: How to Find Optimal Code Pre-trained Models for Code Embedding in Vulnerability Detection? Yu Zhao, Lina Gong, Zhiqiu Huang, Yongwei Wang, Mingqiang Wei | ASE | 2024 | AI / LLM for SE |
| ChatBR: Automated assessment and improvement of bug report quality using ChatGPT. Lili Bo, Wangjie Ji, Xiaobing Sun 0001, Ting Zhang 0011, Xiaoxue Wu 0001 | ASE | 2024 | AI / LLM for SE |
| Bridging Gaps in LLM Code Translation: Reducing Errors with Call Graphs and Bridged Debuggers. Yang Luo, Richard Yu, Fajun Zhang, Ling Liang, Yongqiang Xiong | ASE | 2024 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| An Empirical Study on Learning-based Techniques for Explicit and Implicit Commit Messages Generation. Zhiquan Huang, Yuan Huang 0002, Xiangping Chen, Xiaocong Zhou, Changlin Yang | ASE | 2024 | AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release |
| AdvSCanner: Generating Adversarial Smart Contracts to Exploit Reentrancy Vulnerabilities Using LLM and Static Analysis. Yin Wu, Xiaofei Xie, Chenyang Peng, Dijun Liu, Hao Wu 0100 | ASE | 2024 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability |
| AI-driven Java Performance Testing: Balancing Result Quality with Testing Time. Luca Traini, Federico Di Menna, Vittorio Cortellessa | ASE | 2024 | Testing / QA; AI / LLM for SE; Performance / Energy / Reliability |
| A Pixel-Level Explainable Approach of Convolutional Neural Networks and Its Application. Haitao Zhang, Jing Wang 0141, Ziyue Wang, Ziyi Zhao, Zhuo Cheng | ASE | 2024 | AI / LLM for SE |
| A Conceptual Framework for Quality Assurance of LLM-based Socio-critical Systems. Luciano Baresi, Matteo Camilli, Tommaso Dolci, Giovanni Quattrocchi | ASE | 2024 | AI / LLM for SE |
| Understanding and Tackling Label Errors in Deep Learning-Based Vulnerability Detection (Experience Paper). Xu Nie, Ningke Li, Kailong Wang 0001, Shangguang Wang, Xiapu Luo | ISSTA | 2023 | AI / LLM for SE |
| Towards More Realistic Evaluation for Neural Test Oracle Generation. Zhongxin Liu 0002, Kui Liu 0001, Xin Xia 0001, Xiaohu Yang 0001 | ISSTA | 2023 | Testing / QA; AI / LLM for SE |
| Semantic-Based Neural Network Repair. Richard Schumi, Jun Sun 0001 | ISSTA | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Quantitative Robustness Analysis of Neural Networks. Mara Downing | ISSTA | 2023 | AI / LLM for SE |
| In Defense of Simple Techniques for Neural Network Test Case Selection. Shenglin Bao, Chaofeng Sha, Bihuan Chen 0001, Xin Peng 0001, Wenyun Zhao | ISSTA | 2023 | Testing / QA; AI / LLM for SE |
| Improving Binary Code Similarity Transformer Models by Semantics-Driven Instruction Deemphasis. Xiangzhe Xu, Shiwei Feng 0002, Yapeng Ye, Guangyu Shen, Zian Su | ISSTA | 2023 | AI / LLM for SE |
| How Effective Are Neural Networks for Fixing Security Vulnerabilities. Yi Wu 0023, Nan Jiang 0012, Hung Viet Pham, Thibaud Lutellier, Jordan Davis | ISSTA | 2023 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Fuzzing Deep Learning Compilers with HirGen. Haoyang Ma, Qingchao Shen, Yongqiang Tian 0001, Junjie Chen 0003, Shing-Chi Cheung | ISSTA | 2023 | Testing / QA; AI / LLM for SE |
| DyCL: Dynamic Neural Network Compilation Via Program Rewriting and Graph Optimization. Simin Chen, Shiyi Wei, Cong Liu 0005, Wei Yang 0013 | ISSTA | 2023 | AI / LLM for SE; Performance / Energy / Reliability |
| Detecting Condition-Related Bugs with Control Flow Graph Neural Network. Jian Zhang 0087, Xu Wang 0007, Hongyu Zhang 0002, Hailong Sun 0001, Xudong Liu 0001 | ISSTA | 2023 | AI / LLM for SE |
| DeepAtash: Focused Test Generation for Deep Learning Systems. Tahereh Zohdinasab, Vincenzo Riccio, Paolo Tonella | ISSTA | 2023 | Testing / QA; AI / LLM for SE |
| CoopHance: Cooperative Enhancement for Robustness of Deep Learning Systems. Quan Zhang 0003, Yongqiang Tian 0001, Yifeng Ding, Shanshan Li 0001, Chengnian Sun | ISSTA | 2023 | AI / LLM for SE |
| COME: Commit Message Generation with Modification Embedding. Yichen He, Liran Wang, Kaiyi Wang, Yupeng Zhang, Hang Zhang | ISSTA | 2023 | AI / LLM for SE; DevOps / CI / Build / Release |
| An Empirical Study on the Effects of Obfuscation on Static Machine Learning-Based Malicious JavaScript Detectors. Kunlun Ren, Weizhong Qiang, Yueming Wu 0001, Yi Zhou, Deqing Zou | ISSTA | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical |
| ACETest: Automated Constraint Extraction for Testing Deep Learning Operators. Jingyi Shi, Yang Xiao 0011, Yuekang Li, Yeting Li, Dongsong Yu | ISSTA | 2023 | Testing / QA; AI / LLM for SE |
| When and Why Test Generators for Deep Learning Produce Invalid Inputs: an Empirical Study. Vincenzo Riccio, Paolo Tonella | ICSE | 2023 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical |
| VULGEN: Realistic Vulnerability Generation Via Pattern Mining and Deep Learning. Yu Nong, Yuzhe Ou, Michael Pradel, Feng Chen 0001, Haipeng Cai | ICSE | 2023 | AI / LLM for SE |
| Two Sides of the Same Coin: Exploiting the Impact of Identifiers in Neural Code Comprehension. Shuzheng Gao, Cuiyun Gao 0001, Chaozheng Wang, Jun Sun 0001, David Lo 0001 | ICSE | 2023 | AI / LLM for SE; Education / Program Comprehension |
| Towards Understanding Fairness and its Composition in Ensemble Machine Learning. Usman Gohar, Sumon Biswas, Hridesh Rajan | ICSE | 2023 | AI / LLM for SE |
| The Road Toward Dependable AI Based Systems. Paolo Tonella | ICSE | 2023 | AI / LLM for SE |
| Template-based Neural Program Repair. Xiangxin Meng, Xu Wang 0007, Hongyu Zhang 0002, Hailong Sun 0001, Xudong Liu 0001 | ICSE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Tare: Type-Aware Neural Program Repair. Qihao Zhu, Zeyu Sun 0004, Wenjie Zhang 0007, Yingfei Xiong 0001, Lu Zhang 0023 | ICSE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods |
| Revisiting Learning-based Commit Message Generation. Jinhao Dong, Yiling Lou, Dan Hao 0001, Lin Tan 0001 | ICSE | 2023 | AI / LLM for SE; DevOps / CI / Build / Release |
| Reusing Deep Neural Network Models through Model Re-engineering. Binhang Qi, Hailong Sun 0001, Xiang Gao 0012, Hongyu Zhang 0002, Zhaotian Li | ICSE | 2023 | AI / LLM for SE |
| Reliability Assurance for Deep Neural Network Architectures Against Numerical Defects. Linyi Li 0001, Yuhao Zhang 0005, Luyao Ren, Yingfei Xiong 0001, Tao Xie 0001 | ICSE | 2023 | AI / LLM for SE; Performance / Energy / Reliability |
| Regression Fuzzing for Deep Learning Systems. Hanmo You, Zan Wang, Junjie Chen 0003, Shuang Liu 0007, Shuochuan Li | ICSE | 2023 | Testing / QA; AI / LLM for SE |
| On-Demand Security Requirements Synthesis with Relational Generative Adversarial Networks. Viktoria Koscinski, Sara Hashemi, Mehdi Mirakhorli | ICSE | 2023 | AI / LLM for SE; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture |
| Leveraging Feature Bias for Scalable Misprediction Explanation of Machine Learning Models. Jiri Gesi, Xinyun Shen, Yunfan Geng, Qihong Chen, Iftekhar Ahmed 0001 | ICSE | 2023 | AI / LLM for SE |
| Large Language Models are Few-shot Testers: Exploring LLM-based General Bug Reproduction. Sungmin Kang, Juyeon Yoon, Shin Yoo | ICSE | 2023 | Testing / QA; AI / LLM for SE |
| Information-Theoretic Testing and Debugging of Fairness Defects in Deep Neural Networks. Verya Monjezi, Ashutosh Trivedi 0001, Gang Tan, Saeid Tizpaz-Niari | ICSE | 2023 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Fairify: Fairness Verification of Neural Networks. Sumon Biswas, Hridesh Rajan | ICSE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Explaining Software Bugs Leveraging Code Structures in Neural Machine Translation. Parvez Mahbub, Ohiduzzaman Shuvo, Mohammad Masudur Rahman 0001 | ICSE | 2023 | AI / LLM for SE |
| Enhancing Deep Learning-based Vulnerability Detection by Building Behavior Graph Model. Bin Yuan, Yifan Lu, Yilin Fang, Yueming Wu 0001, Deqing Zou | ICSE | 2023 | AI / LLM for SE; DevOps / CI / Build / Release |
| Does data sampling improve deep learning-based vulnerability detection? Yeas! and Nays! Xu Yang, Shaowei Wang 0002, Yi Li 0048, Shaohua Wang 0002 | ICSE | 2023 | AI / LLM for SE |
| DeepVD: Toward Class-Separation Features for Neural Network Vulnerability Detection. Wenbo Wang, Tien N. Nguyen, Shaohua Wang 0002, Yi Li 0048, Jiyuan Zhang | ICSE | 2023 | AI / LLM for SE |
| DeepArc: Modularizing Neural Networks for the Model Maintenance. Xiaoning Ren, Yun Lin 0001, Yinxing Xue, Ruofan Liu, Jun Sun 0001 | ICSE | 2023 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Decomposing a Recurrent Neural Network into Modules for Enabling Reusability and Replacement. Sayem Mohammad Imtiaz, Fraol Batole, Astha Singh, Rangeet Pan, Breno Dantas Cruz | ICSE | 2023 | AI / LLM for SE |
| DLInfer: Deep Learning with Static Slicing for Python Type Inference. Yanyan Yan, Yang Feng 0003, Hongcheng Fan, Baowen Xu | ICSE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| CCRep: Learning Code Change Representations via Pre-Trained Code Model and Query Back. Zhongxin Liu 0002, Zhijie Tang, Xin Xia 0001, Xiaohu Yang 0001 | ICSE | 2023 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| CC: Causality-Aware Coverage Criterion for Deep Neural Networks. Zhenlan Ji, Pingchuan Ma 0004, Yuanyuan Yuan 0001, Shuai Wang 0011 | ICSE | 2023 | Testing / QA; AI / LLM for SE |
| Balancing Effectiveness and Flakiness of Non-Deterministic Machine Learning Tests. Chunqiu Steven Xia, Saikat Dutta 0001, Sasa Misailovic, Darko Marinov, Lingming Zhang 0001 | ICSE | 2023 | Testing / QA; AI / LLM for SE |
| Aries: Efficient Testing of Deep Neural Networks via Labeling-Free Accuracy Estimation. Qiang Hu, Yuejun Guo 0001, Xiaofei Xie, Maxime Cordy, Mike Papadakis | ICSE | 2023 | Testing / QA; AI / LLM for SE |
| An Empirical Study of Pre-Trained Model Reuse in the Hugging Face Deep Learning Model Registry. Wenxin Jiang 0001, Nicholas Synovic, Matt Hyatt, Taylor R. Schorlemmer, Rohan Sethi | ICSE | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical |
| An Empirical Study of Deep Learning Models for Vulnerability Detection. Benjamin Steenhoek, Md Mahbubur Rahman, Richard Jiles, Wei Le | ICSE | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical |
| AI-based Question Answering Assistance for Analyzing Natural-language Requirements. Saad Ezzini, Sallam Abualhaija, Chetan Arora 0002, Mehrdad Sabetzadeh | ICSE | 2023 | AI / LLM for SE; Requirements / Modeling / Architecture |
| A Comprehensive Study of Real-World Bugs in Machine Learning Model Optimization. Hao Guan 0001, Ying Xiao, Jiaying Li 0001, Yepang Liu 0001, Guangdong Bai | ICSE | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical; Performance / Energy / Reliability |
| TransMap: Pinpointing Mistakes in Neural Code Translation. Bo Wang 0146, Ruishi Li, Mingkai Li, Prateek Saxena | FSE | 2023 | AI / LLM for SE |
| Towards Feature-Based Analysis of the Machine Learning Development Lifecycle. Boyue Caroline Hu, Marsha Chechik | FSE | 2023 | AI / LLM for SE |
| Towards AI-Driven Software Development: Challenges and Lessons from the Field (Keynote). Eran Yahav | FSE | 2023 | AI / LLM for SE |
| Revisiting Neural Program Smoothing for Fuzzing. Maria-Irina Nicolae, Max Eisele, Andreas Zeller | FSE | 2023 | Testing / QA; AI / LLM for SE |
| Recommending Analogical APIs via Knowledge Graph Embedding. Mingwei Liu 0002, Yanjun Yang, Yiling Lou, Xin Peng 0001, Zhong Zhou | FSE | 2023 | AI / LLM for SE |
| On Using Information Retrieval to Recommend Machine Learning Good Practices for Software Engineers. Laura Cabra-Acela, Anamaria Mojica-Hanke, Mario Linares-Vásquez, Steffen Herbold | FSE | 2023 | AI / LLM for SE |
| Neural-Based Test Oracle Generation: A Large-Scale Evaluation and Lessons Learned. Soneya Binta Hossain, Antonio Filieri, Matthew B. Dwyer, Sebastian G. Elbaum, Willem Visser | FSE | 2023 | Testing / QA; AI / LLM for SE |
| LLM-Based Code Generation Method for Golang Compiler Testing. Qiuhan Gu | FSE | 2023 | Testing / QA; AI / LLM for SE |
| Knowledge-Based Version Incompatibility Detection for Deep Learning. Zhongkai Zhao, Bonan Kou, Mohamed Yilmaz Ibrahim, Muhao Chen 0001, Tianyi Zhang 0001 | FSE | 2023 | AI / LLM for SE |
| Efficient Text-to-Code Retrieval with Cascaded Fast and Slow Transformer Models. Akhilesh Deepak Gotmare, Junnan Li 0001, Shafiq Joty, Steven C. H. Hoi | FSE | 2023 | AI / LLM for SE |
| Dynamic Data Fault Localization for Deep Neural Networks. Yining Yin, Yang Feng 0003, Shihao Weng, Zixi Liu, Yuan Yao 0001 | FSE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| DistXplore: Distribution-Guided Testing for Evaluating and Enhancing Deep Learning Systems. Longtian Wang, Xiaofei Xie, Xiaoning Du 0001, Meng Tian, Qing Guo 0005 | FSE | 2023 | Testing / QA; AI / LLM for SE |
| Detecting Overfitting of Machine Learning Techniques for Automatic Vulnerability Detection. Niklas Risse | FSE | 2023 | AI / LLM for SE |
| Design by Contract for Deep Learning APIs. Shibbir Ahmed, Sayem Mohammad Imtiaz, Syeda Khairunnesa Samantha, Breno Dantas Cruz, Hridesh Rajan | FSE | 2023 | AI / LLM for SE; Requirements / Modeling / Architecture |
| Demystifying Dependency Bugs in Deep Learning Stack. Kaifeng Huang 0001, Bihuan Chen 0001, Susheng Wu, Junming Cao, Lei Ma 0003 | FSE | 2023 | AI / LLM for SE |
| DeepRover: A Query-Efficient Blackbox Attack for Deep Neural Networks. Fuyuan Zhang, Xinwen Hu, Lei Ma 0003, Jianjun Zhao 0001 | FSE | 2023 | AI / LLM for SE; Security / Privacy / Vulnerability |
| Deep Learning Based Feature Envy Detection Boosted by Real-World Examples. Bo Liu 0094, Hui Liu 0003, Guangjie Li, Nan Niu, Zimao Xu | FSE | 2023 | AI / LLM for SE |
| DeMinify: Neural Variable Name Recovery and Type Inference. Yi Li 0048, Aashish Yadavally, Jiaxing Zhang 0002, Shaohua Wang 0002, Tien N. Nguyen | FSE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| DENT: A Tool for Tagging Stack Overflow Posts with Deep Learning Energy Patterns. Shriram Shanbhag, Sridhar Chimalakonda, Vibhu Saujanya Sharma, Vikrant Kaulgud | FSE | 2023 | AI / LLM for SE; Performance / Energy / Reliability |
| Compatibility Issues in Deep Learning Systems: Problems and Opportunities. Jun Wang 0167, Guanping Xiao, Shuai Zhang 0046, Huashan Lei, Yepang Liu 0001 | FSE | 2023 | AI / LLM for SE |
| Commit-Level, Neural Vulnerability Detection and Assessment. Yi Li 0048, Aashish Yadavally, Jiaxing Zhang 0002, Shaohua Wang 0002, Tien N. Nguyen | FSE | 2023 | AI / LLM for SE; DevOps / CI / Build / Release |
| CodeMark: Imperceptible Watermarking for Code Datasets against Neural Code Completion Models. Zhensu Sun, Xiaoning Du 0001, Fu Song, Li Li 0029 | FSE | 2023 | AI / LLM for SE |
| Can Machine Learning Pipelines Be Better Configured? Yibo Wang 0008, Ying Wang 0038, Tingwei Zhang, Yue Yu 0001, Shing-Chi Cheung | FSE | 2023 | AI / LLM for SE |
| BiasAsker: Measuring the Bias in Conversational AI System. Yuxuan Wan, Wenxuan Wang 0001, Pinjia He, Jiazhen Gu, Haonan Bai | FSE | 2023 | AI / LLM for SE |
| Benchmarking Robustness of AI-Enabled Multi-sensor Fusion Systems: Challenges and Opportunities. Xinyu Gao, Zhijie Wang 0014, Yang Feng 0003, Lei Ma 0003, Zhenyu Chen 0001 | FSE | 2023 | AI / LLM for SE |
| Assisting Static Analysis with Large Language Models: A ChatGPT Experiment. Haonan Li 0009, Yu Hao 0006, Yizhuo Zhai, Zhiyun Qian | FSE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| A Generative and Mutational Approach for Synthesizing Bug-Exposing Test Cases to Guide Compiler Fuzzing. Guixin Ye, Tianmin Hu, Zhanyong Tang, Zhenye Fan, Shin Hwei Tan | FSE | 2023 | Testing / QA; AI / LLM for SE |
| Using Deep Learning to Automatically Improve Code Readability. Antonio Vitale, Valentina Piantadosi, Simone Scalabrino, Rocco Oliveto | ASE | 2023 | AI / LLM for SE; Education / Program Comprehension |
| Unifying Defect Prediction, Categorization, and Repair by Multi-Task Deep Learning. Chao Ni 0001, Kaiwen Yang, Yan Zhu, Xiang Chen 0005, Xiaohu Yang 0001 | ASE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Towards Self-Adaptive Machine Learning-Enabled Systems Through QoS-Aware Model Switching. Shubham Kulkarni, Arya Marda, Karthik Vaidhyanathan | ASE | 2023 | AI / LLM for SE |
| Towards Safe Automated Refactoring of Imperative Deep Learning Programs to Graph Execution. Raffi Khatchadourian, Tatiana Castro Vélez, Mehdi Bagherzadeh 0001, Nan Jia, Anita Raja | ASE | 2023 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Semantic Data Augmentation for Deep Learning Testing Using Generative AI. Sondess Missaoui, Simos Gerasimou, Nicholas Matragkas | ASE | 2023 | Testing / QA; AI / LLM for SE |
| Robin: A Novel Method to Produce Robust Interpreters for Deep Learning-Based Code Classifiers. Zhen Li 0027, Ruqian Zhang, Deqing Zou, Ning Wang 0098, Yating Li | ASE | 2023 | AI / LLM for SE; Performance / Energy / Reliability |
| On the Evaluation of Neural Code Translation: Taxonomy and Benchmark. Mingsheng Jiao, Tingrui Yu, Xuan Li, Guanjie Qiu, Xiaodong Gu 0002 | ASE | 2023 | AI / LLM for SE |
| Nuances are the Key: Unlocking ChatGPT to Find Failure-Inducing Tests with Differential Prompting. Tsz On Li, Wenxi Zong, Yibo Wang 0008, Haoye Tian, Ying Wang 0038 | ASE | 2023 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Neural SZZ Algorithm. Lingxiao Tang, Lingfeng Bao, Xin Xia 0001, Zhongdong Huang | ASE | 2023 | AI / LLM for SE |
| Mutation-based Fault Localization of Deep Neural Networks. Ali Ghanbari 0001, Deepak-George Thomas, Muhammad Arbab Arshad, Hridesh Rajan | ASE | 2023 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Log Parsing: How Far Can ChatGPT Go? Van-Hoang Le, Hongyu Zhang 0002 | ASE | 2023 | AI / LLM for SE |
| Let's Chat to Find the APIs: Connecting Human, LLM and Knowledge Graph through AI Chain. Qing Huang, Zhenyu Wan, Zhenchang Xing, Changjing Wang, Jieshan Chen | ASE | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Identify and Update Test Cases When Production Code Changes: A Transformer-Based Approach. Xing Hu 0008, Zhuang Liu, Xin Xia 0001, Zhongxin Liu 0002, Tongtong Xu | ASE | 2023 | Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| How to Train Your Neural Bug Detector: Artificial vs Real Bugs. Cedric Richter, Heike Wehrheim | ASE | 2023 | AI / LLM for SE |
| HOBAT: Batch Verification for Homogeneous Structural Neural Networks. Jingyang Li, Guoqiang Li 0001 | ASE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Green AI Quotient: Assessing Greenness of AI-based software and the way forward. Samarth Sikand, Vibhu Saujanya Sharma, Vikrant Kaulgud, Sanjay Podder | ASE | 2023 | AI / LLM for SE |
| Generative Type Inference for Python. Yun Peng 0003, Chaozheng Wang, Wenxuan Wang 0001, Cuiyun Gao 0001, Michael R. Lyu | ASE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Generative Model-Based Testing on Decision-Making Policies. Zhuo Li 0021, Xiongfei Wu, Derui Zhu, Mingfei Cheng, Siyuan Chen | ASE | 2023 | Testing / QA; AI / LLM for SE |
| From Misuse to Mastery: Enhancing Code Generation with Knowledge-Driven AI Chaining. Xiaoxue Ren, Xinyuan Ye, Dehai Zhao, Zhenchang Xing, Xiaohu Yang 0001 | ASE | 2023 | AI / LLM for SE |
| Fixing Privilege Escalations in Cloud Access Control with MaxSAT and Graph Neural Networks. Yang Hu, Wenxi Wang, Sarfraz Khurshid, Kenneth L. McMillan, Mohit Tiwari | ASE | 2023 | AI / LLM for SE; Cloud / Microservices / Distributed Systems |
| Fine-Grained In-Context Permission Classification for Android Apps Using Control-Flow Graph Embedding. Vikas Kumar Malviya, Yan Naing Tun, Chee Wei Leow, Ailys Tee Xynyn, Lwin Khin Shar | ASE | 2023 | AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android |
| Fault Localization for Buggy Deep Learning Framework Conversions in Image Recognition. Nikolaos Louloudakis, Perry Gibson, José Cano 0001, Ajitha Rajan | ASE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Expediting Neural Network Verification via Network Reduction. Yuyi Zhong, Ruiwei Wang, Siau-Cheng Khoo | ASE | 2023 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Dynamic Graph Neural Networks-Based Alert Link Prediction for Online Service Systems. Yiru Chen, Chenxi Zhang 0003, Zhen Dong, Dingyu Yang, Xin Peng 0001 | ASE | 2023 | AI / LLM for SE |
| CertPri: Certifiable Prioritization for Deep Neural Networks via Movement Cost in Feature Space. Haibin Zheng, Jinyin Chen, Haibo Jin | ASE | 2023 | AI / LLM for SE; Performance / Energy / Reliability |
| Causality-Aided Trade-Off Analysis for Machine Learning Fairness. Zhenlan Ji, Pingchuan Ma 0004, Shuai Wang 0011, Yanhui Li | ASE | 2023 | AI / LLM for SE |
| Bridging the Gap Between Academia and Industry in Machine Learning Software Defect Prediction: Thirteen Considerations. Szymon Stradowski, Lech Madeyski | ASE | 2023 | AI / LLM for SE |
| Better Patching Using LLM Prompting, via Self-Consistency. Toufique Ahmed, Premkumar T. Devanbu | ASE | 2023 | AI / LLM for SE |
| Are We Ready to Embrace Generative AI for Software Q&A? Bowen Xu, Thanh-Dat Nguyen, Thanh Le-Cong, Thong Hoang, Jiakun Liu | ASE | 2023 | AI / LLM for SE |
| An Energy-Aware Approach to Design Self-Adaptive AI-based Applications on the Edge. Alessandro Tundo, Marco Mobilio, Shashikant Ilager, Ivona Brandic, Ezio Bartocci | ASE | 2023 | AI / LLM for SE; Requirements / Modeling / Architecture; Performance / Energy / Reliability |
| A Majority Invariant Approach to Patch Robustness Certification for Deep Learning Models. Qilin Zhou, Zhengyuan Wei, Haipeng Wang 0005, W. K. Chan 0001 | ASE | 2023 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods |
| A Comparative Study of Transformer-Based Neural Text Representation Techniques on Bug Triaging. Atish Kumar Dipongkor, Kevin Moran | ASE | 2023 | AI / LLM for SE; Human / Empirical / Socio-technical |
| A Closer Look at Different Difficulty Levels Code Generation Abilities of ChatGPT. Dapeng Yan, Zhipeng Gao 0002, Zhiming Liu 0001 | ASE | 2023 | AI / LLM for SE |
| ε-weakened robustness of deep neural networks. Pei Huang 0002, Yuting Yang 0002, Minghao Liu 0001, Fuqi Jia, Feifei Ma | ISSTA | 2022 | AI / LLM for SE |
| jTrans: jump-aware transformer for binary code similarity detection. Hao Wang 0226, Wenjie Qu 0001, Gilad Katz, Wenyu Zhu, Zeyu Gao | ISSTA | 2022 | AI / LLM for SE |
| The raise of machine learning hyperparameter constraints in Python code. Ingkarat Rak-amnouykit, Ana L. Milanova, Guillaume Baudart, Martin Hirzel, Julian Dolby | ISSTA | 2022 | AI / LLM for SE |
| Simple techniques work surprisingly well for neural network test prioritization and active learning (replicability study). Michael Weiss 0004, Paolo Tonella | ISSTA | 2022 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release |
| Path-sensitive code embedding via contrastive learning for software vulnerability detection. Xiao Cheng 0002, Guanqin Zhang, Haoyu Wang 0001, Yulei Sui | ISSTA | 2022 | AI / LLM for SE |
| HybridRepair: towards annotation-efficient repair for deep learning models. Yu Li 0007, Muxi Chen, Qiang Xu 0001 | ISSTA | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| DocTer: documentation-guided fuzzing for testing deep learning API functions. Danning Xie, Yitong Li, Mijung Kim, Hung Viet Pham, Lin Tan 0001 | ISSTA | 2022 | Testing / QA; AI / LLM for SE |
| BET: black-box efficient testing for convolutional neural networks. Jialai Wang, Han Qiu 0001, Yi Rong, Hengkai Ye, Qi Li 0002 | ISSTA | 2022 | Testing / QA; AI / LLM for SE |
| ASRTest: automated testing for deep-neural-network-driven speech recognition systems. Pin Ji, Yang Feng 0003, Jia Liu 0008, Zhihong Zhao, Zhenyu Chen 0001 | ISSTA | 2022 | Testing / QA; AI / LLM for SE |
| Using Deep Learning to Generate Complete Log Statements. Antonio Mastropaolo, Luca Pascarella, Gabriele Bavota | ICSE | 2022 | AI / LLM for SE |
| Unleashing the Power of Compiler Intermediate Representation to Enhance Neural Program Embeddings. Zongjie Li, Pingchuan Ma 0004, Huaijin Wang 0001, Shuai Wang 0011, Qiyi Tang 0003 | ICSE | 2022 | AI / LLM for SE |
| Type4Py: Practical Deep Similarity Learning-Based Type Inference for Python. Amir M. Mir, Evaldas Latoskinas, Sebastian Proksch 0001, Georgios Gousios | ICSE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Training Data Debugging for the Fairness of Machine Learning Software. Yanhui Li, Linghan Meng, Lin Chen 0015, Li Yu 0008, Di Wu 0014 | ICSE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Towards Training Reproducible Deep Learning Models. Boyuan Chen 0002, Mingzhi Wen, Yong Shi 0010, Dayi Lin, Gopi Krishnan Rajbahadur | ICSE | 2022 | AI / LLM for SE |
| TOGA: A Neural Method for Test Oracle Generation. Elizabeth Dinella, Gabriel Ryan, Todd Mytkowicz, Shuvendu K. Lahiri | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| Static Inference Meets Deep learning: A Hybrid Type Inference Approach for Python. Yun Peng 0003, Cuiyun Gao 0001, Zongjie Li, Bowei Gao, David Lo 0001 | ICSE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Semantic Image Fuzzing of AI Perception Systems. Trey Woodlief, Sebastian G. Elbaum, Kevin Sullivan | ICSE | 2022 | Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical |
| SAPIENTML: Synthesizing Machine Learning Pipelines by Learning from Human-Written Solutions. Ripon K. Saha, Akira Ura, Sonal Mahajan, Chenguang Zhu 0002, Linyi Li 0001 | ICSE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| REFTY: Refinement Types for Valid Deep Learning Models. Yanjie Gao, Zhengxian Li, Haoxiang Lin, Hongyu Zhang 0002, Ming Wu 0007 | ICSE | 2022 | AI / LLM for SE |
| PROMAL: Precise Window Transition Graphs for Android via Synergy of Program Analysis and Machine Learning. Changlin Liu, Hanlin Wang, Tianming Liu 0002, Diandian Gu, Yun Ma 0002 | ICSE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Mobile / Web / GUI / Android |
| On the Importance of Building High-quality Training Datasets for Neural Code Search. Zhensu Sun, Li Li 0091, Yan Liu, Xiaoning Du 0001, Li Li 0029 | ICSE | 2022 | AI / LLM for SE; DevOps / CI / Build / Release |
| On the Evaluation of Neural Code Summarization. Ensheng Shi, Yanlin Wang 0001, Lun Du, Junjie Chen 0003, Shi Han | ICSE | 2022 | AI / LLM for SE |
| Neural Program Repair with Execution-based Backpropagation. He Ye, Matias Martinez, Martin Monperrus | ICSE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Muffin: Testing Deep Learning Libraries via Neural Architecture Fuzzing. Jiazhen Gu, Xuchuan Luo, Yangfan Zhou 0002, Xin Wang 0002 | ICSE | 2022 | Testing / QA; AI / LLM for SE; Requirements / Modeling / Architecture |
| MVD: Memory-Related Vulnerability Detection Based on Flow-Sensitive Graph Neural Networks. Sicong Cao, Xiaobing Sun 0001, Lili Bo, Rongxin Wu, Bin Li 0006 | ICSE | 2022 | AI / LLM for SE |
| Log-based Anomaly Detection with Deep Learning: How Far Are We? Van-Hoang Le, Hongyu Zhang 0002 | ICSE | 2022 | AI / LLM for SE; Cloud / Microservices / Distributed Systems |
| Green AI: Do Deep Learning Frameworks Have Different Costs? Stefanos Georgiou, Maria Kechagia, Tushar Sharma 0001, Federica Sarro, Ying Zou 0001 | ICSE | 2022 | AI / LLM for SE |
| Fairneuron: Improving Deep Neural Network Fairness with Adversary Games on Selective Neurons. Xuanqi Gao, Juan Zhai, Shiqing Ma, Chao Shen 0001, Yufei Chen 0001 | ICSE | 2022 | AI / LLM for SE |
| Fairness-aware Configuration of Machine Learning Libraries. Saeid Tizpaz-Niari, Ashish Kumar, Gang Tan, Ashutosh Trivedi 0001 | ICSE | 2022 | AI / LLM for SE; DevOps / CI / Build / Release |
| ExAIS: Executable AI Semantics. Richard Schumi, Jun Sun 0001 | ICSE | 2022 | AI / LLM for SE |
| Evaluating and Improving Neural Program-Smoothing-based Fuzzing. Mingyuan Wu, Ling Jiang, Jiahong Xiang, Yuqun Zhang, Guowei Yang 0001 | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| EREBA: Black-box Energy Testing of Adaptive Neural Networks. Mirazul Haque, Yaswanth Yadlapalli, Wei Yang 0013, Cong Liu 0005 | ICSE | 2022 | Testing / QA; AI / LLM for SE; Performance / Energy / Reliability |
| EAGLE: Creating Equivalent Graphs to Test Deep Learning Libraries. Jiannan Wang 0002, Thibaud Lutellier, Shangshu Qian, Hung Viet Pham, Lin Tan 0001 | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| DeepTraLog: Trace-Log Combined Microservice Anomaly Detection through Graph-based Deep Learning. Chenxi Zhang 0003, Xin Peng 0001, Chaofeng Sha, Ke Zhang, Zhenqing Fu | ICSE | 2022 | AI / LLM for SE; Cloud / Microservices / Distributed Systems |
| DeepState: Selecting Test Suites to Enhance the Robustness of Recurrent Neural Networks. Zixi Liu, Yang Feng 0003, Yining Yin, Zhenyu Chen 0001 | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| DeepStability: A Study of Unstable Numerical Methods and Their Solutions in Deep Learning. Eliska Kloberdanz, Kyle G. Kloberdanz, Wei Le | ICSE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| DeepFD: Automated Fault Diagnosis and Localization for Deep Learning Programs. Jialun Cao, Meiziniu Li, Xiao Chen 0026, Ming Wen 0001, Yongqiang Tian 0001 | ICSE | 2022 | AI / LLM for SE |
| DeepDiagnosis: Automatically Diagnosing Faults and Recommending Actionable Fixes in Deep Learning Programs. Mohammad Wardat, Breno Dantas Cruz, Wei Le, Hridesh Rajan | ICSE | 2022 | AI / LLM for SE |
| Decomposing Convolutional Neural Networks into Reusable and Replaceable Modules. Rangeet Pan, Hridesh Rajan | ICSE | 2022 | AI / LLM for SE |
| DEAR: A Novel Deep Learning-based Approach for Automated Program Repair. Yi Li 0048, Shaohua Wang 0002, Tien N. Nguyen | ICSE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Causality-Based Neural Network Repair. Bing Sun, Jun Sun 0001, Long H. Pham, Tie Shi | ICSE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Automated Testing of Software that Uses Machine Learning APIs. Chengcheng Wan 0001, Shicheng Liu, Sophie Xie, Yifan Liu, Henry Hoffmann | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| Automated Assertion Generation via Information Retrieval and Its Integration with Deep learning. Hao Yu 0016, Yiling Lou, Ke Sun 0017, Dezhi Ran, Tao Xie 0001 | ICSE | 2022 | Testing / QA; AI / LLM for SE |
| An Exploratory Study of Deep learning Supply Chain. Xin Tan 0003, Kai Gao 0008, Minghui Zhou 0001, Li Zhang 0029 | ICSE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Adaptive Test Selection for Deep Neural Networks. Xinyu Gao, Yang Feng 0003, Yining Yin, Zixi Liu, Zhenyu Chen 0001 | ICSE | 2022 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| You see what I want you to see: poisoning vulnerabilities in neural code search. Yao Wan 0001, Shijie Zhang, Hongyu Zhang 0002, Yulei Sui, Guandong Xu | FSE | 2022 | AI / LLM for SE |
| Using graph neural networks for program termination. Yoav Alon, Cristina David | FSE | 2022 | AI / LLM for SE |
| Understanding performance problems in deep learning systems. Junming Cao, Bihuan Chen 0001, Chao Sun, Longjie Hu, Shuaihong Wu | FSE | 2022 | AI / LLM for SE; Performance / Energy / Reliability |
| Testing of machine learning models with limited samples: an industrial vacuum pumping application. Ayan Chatterjee, Bestoun S. Ahmed, Erik Hallin, Anton Engman | FSE | 2022 | Testing / QA; AI / LLM for SE |
| Semi-supervised pre-processing for learning-based traceability framework on real-world software projects. Liming Dong 0001, He Zhang 0001, Wei Liu, Zhiluo Weng, Hongyu Kuang | FSE | 2022 | AI / LLM for SE; Requirements / Modeling / Architecture |
| RULER: discriminative and iterative adversarial training for deep neural network fairness. Guanhong Tao 0001, Weisong Sun, Tingxu Han, Chunrong Fang, Xiangyu Zhang 0001 | FSE | 2022 | AI / LLM for SE |
| Program merge conflict resolution via neural transformers. Alexey Svyatkovskiy, Sarah Fakhoury, Negar Ghorbani, Todd Mytkowicz, Elizabeth Dinella | FSE | 2022 | AI / LLM for SE |
| On-the-fly syntax highlighting using neural networks. Marco Edoardo Palma, Pasquale Salza, Harald C. Gall | FSE | 2022 | AI / LLM for SE |
| Neural termination analysis. Mirco Giacobbe, Daniel Kroening, Julian Parsert | FSE | 2022 | AI / LLM for SE |
| NeuDep: neural binary memory dependence analysis. Kexin Pei, Dongdong She, Michael Wang, Scott Geng, Zhou Xuan | FSE | 2022 | AI / LLM for SE |
| NatGen: generative pre-training by "naturalizing" source code. Saikat Chakraborty 0001, Toufique Ahmed, Yangruibo Ding, Premkumar T. Devanbu, Baishakhi Ray | FSE | 2022 | AI / LLM for SE |
| NMTSloth: understanding and testing efficiency degradation of neural machine translation systems. Simin Chen, Cong Liu 0005, Mirazul Haque, Zihe Song, Wei Yang 0013 | FSE | 2022 | Testing / QA; AI / LLM for SE; Performance / Energy / Reliability |
| MpBP: verifying robustness of neural networks with multi-path bound propagation. Ye Zheng, Jiaxiang Liu 0001, Xiaomu Shi | FSE | 2022 | AI / LLM for SE |
| Machine learning and natural language processing for automating software testing (tutorial). Mauro Pezzè | FSE | 2022 | Testing / QA; AI / LLM for SE |
| MAAT: a novel ensemble approach to addressing fairness and performance bugs for machine learning software. Zhenpeng Chen, Jie M. Zhang, Federica Sarro, Mark Harman | FSE | 2022 | AI / LLM for SE; Performance / Energy / Reliability |
| Generating realistic vulnerabilities via neural code editing: an empirical study. Yu Nong, Yuzhe Ou, Michael Pradel, Feng Chen 0001, Haipeng Cai | FSE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Effective and scalable fault injection using bug reports and generative language models. Ahmed Khanfir | FSE | 2022 | AI / LLM for SE |
| Discrepancies among pre-trained deep neural networks: a new threat to model zoo reliability. Diego Montes, Pongpatapee Peerapatanapokin, Jeff Schultz, Chengjun Guo, Wenxin Jiang 0001 | FSE | 2022 | AI / LLM for SE; Performance / Energy / Reliability |
| DeepDev-PERF: a deep learning-based approach for improving software performance. Spandan Garg, Roshanak Zilouchian Moghaddam, Colin B. Clement, Neel Sundaresan, Chen Wu | FSE | 2022 | AI / LLM for SE; Performance / Energy / Reliability |
| AutoPruner: transformer-based call graph pruning. Thanh Le-Cong, Hong Jin Kang, Truong Giang Nguyen, Stefanus Agus Haryono, David Lo 0001 | FSE | 2022 | AI / LLM for SE |
| An empirical study of deep transfer learning-based program repair for Kotlin projects. Misoo Kim, Youngkyoung Kim, Hohyeon Jeong, Jinseok Heo, Sungoh Kim | FSE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical |
| API recommendation for machine learning libraries: how far are we? Moshi Wei, Yuchao Huang, Junjie Wang 0001, Jiho Shin, Nima Shiri Harzevili | FSE | 2022 | AI / LLM for SE |
| AI-assisted programming: applications, user experiences, and neuro-symbolic techniques (keynote). Sumit Gulwani | FSE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| 23 shades of self-admitted technical debt: an empirical study on machine learning software. David O'Brien, Sumon Biswas, Sayem Imtiaz, Rabe Abdalkareem, Emad Shihab | FSE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review |
| Towards Understanding the Faults of JavaScript-Based Deep Learning Systems. Lili Quan, Qianyu Guo, Xiaofei Xie, Sen Chen 0001, Xiaohong Li 0001 | ASE | 2022 | AI / LLM for SE |
| Toward Improving the Robustness of Deep Learning Models via Model Transformation. Yingyi Zhang, Zan Wang, Jiajun Jiang, Hanmo You, Junjie Chen 0003 | ASE | 2022 | AI / LLM for SE |
| Test-Driven Multi-Task Learning with Functionally Equivalent Code Transformation for Neural Code Generation. Xin Wang 0114, Xiao Liu 0004, Pingyi Zhou, Qixia Liu, Jin Liu 0016 | ASE | 2022 | Testing / QA; AI / LLM for SE |
| StandUp4NPR: Standardizing SetUp for Empirically Comparing Neural Program Repair Systems. Wenkang Zhong, Hongliang Ge, Hongfei Ai, Chuanyi Li, Kui Liu 0001 | ASE | 2022 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| SmOOD: Smoothness-based Out-of-Distribution Detection Approach for Surrogate Neural Networks in Aircraft Design. Houssem Ben Braiek, Ali Tfaily, Foutse Khomh, Thomas Reid, Ciro Guida | ASE | 2022 | AI / LLM for SE; Requirements / Modeling / Architecture |
| Safety and Performance, Why not Both? Bi-Objective Optimized Model Compression toward AI Software Deployment. Jie Zhu, Leye Wang, Xiao Han 0001 | ASE | 2022 | AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability |
| Reentrancy Vulnerability Detection and Localization: A Deep Learning Based Two-phase Approach. Zhuo Zhang 0007, Yan Lei, Meng Yan 0001, Yue Yu 0001, Jiachi Chen | ASE | 2022 | AI / LLM for SE |
| Rank Learning-Based Code Readability Assessment with Siamese Neural Networks. Qing Mi | ASE | 2022 | AI / LLM for SE; Education / Program Comprehension |
| QVIP: An ILP-based Formal Verification Approach for Quantized Neural Networks. Yedi Zhang, Zhe Zhao 0007, Guangke Chen, Fu Song, Min Zhang 0002 | ASE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Provably Tightest Linear Approximation for Robustness Verification of Sigmoid-like Neural Networks. Zhaodi Zhang, Yiting Wu, Si Liu 0003, Jing Liu 0012, Min Zhang 0002 | ASE | 2022 | Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Prototyping Deep Learning Applications with Non-Experts: An Assistant Proposition. Gustavo Rodrigues dos Reis, Adrian Mos, Mario Cortes Cornax, Cyril Labbé | ASE | 2022 | AI / LLM for SE |
| Prompt-tuned Code Language Model as a Neural Knowledge Base for Type Inference in Statically-Typed Partial Code. Qing Huang, Zhiqiang Yuan, Zhenchang Xing, Xiwei Xu 0001, Liming Zhu 0001 | ASE | 2022 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| Patching Weak Convolutional Neural Network Models through Modularization and Composition. Binhang Qi, Hailong Sun 0001, Xiang Gao 0012, Hongyu Zhang 0002 | ASE | 2022 | AI / LLM for SE |
| DeepPerform: An Efficient Approach for Performance Testing of Resource-Constrained Neural Networks. Simin Chen, Mirazul Haque, Cong Liu 0005, Wei Yang 0013 | ASE | 2022 | Testing / QA; AI / LLM for SE; Performance / Energy / Reliability |
| CARGO: AI-Guided Dependency Analysis for Migrating Monolithic Applications to Microservices Architecture. Vikram Nitin, Shubhi Asthana, Baishakhi Ray, Rahul Krishna | ASE | 2022 | AI / LLM for SE; Requirements / Modeling / Architecture |
| Boosting the Revealing of Detected Violations in Deep Learning Testing: A Diversity-Guided Method. Xiaoyuan Xie, Pengbo Yin, Songqiang Chen | ASE | 2022 | Testing / QA; AI / LLM for SE |
| B-AIS: An Automated Process for Black-box Evaluation of Visual Perception in AI-enabled Software against Domain Semantics. Hamed Barzamini, Mona Rahimi | ASE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Automatically Tagging the "AAA" Pattern in Unit Test Cases Using Machine Learning Models. Chenhao Wei, Lu Xiao 0001, Tingting Yu 0001, Xinyu Chen, Xiao Wang 0030 | ASE | 2022 | Testing / QA; AI / LLM for SE |
| Automatic Generation of Visualizations for Machine Learning Pipelines. Lei Liu 0061, Wei-Peng Chen, Mehdi Bahrami, Mukul R. Prasad | ASE | 2022 | AI / LLM for SE |
| Automatic Code Documentation Generation Using GPT-3. Junaed Younus Khan, Gias Uddin 0001 | ASE | 2022 | AI / LLM for SE |
| Are Neural Bug Detectors Comparable to Software Developers on Variable Misuse Bugs? Cedric Richter, Jan Haltermann, Marie-Christine Jakobs, Felix Pauck, Stefan Schott | ASE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Answering Software Deployment Questions via Neural Machine Reading at Scale. Guanjie Qiu, Diwei Chen, Shuai Zhang, Yitian Chai, Xiaodong Gu 0002 | ASE | 2022 | AI / LLM for SE; DevOps / CI / Build / Release |
| An Empirical Study on Numerical Bugs in Deep Learning Programs. Gan Wang, Zan Wang, Junjie Chen 0003, Xiang Chen 0005, Ming Yan 0010 | ASE | 2022 | AI / LLM for SE; Human / Empirical / Socio-technical |
| A transformer-based IDE plugin for vulnerability detection. Cláudia Mamede, Eduard Pinconschi, Rui Abreu 0001 | ASE | 2022 | AI / LLM for SE |
| A Transferable Time Series Forecasting Service Using Deep Transformer Model for Online Systems. Tao Huang 0021, Pengfei Chen 0002, Jingrun Zhang, Ruipeng Li, Rui Wang | ASE | 2022 | AI / LLM for SE |
| A Review of AI-augmented End-to-End Test Automation Tools. Phuoc Pham, Vu Nguyen 0003, Tien N. Nguyen | ASE | 2022 | Testing / QA; AI / LLM for SE |
| TauMed: test augmentation of deep learning in medical diagnosis. Yunhan Hou, Jiawei Liu, Daiwei Wang, Jiawei He, Chunrong Fang | ISSTA | 2021 | Testing / QA; AI / LLM for SE |
| TERA: optimizing stochastic regression tests in machine learning projects. Saikat Dutta 0001, Jeeva Selvam, Aryaman Jain, Sasa Misailovic | ISSTA | 2021 | Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release |
| Predoo: precision testing of deep learning operators. Xufan Zhang, Ning Sun, Chunrong Fang, Jiawei Liu, Jia Liu 0015 | ISSTA | 2021 | Testing / QA; AI / LLM for SE |
| Exposing previously undetectable faults in deep neural networks. Isaac Dunn, Hadrien Pouget, Daniel Kroening, Tom Melham | ISSTA | 2021 | AI / LLM for SE |
| DialTest: automated testing for recurrent-neural-network-driven dialogue systems. Zixi Liu, Yang Feng 0003, Zhenyu Chen 0001 | ISSTA | 2021 | Testing / QA; AI / LLM for SE |
| DeepHyperion: exploring the feature space of deep learning-based systems through illumination search. Tahereh Zohdinasab, Vincenzo Riccio, Alessio Gambi, Paolo Tonella | ISSTA | 2021 | AI / LLM for SE |
| DeepCrime: mutation testing of deep learning systems based on real faults. Nargiz Humbatova, Gunel Jahangirova, Paolo Tonella | ISSTA | 2021 | Testing / QA; AI / LLM for SE |
| AdvDoor: adversarial backdoor attack of deep learning system. Quan Zhang 0003, Yifeng Ding, Yongqiang Tian 0001, Jianmin Guo, Min Yuan | ISSTA | 2021 | AI / LLM for SE; Security / Privacy / Vulnerability |
| White-Box Analysis over Machine Learning: Modeling Performance of Configurable Systems. Miguel Velez, Pooyan Jamshidi, Norbert Siegmund, Sven Apel, Christian Kästner | ICSE | 2021 | AI / LLM for SE; Requirements / Modeling / Architecture; Performance / Energy / Reliability |
| Studying the Usage of Text-To-Text Transfer Transformer to Support Code-Related Tasks. Antonio Mastropaolo, Simone Scalabrino, Nathan Cooper, David Nader-Palacio, Denys Poshyvanyk | ICSE | 2021 | AI / LLM for SE |
| Self-Checking Deep Neural Networks in Deployment. Yan Xiao 0002, Ivan Beschastnikh, David S. Rosenblum, Changsheng Sun, Sebastian G. Elbaum | ICSE | 2021 | AI / LLM for SE; DevOps / CI / Build / Release |
| Scalable Quantitative Verification For Deep Neural Networks. Teodora Baluta, Zheng Leong Chua, Kuldeep S. Meel, Prateek Saxena | ICSE | 2021 | AI / LLM for SE; Program Analysis / Verification / Formal Methods |
| RobOT: Robustness-Oriented Testing for Deep Learning Systems. Jingyi Wang 0004, Jialuo Chen, Youcheng Sun, Xingjun Ma, Dongxia Wang 0002 | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| Resource-Guided Configuration Space Reduction for Deep Learning Models. Yanjie Gao, Yonghao Zhu, Hongyu Zhang 0002, Haoxiang Lin, Mao Yang 0004 | ICSE | 2021 | AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability |
| Prioritizing Test Inputs for Deep Neural Networks via Mutation Analysis. Zan Wang, Hanmo You, Junjie Chen 0003, Yingyi Zhang, Xuyuan Dong | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| Measuring Discrimination to Boost Comparative Testing for Multiple Deep Learning Models. Linghan Meng, Yanhui Li, Lin Chen 0015, Zhi Wang, Di Wu 0014 | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| Graph-based Fuzz Testing for Deep Learning Inference Engines. Weisi Luo, Dong Chai, Xiaoyue Run, Jiang Wang, Chunrong Fang | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| GUIGAN: Learning to Generate GUI Designs Using Generative Adversarial Networks. Tianming Zhao 0005, Chunyang Chen 0001, Yuanning Liu, Xiaodong Zhu 0001 | ICSE | 2021 | AI / LLM for SE; Mobile / Web / GUI / Android |
| Distribution-Aware Testing of Neural Networks Using Generative Models. Swaroopa Dola, Matthew B. Dwyer, Mary Lou Soffa | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| DeepPayload: Black-box Backdoor Attack on Deep Learning Models through Neural Payload Injection. Yuanchun Li 0003, Jiayi Hua, Haoyu Wang 0001, Chunyang Chen 0001, Yunxin Liu 0001 | ICSE | 2021 | AI / LLM for SE; Security / Privacy / Vulnerability |
| DeepLocalize: Fault Localization for Deep Neural Networks. Mohammad Wardat, Wei Le, Hridesh Rajan | ICSE | 2021 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| DeepLV: Suggesting Log Levels Using Ordinal Based Neural Networks. Zhenhao Li 0002, Heng Li 0007, Tse-Hsun Peter Chen, Weiyi Shang | ICSE | 2021 | AI / LLM for SE |
| CURE: Code-Aware Neural Machine Translation for Automatic Program Repair. Nan Jiang 0012, Thibaud Lutellier, Lin Tan 0001 | ICSE | 2021 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Automatic Unit Test Generation for Machine Learning Libraries: How Far Are We? Song Wang 0009, Nishtha Shrestha, Abarna Kucheri Subburaman, Junjie Wang 0001, Moshi Wei | ICSE | 2021 | Testing / QA; AI / LLM for SE |
| Are Machine Learning Cloud APIs Used Correctly? Chengcheng Wan 0001, Shicheng Liu, Henry Hoffmann, Michael Maire, Shan Lu 0001 | ICSE | 2021 | AI / LLM for SE; Cloud / Microservices / Distributed Systems |
| An Empirical Study on Deployment Faults of Deep Learning Based Mobile Applications. Zhenpeng Chen, Huihan Yao, Yiling Lou, Yanbin Cao, Yuanqiang Liu | ICSE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Mobile / Web / GUI / Android |
| An Empirical Study of Refactorings and Technical Debt in Machine Learning Systems. Yiming Tang 0002, Raffi Khatchadourian, Mehdi Bagherzadeh 0001, Rhia Singh, Ajani Stewart | ICSE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review |
| Understanding neural code intelligence through program simplification. Md. Rafiqul Islam Rabin, Vincent J. Hellendoorn, Mohammad Amin Alipour | FSE | 2021 | AI / LLM for SE |
| StateFormer: fine-grained type recovery from binaries using generative state modeling. Kexin Pei, Jonas Guan, Matthew Broughton, Zhongtian Chen, Songchen Yao | FSE | 2021 | AI / LLM for SE; Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture |
| Semantic bug seeding: a learning-based approach for creating realistic bugs. Jibesh Patra, Michael Pradel | FSE | 2021 | AI / LLM for SE |
| Multi-location cryptographic code repair with neural-network-based methodologies. Ya Xiao 0002 | FSE | 2021 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability |
| Learning-based extraction of first-order logic representations of API directives. Mingwei Liu 0002, Xin Peng 0001, Andrian Marcus, Christoph Treude, Xuefang Bai | FSE | 2021 | AI / LLM for SE |
| Freeing hybrid distributed AI training configuration. Haoran Wang | FSE | 2021 | AI / LLM for SE; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems |
| Fair preprocessing: towards understanding compositional fairness of data transformers in machine learning pipeline. Sumon Biswas, Hridesh Rajan | FSE | 2021 | AI / LLM for SE; DevOps / CI / Build / Release |
| FLEX: fixing flaky tests in machine learning projects by updating assertion bounds. Saikat Dutta 0001, August Shi, Sasa Misailovic | FSE | 2021 | Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| Exposing numerical bugs in deep learning via gradient back-propagation. Ming Yan 0010, Junjie Chen 0003, Xiangyu Zhang 0001, Lin Tan 0001, Gan Wang | FSE | 2021 | AI / LLM for SE |
| Explaining mispredictions of machine learning models using rule induction. Jürgen Cito, Isil Dillig, Seohyun Kim 0001, Vijayaraghavan Murali, Satish Chandra 0001 | FSE | 2021 | AI / LLM for SE |
| Embedding app-library graph for neural third party library recommendation. Bo Li 0103, Qiang He 0001, Feifei Chen 0001, Xin Xia 0001, Li Li 0029 | FSE | 2021 | AI / LLM for SE; Mobile / Web / GUI / Android |
| Documenting evidence of a reuse of 'on the number of linear regions of deep neural networks'. Rahul Yedida, Tim Menzies | FSE | 2021 | AI / LLM for SE |
| Documenting evidence of a reuse of 'a systematic study of the class imbalance problem in convolutional neural networks'. Rahul Yedida, Tim Menzies | FSE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Code integrity attestation for PLCs using black box neural network predictions. Yuqi Chen 0001, Christopher M. Poskitt, Jun Sun 0001 | FSE | 2021 | Testing / QA; AI / LLM for SE |
| Bias in machine learning software: why? how? what to do? Joymallya Chakraborty, Suvodeep Majumder, Tim Menzies | FSE | 2021 | AI / LLM for SE |
| A syntax-guided edit decoder for neural program repair. Qihao Zhu, Zeyu Sun 0004, Yuan-an Xiao, Wenjie Zhang 0007, Kang Yuan | FSE | 2021 | AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair |
| A comprehensive study on learning-based PE malware family classification methods. Yixuan Ma, Shuang Liu 0007, Jiajun Jiang, Guanhong Chen, Keqiu Li | FSE | 2021 | AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical |
| A comprehensive study of deep learning compiler bugs. Qingchao Shen, Haoyang Ma, Junjie Chen 0003, Yongqiang Tian 0001, Shing-Chi Cheung | FSE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Towards the generation of machine learning defect reports. Tuan Dung Lai | ASE | 2021 | AI / LLM for SE |
| Towards Fluid Software Architectures: Bidirectional Human-AI Interaction. Ammar Yasser, Mervat Abu-Elkheir | ASE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Thinking Like a Developer? Comparing the Attention of Humans with Neural Models of Code. Matteo Paltenghi, Michael Pradel | ASE | 2021 | AI / LLM for SE; Human / Empirical / Socio-technical |
| Log Anomaly to Resolution: AI Based Proactive Incident Remediation. Ruchi Mahindru, Harshit Kumar, Sahil Bansal | ASE | 2021 | AI / LLM for SE |
| Learning-based Assistant for Data Migration of Enterprise Information Systems. Sayandeep Mitra, Debayan Mukherjee, Atreya Bandyopadhyay, Rajdip Chowdhury, Raveendra Kumar Medicherla | ASE | 2021 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| Explainable AI for Software Engineering. Chakkrit Kla Tantithamthavorn, Jirayus Jiarpakdee | ASE | 2021 | AI / LLM for SE |
| DeepMetis: Augmenting a Deep Learning Test Set to Increase its Mutation Score. Vincenzo Riccio, Nargiz Humbatova, Gunel Jahangirova, Paolo Tonella | ASE | 2021 | Testing / QA; AI / LLM for SE |
| DeepMemory: Model-based Memorization Analysis of Deep Neural Language Models. Derui Zhu, Jinfu Chen 0002, Weiyi Shang, Xuebing Zhou, Jens Grossklags | ASE | 2021 | AI / LLM for SE |
| Deep GUI: Black-box GUI Input Generation with Deep Learning. Faraz Yazdani Banafshe Daragh, Sam Malek | ASE | 2021 | AI / LLM for SE; Mobile / Web / GUI / Android |
| DEVIATE: A Deep Learning Variance Testing Framework. Hung Viet Pham, Mijung Kim, Lin Tan 0001, Yaoliang Yu, Nachiappan Nagappan | ASE | 2021 | Testing / QA; AI / LLM for SE |
| Can Neural Clone Detection Generalize to Unseen Functionalitiesƒ. Chenyao Liu, Zeqi Lin, Jian-Guang Lou, Lijie Wen 0001, Dongmei Zhang 0001 | ASE | 2021 | AI / LLM for SE; Maintenance / Evolution / Refactoring / Review |
| AST-Transformer: Encoding Abstract Syntax Trees Efficiently for Code Summarization. Ze Tang 0002, Chuanyi Li, Jidong Ge, Xiaoyu Shen 0001, Zheling Zhu | ASE | 2021 | AI / LLM for SE |
| A First Look at the Effect of Deep Learning in Coverage-guided Fuzzing. Siqi Li, Yun Lin 0001, Xiaofei Xie, Yuekang Li, Xiaohong Li 0001 | ASE | 2021 | Testing / QA; AI / LLM for SE |