Software Engineering Empirical Research Radar

AI / LLM for SE Papers

Papers tagged as AI / LLM for SE.

PaperVenueYearTopics
LLM Agents Can See Code Repositories
Dongjian Ma, Silin Chen, Yufei Yang, Yulin Shi, Yanfu Yan
arXiv2026Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Program Comprehension
ARISE: A Repository-level Graph Representation and Toolset for Agentic Fault Localization and Program Repair
Shahd Seddik, Fatemeh Fard
arXiv2026Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods; AI / LLM for SE
Measure Twice, Locate Once: Mitigating Hallucinations in LLM-based Agents for Repository-Scale Fault Localization
Feiyue Chen, Guowei Yang, Cheryl Lee, Zhanming Jie, Yuqi Chen
TOSEM2026Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Software Agents
Assessing the Impact of Code Changes on the Fault Localizability of Large Language Models
Sabaat Haroon, Ahmand Faraz Khan, Ahmad Humayun, Waris Gill, Abdul Haddi Amjad
ICST2026Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Testing / QA
Finding the Needle in the Crash Stack: Industrial-Scale Crash Root Cause Localization with AutoCrashFL
Sungmin Kang, Sumi Yun, Jingun Hong, Shin Yoo, Gabin An
ICSE-SEIP2026Debugging / Fault Localization / Diagnosis / Repair; AI / LLM for SE; Industrial Software Engineering
You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects.
Islem Bouzenia; Michael Pradel
ISSTA2025Testing / QA; AI / LLM for SE
Top Score on the Wrong Exam: On Benchmarking in Machine Learning for Vulnerability Detection.
Niklas Risse; Jing Liu; Marcel Böhme
ISSTA2025AI / LLM for SE
Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection.
Lei Yu; Zhirong Huang; Hang Yuan; Shiqi Cheng; Li Yang 0015; Fengjun Zhang; Chenjie Shen; Jiajia Ma; Jingyuan Zhang; Junyi Lu; Chun Zuo
ISSTA2025AI / LLM for SE; Security / Privacy / Vulnerability
SWE-GPT: A Process-Centric Language Model for Automated Software Improvement.
Yingwei Ma; Rongyu Cao; Yongchang Cao; Yue Zhang 0004; Jue Chen; Yibo Liu; Yuchen Liu; Binhua Li; Fei Huang 0002; Yongbin Li 0001
ISSTA2025AI / LLM for SE
Robust Vulnerability Detection across Compilations: LLVM-IR vs. Assembly with Transformer Model.
Rony Shir; Priyanka Prakash Surve; Yuval Elovici; Asaf Shabtai
ISSTA2025AI / LLM for SE; Performance / Energy / Reliability
Reinforcement Learning-Based Fuzz Testing for the Gazebo Robotic Simulator.
Zhilei Ren; Yitao Li; Xiaochen Li; Guanxiao Qi; Jifeng Xuan; He Jiang 0001
ISSTA2025Testing / QA; AI / LLM for SE
PatchScope: LLM-Enhanced Fine-Grained Stable Patch Classification for Linux Kernel.
Rongkai Liu; Heyuan Shi; Shuning Liu; Chao Hu; Sisheng Li; Yuheng Shen; Runzhe Wang; Xiaohai Shi; Yu Jiang 0001
ISSTA2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
OpDiffer: LLM-Assisted Opcode-Level Differential Testing of Ethereum Virtual Machine.
Jie Ma; Ningyu He; Jinwen Xi; Mingzhe Xing; Haoyu Wang 0001; Ying Gao 0006; Yinliang Yue
ISSTA2025Testing / QA; AI / LLM for SE
NADA: Neural Acceptance-Driven Approximate Specification Mining.
Weilin Luo; Tingchen Han; Junming Qiu; Hai Wan; Jianfeng Du; Bo Peng 0041; Guohui Xiao 0001; Yanan Liu
ISSTA2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation.
Ziyao Zhang 0004; Chong Wang 0013; Yanlin Wang 0001; Ensheng Shi; Yuchi Ma; Wanjun Zhong; Jiachi Chen; Mingzhi Mao; Zibin Zheng
ISSTA2025AI / LLM for SE
Improving Graph Learning-Based Fault Localization with Tailored Semi-supervised Learning.
Chun Li; Hui Li 0104; Zhong Li; Minxue Pan; Xuandong Li
ISSTA2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Improving Deep Learning Framework Testing with Model-Level Metamorphic Testing.
Yanzhou Mu; Juan Zhai; Chunrong Fang; Xiang Chen 0005; Zhixiang Cao; Peiran Yang; Kexin Zhao; An Guo 0002; Zhenyu Chen 0001
ISSTA2025Testing / QA; AI / LLM for SE
DecLLM: LLM-Augmented Recompilable Decompilation for Enabling Programmatic Use of Decompiled Code.
Wai Kin Wong; Daoyuan Wu; Huaijin Wang 0001; Zongjie Li; Zhibo Liu 0001; Shuai Wang 0011; Qiyi Tang 0003; Sen Nie; Shi Wu
ISSTA2025AI / LLM for SE
CrossProbe: LLM-Empowered Cross-Project Bug Detection for Deep Learning Frameworks.
Hao Guan 0001; Guangdong Bai; Yepang Liu 0001
ISSTA2025AI / LLM for SE
ConTested: Consistency-Aided Tested Code Generation with LLM.
Jinhao Dong; Jun Sun 0001; Wenjie Zhang 0007; Jin Song Dong 0001; Dan Hao 0001
ISSTA2025AI / LLM for SE
Causality-Aided Evaluation and Explanation of Large Language Model-Based Code Generation.
Zhenlan Ji; Pingchuan Ma 0004; Zongjie Li; Zhaoyu Wang 0006; Shuai Wang 0011
ISSTA2025AI / LLM for SE
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering.
Ruiqi Wang; Jiyu Guo; Cuiyun Gao 0001; Guodong Fan; Chun Yong Chong; Xin Xia 0001
ISSTA2025AI / LLM for SE; Human / Empirical / Socio-technical
Bridging the Gaps between Graph Neural Networks and Data-Flow Analysis: The Closer, the Better.
Qingchen Yu; Xin Liu 0050; Qingguo Zhou; Chunming Wu 0001
ISSTA2025AI / LLM for SE
Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar.
Yuanliang Zhang, Yifan Xie, Shanshan Li 0001, Ke Liu, Chong Wang
ICSE2025AI / LLM for SE
Trust Dynamics in AI-Assisted Development: Definitions, Factors, and Implications.
Sadra Sabouri, Philipp Eibl, Xinyi Zhou, Morteza Ziyadi, Nenad Medvidovic
ICSE2025AI / LLM for SE
Towards Neural Synthesis for SMT-Assisted Proof-Oriented Programming.
Saikat Chakraborty 0001, Gabriel Ebner, Siddharth Bhat, Sarah Fakhoury, Sakina Fatima
ICSE2025AI / LLM for SE
The Power of Types: Exploring the Impact of Type Checking on Neural Bug Detection in Dynamically Typed Languages.
Boqi Chen, José Antonio Hernández López, Gunter Mussbacher, Dániel Varró
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
The Fact Selection Problem in LLM-Based Program Repair.
Nikhil Parasaram, Huijie Yan, Boyu Yang, Zineb Flahy, Abriele Qudsi
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Testing and Understanding Deviation Behaviors in FHE-Hardened Machine Learning Models.
Yiteng Peng, Daoyuan Wu, Zhibo Liu, Dongwei Xiao, Zhenlan Ji
ICSE2025Testing / QA; AI / LLM for SE
Test Intention Guided LLM-Based Unit Test Generation.
Zifan Nan, Zhaoqiang Guo, Kui Liu 0001, Xin Xia 0001
ICSE2025Testing / QA; AI / LLM for SE
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents.
Feng Lin, Dong Jae Kim, Tse-Hsun Chen
ICSE2025AI / LLM for SE
Rug: Turbo Llm for Rust Unit Test Generation.
Xiang Cheng, Fan Sang, Yizhuo Zhai, Xiaokuan Zhang, Taesoo Kim
ICSE2025Testing / QA; AI / LLM for SE
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair.
Islem Bouzenia, Premkumar T. Devanbu, Michael Pradel
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Reasoning Runtime Behavior of a Program with LLM: How Far are We?
Junkai Chen, Zhiyuan Pan, Xing Hu 0008, Zhenhao Li 0002, Ge Li 0001
ICSE2025AI / LLM for SE
Prompt-to-SQL Injections in LLM-Integrated Web Applications: Risks and Defenses.
Rodrigo Pedro, Miguel E. Coimbra, Daniel Castro 0004, Paulo Carreira 0001, Nuno Santos 0001
ICSE2025AI / LLM for SE; Mobile / Web / GUI / Android
Planning a Large Language Model for Static Detection of Runtime Errors in Code Snippets.
Smit Patel, Aashish Yadavally, Hridya Dhulipala, Tien N. Nguyen
ICSE2025AI / LLM for SE
Patch Synthesis for Property Repair of Deep Neural Networks.
Zhiming Chi, Jianan Ma, Pengfei Yang 0002, Cheng-Chao Huang, Renjue Li
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Navigating the Testing of Evolving Deep Learning Systems: An Exploratory Interview Study.
Hanmo You, Zan Wang, Bin Lin 0008, Junjie Chen 0003
ICSE2025Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
NIODebugger: A Novel Approach to Repair Non-Idempotent-Outcome Tests with LLM-Based Agent.
Kaiyao Ke
ICSE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Mock Deep Testing: Toward Separate Development of Data and Models for Deep Learning.
Ruchira Manke, Mohammad Wardat, Foutse Khomh, Hridesh Rajan
ICSE2025Testing / QA; AI / LLM for SE
MARQ: Engineering Mission-Critical AI-Based Software with Automated Result Quality Adaptation.
Uwe Gropengießer, Elias Dietz, Florian Brandherm, Achref Doula, Osama Abboud
ICSE2025AI / LLM for SE
MAGIKA: AI-Powered Content-Type Detection.
Yanick Fratantonio, Luca Invernizzi, Loua Farah, Kurt Thomas, Marina Zhang
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Lightweight Concolic Testing via Path-Condition Synthesis for Deep Learning Libraries.
Sehoon Kim, Yonghyeon Kim, Dahyeon Park, Yuseok Jeon, Jooyong Yi
ICSE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
LWDIFF: an LLM-Assisted Differential Testing Framework for Webassembly Runtimes.
Shiyao Zhou, Jincheng Wang, He Ye, Hao Zhou 0043, Claire Le Goues
ICSE2025Testing / QA; AI / LLM for SE
LLMs Meet Library Evolution: Evaluating Deprecated API Usage in LLM-Based Code Completion.
Chong Wang 0013, Kaifeng Huang 0001, Jian Zhang 0087, Yebo Feng, Lyuye Zhang
ICSE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
LLM-Aided Automatic Modeling for Security Protocol Verification.
Ziyu Mao, Jingyi Wang 0004, Jun Sun 0001, Shengchao Qin, Jiawen Xiong
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture
LLM-Agents Driven Automated Simulation Testing and Analysis of small Uncrewed Aerial Systems.
Venkata Sai Aswath Duvvuru, Bohan Zhang, Michael Vierhauser, Ankit Agrawal 0002
ICSE2025Testing / QA; AI / LLM for SE
LLM Based Input Space Partitioning Testing for Library APIs.
Jiageng Li, Zhen Dong, Chong Wang, Haozhen You, Cen Zhang
ICSE2025Testing / QA; AI / LLM for SE
LLM Assistance for Memory Safety.
J. Nausheen Mohammed, Akash Lal, Aseem Rastogi, Rahul Sharma 0001, Subhajit Roy 0001
ICSE2025AI / LLM for SE
Improved Detection and Diagnosis of Faults in Deep Neural Networks Using Hierarchical and Explainable Classification.
Sigma Jahan, Mehil B. Shah, Parvez Mahbub, Mohammad Masudur Rahman 0001
ICSE2025AI / LLM for SE
INTERTRANS: Leveraging Transitive Intermediate Translations to Enhance LLM-Based Code Translation.
Marcos Macedo, Yuan Tian 0008, Pengyu Nie 0001, Filipe Roseiro Côgo, Bram Adams
ICSE2025AI / LLM for SE
Hyperion: Unveiling DApp Inconsistencies Using LLM and Dataflow-Guided Symbolic Execution.
Shuo Yang 0012, Xingwei Lin, Jiachi Chen, Qingyuan Zhong, Lei Xiao 0015
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Gpass: A Goal-Adaptive Neural Theorem Prover Based on Coq for Automated Formal Verification.
Yizhou Chen, Zeyu Sun 0004, Guoqing Wang 0004, Dan Hao 0001
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Faster Configuration Performance Bug Testing with Neural Dual-Level Prioritization.
Youpeng Ma, Tao Chen 0001, Ke Li 0001
ICSE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
Fairquant: Certifying and Quantifying Fairness of Deep Neural Networks.
Brian Hyeongseok Kim, Jingbo Wang 0006, Chao Wang 0001
ICSE2025AI / LLM for SE
Execution Trace Reconstruction Using Diffusion-Based Generative Models.
Madeline Janecek, Naser Ezzati-Jivan, Abdelwahab Hamou-Lhadj
ICSE2025AI / LLM for SE
Diversity Drives Fairness: Ensemble of Higher Order Mutants for Intersectional Fairness of Machine Learning Software.
Zhenpeng Chen, Xinyue Li, Jie M. Zhang, Federica Sarro, Yang Liu 0003
ICSE2025AI / LLM for SE
Deep Learning-based Code Reviews: A Paradigm Shift or a Double-Edged Sword?
Rosalia Tufano, Alberto Martin-Lopez, Ahmad Tayeb, Ozren Dabic, Sonia Haiduc
ICSE2025AI / LLM for SE
Context Conquers Parameters: Outperforming Proprietary Llm in Commit Message Generation.
Aaron Imani, Iftekhar Ahmed 0001, Mohammad Moshirpour
ICSE2025AI / LLM for SE; DevOps / CI / Build / Release
Combining Fine-Tuning and LLM-Based Agents for Intuitive Smart Contract Auditing with Justifications.
Wei Ma 0014, Daoyuan Wu, Yuqiang Sun 0001, Tianwen Wang, Shangqing Liu
ICSE2025AI / LLM for SE; Security / Privacy / Vulnerability
Code Comment Inconsistency Detection and Rectification Using a Large Language Model.
Guoping Rong, Yongda Yu, Song Liu, Xin Tan, Tianyi Zhang
ICSE2025AI / LLM for SE
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE.
Benjamin Steenhoek, Kalpathy Sivaraman, Renata Saldivar Gonzalez, Yevhen Mohylevskyy, Roshanak Zilouchian Moghaddam
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical
Chatgpt-Based Test Generation for Refactoring Engines Enhanced by Feature Analysis on Examples.
Chunhao Dong, Yanjie Jiang, Yuxia Zhang, Yang Zhang, Hui Liu
ICSE2025Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Chatgpt Inaccuracy Mitigation During Technical Report Understanding: Are we There Yet?
Salma Begum Tamanna, Gias Uddin 0001, Song Wang 0009, Lan Xia, Longyu Zhang
ICSE2025AI / LLM for SE
Can an LLM Find Its Way Around a Spreadsheet?
Cho-Ting Lee, Andrew Neeser, Shengzhe Xu, Jay Katyan, Patrick Cross
ICSE2025AI / LLM for SE
COCA: Generative Root Cause Analysis for Distributed Systems with Code Knowledge.
Yichen Li 0003, Yulun Wu, Jinyang Liu 0002, Zhihan Jiang, Zhuangbin Chen
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
Boosting Static Resource Leak Detection via LLM-based Resource-Oriented Intention Inference.
Chong Wang, Jianan Liu, Xin Peng, Yang Liu, Yiling Lou
ICSE2025AI / LLM for SE; Performance / Energy / Reliability
BDefects4NN: A Backdoor Defect Database for Controlled Localization Studies in Neural Networks.
Yisong Xiao, Aishan Liu, Xinwei Zhang 0010, Tianyuan Zhang 0004, Tianlin Li
ICSE2025AI / LLM for SE; Security / Privacy / Vulnerability
Answering User Questions About Machine Learning Models Through Standardized Model Cards.
Tajkia Rahman Toma, Balreet Grewal, Cor-Paul Bezemer
ICSE2025AI / LLM for SE
An LLM-Based Agent-Oriented Approach for Automated Code Design Issue Localization.
Fraol Batole, David O'Brien, Tien N. Nguyen, Robert Dyer 0001, Hridesh Rajan
ICSE2025AI / LLM for SE; Requirements / Modeling / Architecture
An Empirical Study on Automatically Detecting AI-Generated Source Code: How Far are We?
Hyunjae Suh, Mahan Tafreshipour, Jiawei Li 0013, Adithya Bhattiprolu, Iftekhar Ahmed 0001
ICSE2025AI / LLM for SE; Human / Empirical / Socio-technical
Aligning the Objective of LLM-Based Program Repair.
Junjielong Xu, Ying Fu, Shin Hwei Tan, Pinjia He
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
A Multiple Representation Transformer with Optimized Abstract Syntax Tree for Efficient Code Clone Detection.
Tianchen Yu, Li Yuan, Liannan Lin, Hongkui He
ICSE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
A Multi-Agent Approach for REST API Testing with Semantic Graphs and LLM-Driven Inputs.
Myeongsoo Kim, Tyler Stennett, Saurabh Sinha 0003, Alessandro Orso
ICSE2025Testing / QA; AI / LLM for SE
3DGen: AI-Assisted Generation of Provably Correct Binary Format Parsers.
Sarah Fakhoury, Markus Kuppe 0001, Shuvendu K. Lahiri, Tahina Ramananandro, Nikhil Swamy
ICSE2025AI / LLM for SE
$\mu \text{PRL}$: A Mutation Testing Pipeline for Deep Reinforcement Learning Based on Real Faults.
Deepak-George Thomas, Matteo Biagiola, Nargiz Humbatova, Mohammad Wardat, Gunel Jahangirova
ICSE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
Teaching AI the 'Why' and 'How' of Software Vulnerability Fixes.
Amiao Gao; Zenong Zhang; Simin Wang; Liguo Huang; Shiyi Wei; Vincent Ng 0001
FSE2025AI / LLM for SE
SmartNote: An LLM-Powered, Personalised Release Note Generator That Just Works.
Farbod Daneshyan; Runzhi He; Jianyu Wu; Minghui Zhou 0001
FSE2025AI / LLM for SE; DevOps / CI / Build / Release
Revolutionizing Newcomers' Onboarding Process in OSS Communities: The Future AI Mentor.
Xin Tan 0003; Xiao Long; Yinghao Zhu; Lin Shi 0006; Xiaoli Lian; Li Zhang 0029
FSE2025AI / LLM for SE
ReproCopilot: LLM-Driven Failure Reproduction with Dynamic Refinement.
Tanakorn Leesatapornwongsa; Fazle Elahi Faisal; Suman Nath
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
RegTrieve: Reducing System-Level Regression Errors for Machine Learning Systems via Retrieval-Enhanced Ensemble.
Junming Cao; Xuwen Xiang; Mingfei Cheng; Bihuan Chen 0001; Xinyan Wang; You Lu 0005; Chaofeng Sha; Xiaofei Xie; Xin Peng 0001
FSE2025Testing / QA; AI / LLM for SE
Mystique: Automated Vulnerability Patch Porting with Semantic and Syntactic-Enhanced LLM.
Susheng Wu; Ruisi Wang; Yiheng Cao; Bihuan Chen 0001; Zhuotong Zhou; Yiheng Huang; Junpeng Zhao; Xin Peng 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
LLMDroid: Enhancing Automated Mobile App GUI Testing Coverage with Large Language Model Guidance.
Chenxu Wang 0011; Tianming Liu 0002; Yanjie Zhao 0001; Minghui Yang; Haoyu Wang 0001
FSE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android
LLM-Based Method Name Suggestion with Automatically Generated Context-Rich Prompts.
Waseem Akram 0007; Yanjie Jiang; Yuxia Zhang; Haris Ali Khan; Hui Liu 0003
FSE2025AI / LLM for SE
How Do Programming Students Use Generative AI?
Christian Rahe; Walid Maalej
FSE2025AI / LLM for SE
Enhancing Web Accessibility: Automated Detection of Issues with Generative AI.
Ziyao He; Syed Fatiul Huq; Sam Malek
FSE2025AI / LLM for SE; Mobile / Web / GUI / Android
Eliminating Backdoors in Neural Code Models for Secure Code Understanding.
Weisong Sun; Yuchen Chen; Chunrong Fang; Yebo Feng; Yuan Xiao 0003; An Guo 0002; Quanjun Zhang; Zhenyu Chen 0001; Baowen Xu; Yang Liu 0003
FSE2025AI / LLM for SE
Doc2OracLL: Investigating the Impact of Documentation on LLM-Based Test Oracle Generation.
Soneya Binta Hossain; Raygan Taylor; Matthew B. Dwyer
FSE2025Testing / QA; AI / LLM for SE
Demystifying Memorization in LLM-Based Program Repair via a General Hypothesis Testing Framework.
Jiaolong Kong; Xiaofei Xie; Shangqing Liu
FSE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Demystifying LLM-Based Software Engineering Agents.
Chunqiu Steven Xia; Yinlin Deng; Soren Dunn; Lingming Zhang 0001
FSE2025AI / LLM for SE
Code Change Intention, Development Artifact, and History Vulnerability: Putting Them Together for Vulnerability Fix Detection by LLM.
Xu Yang; Wenhan Zhu; Michael Pacheco; Jiayuan Zhou; Shaowei Wang 0002; Xing Hu 0008; Kui Liu 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Maintenance / Evolution / Refactoring / Review
CXXCrafter: An LLM-Based Agent for Automated C/C++ Open Source Software Building.
Zhengmin Yu; Yuan Zhang 0009; Ming Wen 0001; Yinan Nie; Wenhui Zhang; Min Yang 0002
FSE2025AI / LLM for SE; Human / Empirical / Socio-technical
Beyond PEFT: Layer-Wise Optimization for More Effective and Efficient Large Code Model Tuning.
Chaozheng Wang; Jia Feng; Shuzheng Gao; Cuiyun Gao 0001; Zongjie Li; Ting Peng; Hailiang Huang 0004; Yuetang Deng; Michael R. Lyu
FSE2025AI / LLM for SE; Performance / Energy / Reliability
Automatically Detecting Numerical Instability in Machine Learning Applications via Soft Assertions.
Shaila Sharmin; Anwar Hossain Zahid; Subhankar Bhattacharjee; Chiamaka Igwilo; Miryung Kim; Wei Le
FSE2025AI / LLM for SE
Automated Trustworthiness Oracle Generation for Machine Learning Text Classifiers.
Lam Nguyen Tung; Steven Cho; Xiaoning Du 0001; Neelofar; Valerio Terragni; Stefano Ruberto; Aldeida Aleti
FSE2025Testing / QA; AI / LLM for SE
An Empirical Study of Code Clones from Commercial AI Code Generators.
Weibin Wu 0002; Haoxuan Hu; Zhaoji Fan; Yitong Qiao; Yizhan Huang; Yichen Li 0003; Zibin Zheng; Michael R. Lyu
FSE2025AI / LLM for SE; Human / Empirical / Socio-technical
A Knowledge Enhanced Large Language Model for Bug Localization.
Yue Li 0047; Bohan Liu 0003; Ting Zhang 0011; Zhiqi Wang; David Lo 0001; Lanxin Yang; Jun Lyu; He Zhang 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
evalSmarT: An LLM-Based Framework for Evaluating Smart Contract Generated Comments.
Fatou Ndiaye Mbodji, Mame Marieme C. Sougoufara, Wendkûuni C. Ouédraogo, Alioune Diallo, Kui Liu 0001
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability
Wired for Reuse: Automating Context-Aware Code Adaptation in IDEs via LLM-Based Agent.
Taiming Wang, Yanjie Jiang, Chunhao Dong, Yuxia Zhang, Hui Liu 0003
ASE2025AI / LLM for SE
Why AI Agents Still Need You: Findings from Developer-Agent Collaborations in the Wild.
Aayush Kumar, Yasharth Bajpai, Sumit Gulwani, Gustavo Soares, Emerson R. Murphy-Hill
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
When Faster Isn't Greener: The Hidden Costs of LLM-Based Code Optimization.
Tristan Coignion, Clément Quinton, Romain Rouvoy
ASE2025AI / LLM for SE; Performance / Energy / Reliability
When AllClose Fails: Round-Off Error Estimation for Deep Learning Programs.
Qi Zhan, Xing Hu 0008, Yuanyi Lin, Tongtong Xu, Xin Xia 0001
ASE2025AI / LLM for SE
Watson: A Cognitive Observability Framework for the Reasoning of LLM-Powered Agents.
Benjamin Rombaut 0002, Sogol Masoumzadeh, Kirill Vasilevski, Dayi Lin, Ahmed E. Hassan
ASE2025AI / LLM for SE; Cloud / Microservices / Distributed Systems
Vul-R2: A Reasoning LLM for Automated Vulnerability Repair.
Xin-Cheng Wen, Zirui Lin, Yijun Yang, Cuiyun Gao 0001, Deheng Ye
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Unit Test Update through LLM-Driven Context Collection and Error-Type-Aware Refinement.
Yuanhe Zhang, Zhiquan Yang, Shengyi Pan, Zhongxin Liu 0002
ASE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
Tuning LLM-based Code Optimization via Meta-Prompting: An Industrial Perspective.
Jingzhi Gong, Rafail Giavrimis, Paul Brookes, Vardan Voskanyan, Fan Wu 0009
ASE2025AI / LLM for SE; Performance / Energy / Reliability
Towards Reliable LLM-based Exam Generation Lessons Learned and Open Challenges in an Industrial Project.
Renzo Degiovanni, Jordi Cabot
ASE2025AI / LLM for SE
Towards Generalizable Instruction Vulnerability Prediction via LLM-Enhanced Code Representation.
Bao Wen, Jingjing Gu, Jingxuan Zhang, Yang Liu 0390, Pengfei Yu 0002
ASE2025AI / LLM for SE
TensorGuard: Gradient-Based Model Fingerprinting for LLM Similarity Detection and Family Classification.
Zehao Wu, Yanjie Zhao 0001, Haoyu Wang 0001
ASE2025AI / LLM for SE
Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems.
Dany Moshkovich, Sergey Zeltyn
ASE2025AI / LLM for SE
StackPlagger: A System for Identifying AI-Code Plagiarism on Stack Overflow.
Aman Swaraj, Harsh Goyal, Sumit Chadgal, Sandeep Kumar 0004
ASE2025AI / LLM for SE
Speculative Automated Refactoring of Imperative Deep Learning Programs to Graph Execution.
Raffi Khatchadourian, Tatiana Castro Vélez, Mehdi Bagherzadeh 0001, Nan Jia, Anita Raja
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Should We Evaluate LLM Based Security Analysis Approaches on Open Source Systems?
Kohei Dozono, Jonas Engesser, Benjamin Hummel, Tobias Roehm, Alexander Pretschner
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
SemGuard: Real-Time Semantic Evaluator for Correcting LLM-Generated Code.
Qinglin Wang, Zhihong Sun, Ruyun Wang, Tao Huang, Zhi Jin 0001
ASE2025AI / LLM for SE
Security Debt in LLM Agent Applications: A Measurement Study of Vulnerabilities and Mitigation Trade-offs.
Zhuoxiang Shen, Jiarun Dai, Yuan Zhang 0009, Min Yang 0002
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
STaint: Detecting Second-Order Vulnerabilities in PHP Applications with LLM-Assisted Bi-Directional Static Taint Analysis.
Yuchen Ji, Hongchen Cao, Jingzhu He
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability
SGCR: A Specification-Grounded Framework for Trustworthy LLM Code Review.
Kai Wang, Bingcheng Mao, Shuai Jia, Yujie Ding, Dongming Han
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Maintenance / Evolution / Refactoring / Review
SE-Jury: An LLM-as-Ensemble-Judge Metric for Narrowing the Gap with Human Evaluation in SE.
Xin Zhou 0014, Kisub Kim, Ting Zhang 0011, Martin Weyssow, Luís F. Gomes
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
RustAssure: Differential Symbolic Testing for LLM-Transpiled C-to-Rust Code.
Yubo Bai, Tapti Palit
ASE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
Root Cause Analysis of RISC-V Build Failures via LLM and MCTS Reasoning.
Weipeng Shuai, Jie Liu 0008, Zhirou Ma, Liangyi Kang, Zehua Wang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
ReFuzzer: Feedback-Driven Approach to Enhance Validity of LLM-Generated Test Programs.
Iti Shree, Karine Even-Mendoza, Tomasz Radzik
ASE2025Testing / QA; AI / LLM for SE
RFCAudit: AI Agent for Auditing Protocol Implementations Against RFC Specifications.
Mingwei Zheng, Chengpeng Wang 0001, Xuwei Liu, Jinyao Guo, Shiwei Feng 0002
ASE2025AI / LLM for SE
Quirx: A Mutation-Based Framework for Evaluating Prompt Robustness in LLM-based Software.
Souhaila Serbout
ASE2025Testing / QA; AI / LLM for SE
Quantum Machine Learning-based Test Oracle for Autonomous Mobile Robots.
Xinyi Wang 0004, Qinghua Xu, Paolo Arcaini, Shaukat Ali 0001, Thomas Peyrucain
ASE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android
Provable Fairness Repair for Deep Neural Networks.
Jianan Ma, Jingyi Wang, Qi Xuan, Zhen Wang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Prompt-with-Me: in-IDE Structured Prompt Management for LLM-Driven Software Engineering.
Ziyou Li, Agnia Sergeyuk, Maliheh Izadi
ASE2025AI / LLM for SE
PromFuzz: Leveraging LLM-Driven and Bug-Oriented Composite Analysis for Detecting Functional Bugs in Smart Contracts.
Xingshuang Lin, Qinge Xie, Binbin Zhao, Yuan Tian 0001, Saman A. Zonouz
ASE2025Testing / QA; AI / LLM for SE
Out of Distribution Detection in Self-adaptive Robots with AI-powered Digital Twins.
Erblin Isaku, Hassan Sartaj, Shaukat Ali 0001, Beatriz Sanguino, Tongtong Wang
ASE2025AI / LLM for SE
OSSPREY: AI-Driven Forecasting and Intervention for OSS Project Sustainability.
Nafiz Imtiaz Khan, Priyal Soni, Arjun Ashok, Vladimir Filkov
ASE2025AI / LLM for SE
ORFuzz: Fuzzing the "Other Side" of LLM Safety - Testing Over-Refusal.
Haonan Zhang 0007, Dongxia Wang 0002, Yi Liu, Kexin Chen, Jiashui Wang
ASE2025Testing / QA; AI / LLM for SE
Not Every Patch is an Island: LLM-Enhanced Identification of Multiple Vulnerability Patches.
Yi Song, Dongchen Xie, Lin Xu, He Zhang, Chunying Zhou
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Measuring LLM Code Generation Stability via Structural Entropy.
Yewei Song, Tiezhu Sun, Xunzhu Tang, Prateek Rajput, Tegawendé F. Bissyandé
ASE2025AI / LLM for SE
MIMIC: Integrating Diverse Personality Traits for Better Game Testing Using Large Language Model.
Yifei Chen, Sarra Habchi, Lili Wei
ASE2025Testing / QA; AI / LLM for SE
MCTS-Refined CoT: High-Quality Fine-Tuning Data for LLM-Based Repository Issue Resolution.
Yibo Wang 0008, Zhihao Peng 0009, Ying Wang 0038, Zhao Wei, Hai Yu 0001
ASE2025AI / LLM for SE; DevOps / CI / Build / Release
LogSage: An LLM-Based Framework for CI/CD Failure Detection and Remediation with Industrial Validation.
Weiyuan Xu, Juntao Luo, Tao Huang, Kaixin Sui, Jie Geng
ASE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
Leveraging Mixture-of-Experts Framework for Smart Contract Vulnerability Repair with Large Language Model.
Hang Yuan, Xizhi Hou, Lei Yu, Li Yang 0015, Jiayue Tang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
Learning Project-wise Subsequent Code Edits via Interleaving Neural-based Induction and Tool-based Deduction.
Chenyan Liu, Yun Lin 0001, Yuhuan Huang, Jiaxin Chang, Binhang Qi
ASE2025AI / LLM for SE
Lares: LLM-driven Code Slice Semantic Search for Patch Presence Testing.
Siyuan Li 0014, Yaowen Zheng, Hong Li 0004, Jingdong Guo, Chaopeng Dong
ASE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
LLM-based Dynamic Differential Testing for Database Connectors with Reinforcement Learning-Guided Prompt Selection.
Ce Lyu, Yanhao Wang 0001, Jie Liang, Minghao Zhao 0001
ASE2025Testing / QA; AI / LLM for SE
LLM-assisted Industrial-Scale Differential Testing of Package Incompatibilities in Linux Distributions.
Yuhao Yang, Chijin Zhou, Runzhe Wang, Weibo Zhang, Yuheng Shen
ASE2025Testing / QA; AI / LLM for SE
LLM-Powered Multi-Agent Collaboration for Intelligent Industrial On-Call Automation.
Ruowei Fu, Yang Zhang, Zeyu Che, Xin Wu, Zhenyu Zhong
ASE2025AI / LLM for SE
LLM-Powered Fully Automated Chaos Engineering: Towards Enabling Anyone to Build Resilient Software Systems at Low Cost.
Daisuke Kikuta, Hiroki Ikeuchi, Kengo Tajiri
ASE2025AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
LLM-Guided Genetic Improvement: Envisioning Semantic Aware Automated Software Evolution.
Karine Even-Mendoza, Alexander E. I. Brownlee, Alina Geiger, Carol Hanna, Justyna Petke
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
LLM-Based Identification of Null Pointer Exception Patches.
Tahir Ullah, Waseem Akram 0005, Fiza Khaliq, Hui Liu
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
LLM-Assisted Synthesis of High-Assurance C Programs.
Prasita Mukherjee, Minghai Lu, Benjamin Delaware
ASE2025AI / LLM for SE
LAURA: Enhancing Code Review Generation with Context-Enriched Retrieval-Augmented LLM.
Yuxin Zhang, Yuxia Zhang, Zeyu Sun 0004, Yanjie Jiang, Hui Liu 0003
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
KAIOPS: A Platform Solution of End-to-End Multi-Modal AIOps for AI Training at Scale.
Zeying Wang, Junhong Liu, Penghao Zhang, Xiaoyang Sun, Xu Wang
ASE2025AI / LLM for SE
Issue Localization via LLM-Driven Iterative Code Graph Searching.
Zhonghao Jiang, Xiaoxue Ren, Meng Yan 0001, Wei Jiang 0041, Yong Li 0004
ASE2025AI / LLM for SE
Industry Practice of LLM-Assisted Protocol Fuzzing for Commercial Communication Modules.
Qiang Fu, Changjian Liu, Yuan Ding, Chao Fan, Yulai Fu
ASE2025Testing / QA; AI / LLM for SE
Improving Quality of LLM Code Generation in Low-Resource Programming Languages via Uncertainty Estimation.
Georgii Andriushchenko
ASE2025AI / LLM for SE; Performance / Energy / Reliability
Improving LLM-based Log Parsing by Learning from Errors in Reasoning Traces.
Jialai Wang, Juncheng Lu, Jie Yang, Junjie Wang 0001, Zeyu Gao
ASE2025AI / LLM for SE
Hypergraph Neural Network-based Multi-Granular Root Cause Localization for Microservice Systems.
Yaxiao Li, Lu Wang 0014, Chenxi Zhang 0003, Qingshan Li, Siming Rong
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
How Does ChatGPT Make Assumptions When Creating Erroneous Programs?
Sadia Jahan, Xiaoyin Wang
ASE2025AI / LLM for SE
Hierarchical Knowledge Injection for Improving LLM-based Program Repair.
Ramtin Ehsani, Esteban Parra, Sonia Haiduc, Preetha Chatterjee
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
GUI-ReRank: Enhancing GUI Retrieval with Multi-Modal LLM-based Reranking.
Kristian Kolthoff, Felix Kretzer, Alexander Maedche, Simone Paolo Ponzetto, Christian Bartelt
ASE2025AI / LLM for SE; Mobile / Web / GUI / Android
From Redundancy to Efficiency: Exploiting Shared UI Interactions towards Efficient LLM-Based Testing.
Xuan Wang, Yingchuan Wang, Yongxiang Hu 0003, Yu Zhang 0165, Hailiang Jin
ASE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android; Performance / Energy / Reliability
Fixing Broken Graphs: LLM-Powered Automatic Code Optimization for DNN Programs.
Haotian Wang, Yicheng Sui, Yudong Xie, Yicong Liu, Yufei Sun
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
Faultseeker: LLM-Empowered Framework for Blockchain Transaction Fault Localization.
Kairan Sun, Zhengzi Xu, Kaixuan Li 0002, Lyuye Zhang, Yuqiang Sun 0001
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
Explainable Fault Localization for Programming Assignments via LLM-Guided Annotation.
Fang Liu, Tianze Wang, Li Zhang, Zheyu Yang, Jing Jiang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Enhancing LLM's Ability to Generate More Repository-Aware Unit Tests Through Precise Context Injection.
Xin Yin, Chao Ni 0001, Xinrui Li, Liushan Chen, Guojun Ma
ASE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
Enhancing LLM to Decompile Optimized PTX to Readable CUDA for Tensor Programs.
Xinyu Sun, Fugen Tang, Yu Zhang, Han Shen, Chengru Song
ASE2025AI / LLM for SE
Efficient Understanding of Machine Learning Model Mispredictions.
Martin Eberlein, Jürgen Cito, Lars Grunske
ASE2025AI / LLM for SE
Detecting and Repairing Incomplete Software Requirements with Multi-LLM Ensembles.
Mohamad Kassab, Marwan AbdElhameed
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Requirements / Modeling / Architecture
Detecting Various DeFi Price Manipulations with LLM Reasoning.
Juantao Zhong, Daoyuan Wu, Ye Liu 0012, Maoyi Xie, Yang Liu 0003
ASE2025AI / LLM for SE
Destabilizing Neurons to Generate Challenging Neural Network Verification Benchmarks.
Linhan Li, ThanhVu Nguyen
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Demystifying the Evolution of Neural Networks with BOM Analysis: Insights from a Large-Scale Study of 55,997 GitHub Repositories.
Xiaoning Ren, Yuhang Ye 0004, Xiongfei Wu, Yueming Wu 0001, Yinxing Xue
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Defects4C: Benchmarking Large Language Model Repair Capability with C/C++ Bugs.
Jian Wang 0067, Xiaofei Xie, Qiang Hu, Shangqing Liu, Jiongchi Yu
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
DeepTx: Real-Time Transaction Risk Analysis via Multi-Modal Features and LLM Reasoning.
Yixuan Liu, Xinlei Li, Yi Li
ASE2025AI / LLM for SE
DeepExploitor: LLM-Enhanced Automated Exploitation of DeepLink Attack in Hybrid Apps.
Zhangyue Zhang, Lei Zhang 0096, Zhibo Zhang 0006, Yongheng Liu, Zhemin Yang
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Coverage-Based Harmfulness Testing for LLM Code Transformation.
Honghao Tan, Haibo Wang, Diany Pressato, Yisen Xu, Shin Hwei Tan
ASE2025Testing / QA; AI / LLM for SE
Context-Aware CodeLLM Eviction for AI-assisted Coding.
Kishanthan Thangarajah, Boyuan Chen 0002, Shi Chang, Ahmed E. Hassan
ASE2025AI / LLM for SE
Characterizing Multi-Hunk Patches: Divergence, Proximity, and LLM Repair Challenges.
Noor Nashid, Daniel Ding, Keheliya Gallaba, Ahmed E. Hassan, Ali Mesbah 0001
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
BuilDroid: A Self-Correcting LLM Agent for Automated Android Builds.
Jaehyeon Kim, Rui Rua, Karim Ali 0001
ASE2025AI / LLM for SE; DevOps / CI / Build / Release; Mobile / Web / GUI / Android
BitsAI-Fix: LLM-Driven Approach for Automated Lint Error Resolution in Practice.
Yuanpeng Li, Qi Long, Zhiyuan Yao, Jian Xu, Lintao Xie
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Beyond Static GUI Agent: Evolving LLM-based GUI Testing via Dynamic Memory.
Mengzhuo Chen, Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Yangguang Xue
ASE2025Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review; Mobile / Web / GUI / Android
Automated Repair of Ambiguous Problem Descriptions for LLM-Based Code Generation.
Haoxiang Jia, Robbie Morris, He Ye, Federica Sarro, Sergey Mechtaev
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
AppBDS: LLM-Powered Description Synthesis for Sensitive Behaviors in Mobile Apps.
Zichen Liu, Xusheng Xiao
ASE2025AI / LLM for SE; Mobile / Web / GUI / Android
An LLM-based multi-agent framework for agile effort estimation.
Thanh-Long Bui, Hoa Khanh Dam, Rashina Hoda
ASE2025AI / LLM for SE
An Empirical Study of Knowledge Transfer in AI Pair Programming.
Alisa Welter, Niklas Schneider, Tobias Dick, Kallistos Weis, Christof Tinnes
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
Advancing Binary Code Similarity Detection via Context-Content Fusion and LLM Verification.
Chaopeng Dong, Jingdong Guo, Shouguo Yang, Yi Li, Dongliang Fang
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Advancing Automated Ethical Profiling in SE: a Zero-Shot Evaluation of LLM Reasoning.
Patrizio Migliarini, Mashal Afzal Memon, Marco Autili, Paola Inverardi
ASE2025AI / LLM for SE
AdaptiveGuard: Towards Adaptive Runtime Safety for LLM-Powered Software.
Rui Yang, Michael Fu, Chakkrit Tantithamthavorn, Chetan Arora 0002, Gunel Gulmammadova
ASE2025AI / LLM for SE
A Large Scale Study of AI-based Binary Function Similarity Detection Techniques for Security Researchers and Practitioners.
Jingyi Shi, Yufeng Chen, Yang Xiao 0011, Yuekang Li, Zhengzi Xu
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
A Characterization Study of Bugs in LLM Agent Workflow Orchestration Frameworks.
Ziluo Xue, Yanjie Zhao 0001, Shenao Wang 0001, Kai Chen 0012, Haoyu Wang 0001
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
"My productivity is boosted, but ..." Demystifying Users' Perception on AI Coding Assistants.
Yunbo Lyu, Zhou Yang 0003, Jieke Shi, Jianming Chang, Yue Liu 0011
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
Towards More Complete Constraints for Deep Learning Library Testing via Complementary Set Guided Refinement.
Gwihwan Go, Chijin Zhou, Quan Zhang 0003, Xiazijian Zou, Heyuan Shi
ISSTA2024Testing / QA; AI / LLM for SE
Test Selection for Deep Neural Networks using Meta-Models with Uncertainty Metrics.
Demet Demir, Aysu Betin Can, Elif Sürer
ISSTA2024Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
TeDA: A Testing Framework for Data Usage Auditing in Deep Learning Model Development.
Xiangshan Gao, Jialuo Chen, Jingyi Wang 0004, Jie Shi 0013, Peng Cheng 0001
ISSTA2024Testing / QA; AI / LLM for SE
Synthesizing Boxes Preconditions for Deep Neural Networks.
Zengyu Liu, Liqian Chen, Wanwei Liu, Ji Wang 0001
ISSTA2024AI / LLM for SE
See the Forest, not Trees: Unveiling and Escaping the Pitfalls of Error-Triggering Inputs in Neural Network Testing.
Yuanyuan Yuan 0001, Shuai Wang 0011, Zhendong Su 0001
ISSTA2024Testing / QA; AI / LLM for SE
One-to-One or One-to-Many? Suggesting Extract Class Refactoring Opportunities with Intra-class Dependency Hypergraph Neural Network.
Di Cui, Qiangqiang Wang, Yutong Zhao, Jiaqi Wang, Minjie Wei
ISSTA2024AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
NeuFair: Neural Network Fairness Repair with Dropout.
Vishnu Asutosh Dasu, Ashish Kumar, Saeid Tizpaz-Niari, Gang Tan
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Maltracker: A Fine-Grained NPM Malware Tracker Copiloted by LLM-Enhanced Dataset.
Zeliang Yu, Ming Wen 0001, Xiaochen Guo, Hai Jin 0001
ISSTA2024AI / LLM for SE; Security / Privacy / Vulnerability
LLM4Fin: Fully Automating LLM-Powered Test Case Generation for FinTech Software Acceptance Testing.
Zhiyi Xue, Liangguo Li, Senyue Tian, Xiaohong Chen 0007, Pingping Li
ISSTA2024Testing / QA; AI / LLM for SE
Isolation-Based Debugging for Neural Networks.
Jialuo Chen, Jingyi Wang 0004, Youcheng Sun, Peng Cheng 0001, Jiming Chen 0001
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Interpretability Based Neural Network Repair.
Zuohui Chen, Jun Zhou, Youcheng Sun, Jingyi Wang 0004, Qi Xuan 0001
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Interoperability in Deep Learning: A User Survey and Failure Analysis of ONNX Model Converters.
Purvish Jajal, Wenxin Jiang 0001, Arav Tewari, Erik Kocinare, Joseph Woo
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical
How Effective Are They? Exploring Large Language Model Based Fuzz Driver Generation.
Cen Zhang, Yaowen Zheng, Mingqiang Bai, Yeting Li, Wei Ma 0014
ISSTA2024Testing / QA; AI / LLM for SE
HECS: A Hypergraph Learning-Based System for Detecting Extract Class Refactoring Opportunities.
Luqiao Wang, Qiangqiang Wang, Jiaqi Wang, Yutong Zhao, Minjie Wei
ISSTA2024AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Guardian: A Runtime Framework for LLM-Based UI Exploration.
Dezhi Ran, Hao Wang 0112, Zihe Song, Mengzhou Wu, Yuan Cao
ISSTA2024AI / LLM for SE; Mobile / Web / GUI / Android
Graph Neural Networks for Vulnerability Detection: A Counterfactual Explanation.
Zhaoyang Chu, Yao Wan 0001, Qian Li 0003, Yang Wu 0010, Hongyu Zhang 0002
ISSTA2024AI / LLM for SE
Fuzzing JavaScript Interpreters with Coverage-Guided Reinforcement Learning for LLM-Based Mutation.
Jueon Eom, Seyeon Jeong, Taekyoung Kwon 0002
ISSTA2024Testing / QA; AI / LLM for SE
Face It Yourselves: An LLM-Based Two-Stage Strategy to Localize Configuration Errors via Logs.
Shiwen Shan, Yintong Huo, Yuxin Su 0001, Yichen Li 0003, Dan Li 0016
ISSTA2024AI / LLM for SE; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems
FDI: Attack Neural Code Generation Systems through User Feedback Channel.
Zhensu Sun, Xiaoning Du 0001, Xiapu Luo, Fu Song, David Lo 0001
ISSTA2024AI / LLM for SE; Security / Privacy / Vulnerability
Evaluating Deep Neural Networks in Deployment: A Comparative Study (Replicability Study).
Eduard Pinconschi, Divya Gopinath, Rui Abreu 0001, Corina S. Pasareanu
ISSTA2024AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release
Domain Adaptation for Code Model-Based Unit Test Case Generation.
Jiho Shin, Sepehr Hashtroudi, Hadi Hemmati, Song Wang 0009
ISSTA2024Testing / QA; AI / LLM for SE
Distance-Aware Test Input Selection for Deep Neural Networks.
Zhong Li, Zhengfeng Xu, Ruihua Ji, Minxue Pan, Tian Zhang 0001
ISSTA2024Testing / QA; AI / LLM for SE
DiaVio: LLM-Empowered Diagnosis of Safety Violations in ADS Simulation Testing.
You Lu 0005, Yifan Tian, Yuyang Bi, Bihuan Chen 0001, Xin Peng 0001
ISSTA2024Testing / QA; AI / LLM for SE
Decomposition of Deep Neural Networks into Modules via Mutation Analysis.
Ali Ghanbari 0001
ISSTA2024Testing / QA; AI / LLM for SE
Certified Continual Learning for Neural Network Regression.
Long H. Pham, Jun Sun 0001
ISSTA2024Testing / QA; AI / LLM for SE
Calico: Automated Knowledge Calibration and Diagnosis for Elevating AI Mastery in Code Tasks.
Yuxin Qiu, Jie Hu 0031, Qian Zhang 0020, Heng Yin 0001
ISSTA2024AI / LLM for SE
CREF: An LLM-Based Conversational Software Repair Framework for Programming Tutors.
Boyang Yang, Haoye Tian, Weiguo Pian, Haoran Yu, Haitao Wang
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Automated Program Repair via Conversation: Fixing 162 out of 337 Bugs for $0.42 Each using ChatGPT.
Chunqiu Steven Xia, Lingming Zhang 0001
ISSTA2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Automated Deep Learning Optimization via DSL-Based Source Code Transformation.
Ruixin Wang, Minghai Lu, Cody Hao Yu, Yi-Hsiang Lai, Tianyi Zhang 0001
ISSTA2024AI / LLM for SE; Performance / Energy / Reliability
AI Coders Are among Us: Rethinking Programming Language Grammar towards Efficient Code Generation.
Zhensu Sun, Xiaoning Du 0001, Zhou Yang 0003, Li Li 0029, David Lo 0001
ISSTA2024AI / LLM for SE
When Neural Code Completion Models Size up the Situation: Attaining Cheaper and Faster Completion through Dynamic Model Inference.
Zhensu Sun, Xiaoning Du 0001, Fu Song, Shangwen Wang, Li Li 0029
ICSE2024AI / LLM for SE
VeRe: Verification Guided Synthesis for Repairing Deep Neural Networks.
Jianan Ma, Pengfei Yang 0002, Jingyi Wang 0004, Youcheng Sun, Cheng-Chao Huang
ICSE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
VGX: Large-Scale Sample Generation for Boosting Learning-Based Software Vulnerability Analyses.
Yu Nong, Richard Fang, Guangbei Yi, Kunsong Zhao, Xiapu Luo
ICSE2024AI / LLM for SE
Using an LLM to Help With Code Understanding.
Daye Nam, Andrew Macvean, Vincent J. Hellendoorn, Bogdan Vasilescu, Brad A. Myers
ICSE2024AI / LLM for SE
UniLog: Automatic Logging via LLM and In-Context Learning.
Junjielong Xu, Ziang Cui, Yuan Zhao 0014, Xu Zhang 0024, Shilin He
ICSE2024AI / LLM for SE
Towards Causal Deep Learning for Vulnerability Detection.
Md Mahbubur Rahman, Ira Ceka, Chengzhi Mao, Saikat Chakraborty 0001, Baishakhi Ray
ICSE2024AI / LLM for SE
Toward Improved Deep Learning-based Vulnerability Detection.
Adriana Sejfia, Satyaki Das, Saad Shafiq, Nenad Medvidovic
ICSE2024AI / LLM for SE
Testing the Limits: Unusual Text Inputs Generation for Mobile App Crash Detection with Large Language Model.
Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Mengzhuo Chen, Boyu Wu
ICSE2024Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Mobile / Web / GUI / Android
Software Engineering Research in a World with Generative Artificial Intelligence.
Martin C. Rinard
ICSE2024AI / LLM for SE
RUNNER: Responsible UNfair NEuron Repair for Enhancing Deep Neural Network Fairness.
Tianlin Li, Yue Cao, Jian Zhang 0087, Shiqian Zhao, Yihao Huang 0001
ICSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Out of Context: How important is Local Context in Neural Program Repair?
Julian Aron Prenner, Romain Robbes
ICSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
MalCertain: Enhancing Deep Neural Network Based Android Malware Detection by Tackling Prediction Uncertainty.
Haodong Li, Guosheng Xu 0001, Liu Wang 0002, Xusheng Xiao, Xiapu Luo
ICSE2024AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Make LLM a Testing Expert: Bringing Human-like Interaction to Mobile GUI Testing via Functionality-aware Decisions.
Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Mengzhuo Chen, Boyu Wu
ICSE2024Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android
Machine Learning is All You Need: A Simple Token-based Approach for Effective Code Clone Detection.
Siyue Feng, Wenqi Suo, Yueming Wu 0001, Deqing Zou, Yang Liu 0003
ICSE2024AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
MAFT: Efficient Model-Agnostic Fairness Testing for Deep Neural Networks via Zero-Order Gradient Search.
Zhaohui Wang, Min Zhang 0007, Jingran Yang, Bojie Shao, Min Zhang 0002
ICSE2024Testing / QA; AI / LLM for SE
Learning-based Widget Matching for Migrating GUI Test Cases.
Yakun Zhang 0001, Wenjie Zhang 0007, Dezhi Ran, Qihao Zhu, Chengfeng Dou
ICSE2024Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android
Large Language Models are Edge-Case Generators: Crafting Unusual Programs for Fuzzing Deep Learning Libraries.
Yinlin Deng, Chunqiu Steven Xia, Chenyuan Yang, Shizhuo Dylan Zhang, Shujing Yang
ICSE2024Testing / QA; AI / LLM for SE
Inferring Data Preconditions from Deep Learning Models for Trustworthy Prediction in Deployment.
Shibbir Ahmed, Hongyang Gao, Hridesh Rajan
ICSE2024AI / LLM for SE; DevOps / CI / Build / Release
Improving Smart Contract Security with Contrastive Learning-based Vulnerability Detection.
Yizhou Chen, Zeyu Sun 0004, Zhihao Gong, Dan Hao 0001
ICSE2024AI / LLM for SE; Security / Privacy / Vulnerability
ITER: Iterative Neural Repair for Multi-Location Patches.
He Ye, Martin Monperrus
ICSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
How Far Are We? The Triumphs and Trials of Generative AI in Learning Software Engineering.
Rudrajit Choudhuri, Dylan Liu, Igor Steinmacher, Marco Aurélio Gerosa, Anita Sarma
ICSE2024AI / LLM for SE
GrammarT5: Grammar-Integrated Pretrained Encoder-Decoder Neural Model for Code.
Qihao Zhu, Qingyuan Liang, Zeyu Sun 0004, Yingfei Xiong 0001, Lu Zhang 0023
ICSE2024AI / LLM for SE
GPTScan: Detecting Logic Vulnerabilities in Smart Contracts by Combining GPT with Program Analysis.
Yuqiang Sun 0001, Daoyuan Wu, Yue Xue, Han Liu 0012, Haijun Wang 0002
ICSE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
Exploring the Potential of ChatGPT in Automated Code Refinement: An Empirical Study.
Qi Guo, Junming Cao, Xiaofei Xie, Shangqing Liu, Xiaohong Li 0001
ICSE2024AI / LLM for SE; Human / Empirical / Socio-technical
Enhancing Exploratory Testing by Large Language Model and Knowledge Graph.
Yanqi Su, Dianshu Liao, Zhenchang Xing, Qing Huang, Mulong Xie
ICSE2024Testing / QA; AI / LLM for SE
Development in times of hype: How freelancers explore Generative AI?
Mateusz Dolata, Norbert Lange, Gerhard Schwabe
ICSE2024AI / LLM for SE
Demystifying and Detecting Misuses of Deep Learning APIs.
Moshi Wei, Nima Shiri Harzevili, Yuekai Huang, Jinqiu Yang 0001, Junjie Wang 0001
ICSE2024AI / LLM for SE
Deep Learning or Classical Machine Learning? An Empirical Study on Log-Based Anomaly Detection.
Boxi Yu, Jiayi Yao, Qiuai Fu, Zhiqing Zhong, Haotian Xie
ICSE2024AI / LLM for SE; Human / Empirical / Socio-technical; Cloud / Microservices / Distributed Systems
Dataflow Analysis-Inspired Deep Learning for Efficient Vulnerability Detection.
Benjamin Steenhoek, Hongyang Gao, Wei Le
ICSE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
DEMISTIFY: Identifying On-device Machine Learning Models Stealing and Reuse Vulnerabilities in Mobile Apps.
Pengcheng Ren, Chaoshun Zuo, Xiaofeng Liu 0013, Wenrui Diao, Qingchuan Zhao
ICSE2024AI / LLM for SE; Mobile / Web / GUI / Android
CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models.
Hao Yu 0016, Bo Shen, Dezhi Ran, Jiaxin Zhang 0029, Qi Zhang 0020
ICSE2024AI / LLM for SE
Coca: Improving and Explaining Graph Neural Network-Based Vulnerability Detection Systems.
Sicong Cao, Xiaobing Sun 0001, Xiaoxue Wu 0001, David Lo 0001, Lili Bo
ICSE2024AI / LLM for SE
ChatGPT-Resistant Screening Instrument for Identifying Non-Programmers.
Raphael Serafini, Clemens Otto, Stefan Albert Horstmann, Alena Naiakshina
ICSE2024AI / LLM for SE
ChatGPT Incorrectness Detection in Software Reviews.
Minaoar Hossain Tanzil, Junaed Younus Khan, Gias Uddin 0001
ICSE2024AI / LLM for SE
CIT4DNN: Generating Diverse and Rare Inputs for Neural Networks Using Latent Space Combinatorial Testing.
Swaroopa Dola, Rory McDaniel, Matthew B. Dwyer, Mary Lou Soffa
ICSE2024Testing / QA; AI / LLM for SE
An Empirical Study on Low GPU Utilization of Deep Learning Jobs.
Yanjie Gao, Yichen He, Xinze Li, Bo Zhao, Haoxiang Lin
ICSE2024AI / LLM for SE; Human / Empirical / Socio-technical
A Large-Scale Survey on the Usability of AI Programming Assistants: Successes and Challenges.
Jenny T. Liang, Chenyang Yang 0002, Brad A. Myers
ICSE2024AI / LLM for SE; Human / Empirical / Socio-technical
A Comprehensive Study of Learning-based Android Malware Detectors under Challenging Environments.
Cuiying Gao, Gaozhun Huang, Heng Li 0008, Bang Wu 0003, Yueming Wu 0001
ICSE2024AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android
Your Code Secret Belongs to Me: Neural Code Completion Tools Can Memorize Hard-Coded Credentials.
Yizhan Huang; Yichen Li 0003; Weibin Wu 0002; Jianping Zhang 0002; Michael R. Lyu
FSE2024AI / LLM for SE; Security / Privacy / Vulnerability
Towards Better Graph Neural Network-Based Fault Localization through Enhanced Code Representation.
Md Nakhla Rafi; Dong Jae Kim; An Ran Chen; Tse-Hsun (Peter) Chen; Shaowei Wang 0002
FSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Towards AI-Assisted Synthesis of Verified Dafny Methods.
Md Rakib Hossain Misu; Cristina V. Lopes; Iris Ma; James Noble 0001
FSE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
SimLLM: Calculating Semantic Similarity in Code Summaries using a Large Language Model-Based Approach.
Xin Jin; Zhiqiang Lin 0001
FSE2024AI / LLM for SE
Rocks Coding, Not Development: A Human-Centric, Experimental Evaluation of LLM-Supported SE Tasks.
Wei Wang 0353; Huilong Ning; Gaowei Zhang; Libo Liu; Yi Wang 0013
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical
Predicting Code Comprehension: A Novel Approach to Align Human Gaze with Code using Deep Neural Networks.
Tarek Alakmeh; David R. Reich; Lena A. Jäger; Thomas Fritz 0001
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical; Education / Program Comprehension
Only diff Is Not Enough: Generating Commit Messages Leveraging Reasoning and Action of Large Language Model.
Jiawei Li 0013; David Faragó; Christian Petrov; Iftekhar Ahmed 0001
FSE2024AI / LLM for SE; DevOps / CI / Build / Release
On Reducing Undesirable Behavior in Deep-Reinforcement-Learning-Based Software.
Ophir M. Carmel; Guy Katz
FSE2024AI / LLM for SE
MirrorFair: Fixing Fairness Bugs in Machine Learning Software via Counterfactual Predictions.
Ying Xiao; Jie M. Zhang; Yepang Liu 0001; Mohammad Reza Mousavi 0001; Sicen Liu; Dingyuan Xue
FSE2024AI / LLM for SE
Generative AI for Pull Request Descriptions: Adoption, Impact, and Developer Interventions.
Tao Xiao 0001; Hideaki Hata; Christoph Treude; Kenichi Matsumoto
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical
EyeTrans: Merging Human and Machine Attention for Neural Code Summarization.
Yifan Zhang 0013; Jiliang Li; Zachary Karas; Aakash Bansal; Toby Jia-Jun Li; Collin McMillan; Kevin Leach; Yu Huang 0015
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical
Evaluating and Improving ChatGPT for Unit Test Generation.
Zhiqiang Yuan; Mingwei Liu 0002; Shiji Ding; Kaixin Wang; Yixuan Chen 0012; Xin Peng 0001; Yiling Lou
FSE2024Testing / QA; AI / LLM for SE
DiffCoder: Enhancing Large Language Model on API Invocation via Analogical Code Exercises.
Daoguang Zan; Ailun Yu; Bo Shen; Bei Chen 0008; Wei Li 0326; Yongshun Gong; Xiaolin Chen; Yafen Yao; Weihua Luo; Bei Guan; Yan Liu; Yongji Wang 0002; Qianxiang Wang; Lizhen Cui 0001
FSE2024AI / LLM for SE
DeciX: Explain Deep Learning Based Code Generation Applications.
Simin Chen; Zexin Li 0001; Wei Yang 0013; Cong Liu 0005
FSE2024AI / LLM for SE
CrossCert: A Cross-Checking Detection Approach to Patch Robustness Certification for Deep Learning Models.
Qilin Zhou; Zhengyuan Wei; Haipeng Wang 0005; Bo Jiang 0001; Wing-Kwong Chan
FSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Code-Aware Prompting: A Study of Coverage-Guided Test Generation in Regression Setting using LLM.
Gabriel Ryan; Siddhartha Jain 0001; Mingyue Shang; Shiqi Wang 0002; Xiaofei Ma 0001; Murali Krishna Ramanathan; Baishakhi Ray
FSE2024Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical
ClarifyGPT: A Framework for Enhancing LLM-Based Code Generation via Requirements Clarification.
Fangwen Mu; Lin Shi 0006; Song Wang 0009; Zhuohao Yu 0002; Binquan Zhang; Chenxue Wang; Shichao Liu; Qing Wang 0001
FSE2024AI / LLM for SE; Requirements / Modeling / Architecture
Can GPT-4 Replicate Empirical Software Engineering Research?
Jenny T. Liang; Carmen Badea; Christian Bird; Robert DeLine; Denae Ford; Nicole Forsgren; Thomas Zimmermann 0001
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical
COSTELLO: Contrastive Testing for Embedding-Based Large Language Model as a Service Embeddings.
Weipeng Jiang; Juan Zhai; Shiqing Ma; Xiaoyu Zhang 0013; Chao Shen 0001
FSE2024Testing / QA; AI / LLM for SE
Beyond Code Generation: An Observational Study of ChatGPT Usage in Software Engineering Practice.
Ranim Khojah; Mazen Mohamad; Philipp Leitner 0001; Francisco Gomes de Oliveira Neto
FSE2024AI / LLM for SE; Human / Empirical / Socio-technical
An Empirical Study on Focal Methods in Deep-Learning-Based Approaches for Assertion Generation.
Yibo He; Jiaming Huang; Hao Yu 0016; Tao Xie 0001
FSE2024Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical
AI-Assisted Code Authoring at Scale: Fine-Tuning, Deploying, and Mixed Methods Evaluation.
Vijayaraghavan Murali; Chandra Shekhar Maddila; Imad Ahmad; Michael Bolin; Daniel Cheng; Negar Ghorbani; Renuka Fernandez; Nachiappan Nagappan; Peter C. Rigby
FSE2024AI / LLM for SE
A Quantitative and Qualitative Evaluation of LLM-Based Explainable Fault Localization.
Sungmin Kang; Gabin An; Shin Yoo
FSE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
A Miss Is as Good as A Mile: Metamorphic Testing for Deep Learning Operators.
Jinyin Chen; Chengyu Jia 0001; Yunjie Yan; Jie Ge; Haibin Zheng; Yao Cheng 0002
FSE2024Testing / QA; AI / LLM for SE
WaDec: Decompiling WebAssembly Using Large Language Model.
Xinyu She, Yanjie Zhao 0001, Haoyu Wang 0001
ASE2024AI / LLM for SE
Using LLM for Mining and Testing Constraints in API Testing.
Hieu Huynh, Quoc-Tri Le, Tien N. Nguyen, Vu Nguyen 0003
ASE2024Testing / QA; AI / LLM for SE
Using AI to Automate the Modernization of Legacy Software Applications.
Vikram Nitin
ASE2024AI / LLM for SE
Unity Is Strength: Collaborative LLM-Based Agents for Code Reviewer Recommendation.
Luqiao Wang, Yangtao Zhou, Huiying Zhuang, Qingshan Li, Di Cui
ASE2024AI / LLM for SE
UFront: Toward A Unified MLIR Frontend for Deep Learning.
Guoqing Bao, Heng Shi 0005, Chengyi Cui, Yalin Zhang 0004, Jianguo Yao 0002
ASE2024AI / LLM for SE
Trident: Detecting SQL Injection Attacks via Abstract Syntax Tree-based Neural Network.
Yuanlin Li, Zhiwei Xu, Min Zhou 0001, Hai Wan, Xibin Zhao
ASE2024AI / LLM for SE
Towards LLM-augmented multiagent systems for agile software engineering.
Konrad Cinkusz, Jaroslaw A. Chudziak
ASE2024AI / LLM for SE
Three Heads Are Better Than One: Suggesting Move Method Refactoring Opportunities with Inter-class Code Entity Dependency Enhanced Hybrid Hypergraph Neural Network.
Di Cui, Jiaqi Wang, Qiangqiang Wang, Peng Ji, Minglang Qiao
ASE2024AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
The Potential of One-Shot Failure Root Cause Analysis: Collaboration of the Large Language Model and Small Classifier.
Yongqi Han 0001, Qingfeng Du, Ying Huang, Jiaqi Wu, Fulong Tian
ASE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Test-Driven Development and LLM-based Code Generation.
Noble Saji Mathews, Meiyappan Nagappan
ASE2024Testing / QA; AI / LLM for SE
PatchTrack: Analyzing ChatGPT's Impact on Software Patch Decision-Making in Pull Requests.
Daniel Ogenrwot, John Businge
ASE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Mutual Learning-Based Framework for Enhancing Robustness of Code Models via Adversarial Training.
Yangsen Wang, Yizhou Chen, Yifan Zhao, Zhihao Gong, Junjie Chen 0003
ASE2024AI / LLM for SE
Mutation-Based Deep Learning Framework Testing Method in JavaScript Environment.
Yinglong Zou, Juan Zhai, Chunrong Fang, Jiawei Liu, Tao Zheng
ASE2024Testing / QA; AI / LLM for SE
Magneto: A Step-Wise Approach to Exploit Vulnerabilities in Dependent Libraries via LLM-Empowered Directed Fuzzing.
Zhuotong Zhou, Yongzhuo Yang, Susheng Wu, Yiheng Huang, Bihuan Chen 0001
ASE2024Testing / QA; AI / LLM for SE; Security / Privacy / Vulnerability
MLOLET - Machine Learning Optimized Load and Endurance Testing: An industrial experience report.
Arthur Vitui, Tse-Hsun Chen
ASE2024Testing / QA; AI / LLM for SE
Leveraging Large Language Model to Assist Detecting Rust Code Comment Inconsistency.
Yichi Zhang, Zixi Liu, Yang Feng 0003, Baowen Xu
ASE2024AI / LLM for SE
LLM4Workflow: An LLM-based Automated Workflow Model Generation Tool.
Jia Xu 0010, Weilin Du, Xiao Liu 0004, Xuejun Li 0001
ASE2024AI / LLM for SE
LLM-Generated Invariants for Bounded Model Checking Without Loop Unrolling.
Muhammad A. A. Pirzada, Giles Reger, Ahmed Bhayat, Lucas C. Cordeiro
ASE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
LLM-Based Java Concurrent Program to ArkTS Converter.
Runlin Liu, Yuhang Lin, Yunge Hu, Zhe Zhang, Xiang Gao 0012
ASE2024AI / LLM for SE
LLM Meets Bounded Model Checking: Neuro-symbolic Loop Invariant Inference.
Guangyuan Wu, Weining Cao, Yuan Yao 0001, Hengfeng Wei, Taolue Chen 0001
ASE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods
Instructive Code Retriever: Learn from Large Language Model's Feedback for Code Intelligence Tasks.
Jiawei Lu, Haoye Wang, Zhongxin Liu 0002, Keyu Liang, Lingfeng Bao
ASE2024AI / LLM for SE
In-Simulation Testing of Deep Learning Vision Models in Autonomous Robotic Manipulators.
Dmytro Humeniuk, Houssem Ben Braiek, Thomas Reid, Foutse Khomh
ASE2024Testing / QA; AI / LLM for SE
Imperceptible Content Poisoning in LLM-Powered Applications.
Quan Zhang 0003, Chijin Zhou, Gwihwan Go, Binqi Zeng, Heyuan Shi
ASE2024AI / LLM for SE
HITS: High-coverage LLM-based Unit Test Generation via Method Slicing.
Zejun Wang, Kaibo Liu, Ge Li 0001, Zhi Jin 0001
ASE2024Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
Getting Inspiration for Feature Elicitation: App Store- vs. LLM-based Approach.
Jialiang Wei, Anne-Lise Courbis, Thomas Lambolais, Binbin Xu 0002, Pierre-Louis Bernard
ASE2024AI / LLM for SE; Mobile / Web / GUI / Android
FAST: Boosting Uncertainty-based Test Prioritization Methods for Neural Networks via Feature Selection.
Jialuo Chen, Jingyi Wang 0004, Xiyue Zhang 0001, Youcheng Sun, Marta Kwiatkowska
ASE2024Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
Exploring Parameter-Efficient Fine-Tuning of Large Language Model on Automated Program Repair.
Guochang Li, Chen Zhi, Jialiang Chen, Junxiao Han, Shuiguang Deng
ASE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Exploring ChatGPT App Ecosystem: Distribution, Deployment and Security.
Chuan Yan, Ruomai Ren, Mark Huasong Meng, Liuhuo Wan, Tian Yang Ooi
ASE2024AI / LLM for SE; Security / Privacy / Vulnerability; DevOps / CI / Build / Release; Mobile / Web / GUI / Android
Emergence of A Novel Domain Expert: A Generative AI-based Framework for Software Function Point Analysis.
Zheng Zhao, Hongxiang Jiang, Ran Zhao, Bing He
ASE2024AI / LLM for SE
DevMuT: Testing Deep Learning Framework via Developer Expertise-Based Mutation.
Yanzhou Mu, Juan Zhai, Chunrong Fang, Xiang Chen 0005, Zhixiang Cao
ASE2024Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical
Cross-lingual Code Clone Detection: When LLMs Fail Short Against Embedding-based Classifier.
Micheline Bénédicte Moumoula, Abdoul Kader Kaboré, Jacques Klein, Tegawendé F. Bissyandé
ASE2024AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
CoqPilot, a plugin for LLM-based generation of proofs.
Andrei Kozyrev, Gleb Solovev, Nikita Khramov, Anton Podkopaev
ASE2024AI / LLM for SE
ContractTinker: LLM-Empowered Vulnerability Repair for Real-World Smart Contracts.
Che Wang, Jiashuo Zhang 0001, Jianbo Gao 0003, Libin Xia, Zhi Guan
ASE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Constructing Surrogate Models in Machine Learning Using Combinatorial Testing and Active Learning.
Sunny Shree, Krishna Khadka, Yu Lei 0001, Raghu N. Kacker, D. Richard Kuhn
ASE2024Testing / QA; AI / LLM for SE
Coding-PTMs: How to Find Optimal Code Pre-trained Models for Code Embedding in Vulnerability Detection?
Yu Zhao, Lina Gong, Zhiqiu Huang, Yongwei Wang, Mingqiang Wei
ASE2024AI / LLM for SE
ChatBR: Automated assessment and improvement of bug report quality using ChatGPT.
Lili Bo, Wangjie Ji, Xiaobing Sun 0001, Ting Zhang 0011, Xiaoxue Wu 0001
ASE2024AI / LLM for SE
Bridging Gaps in LLM Code Translation: Reducing Errors with Call Graphs and Bridged Debuggers.
Yang Luo, Richard Yu, Fajun Zhang, Ling Liang, Yongqiang Xiong
ASE2024AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
An Empirical Study on Learning-based Techniques for Explicit and Implicit Commit Messages Generation.
Zhiquan Huang, Yuan Huang 0002, Xiangping Chen, Xiaocong Zhou, Changlin Yang
ASE2024AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release
AdvSCanner: Generating Adversarial Smart Contracts to Exploit Reentrancy Vulnerabilities Using LLM and Static Analysis.
Yin Wu, Xiaofei Xie, Chenyang Peng, Dijun Liu, Hao Wu 0100
ASE2024AI / LLM for SE; Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability
AI-driven Java Performance Testing: Balancing Result Quality with Testing Time.
Luca Traini, Federico Di Menna, Vittorio Cortellessa
ASE2024Testing / QA; AI / LLM for SE; Performance / Energy / Reliability
A Pixel-Level Explainable Approach of Convolutional Neural Networks and Its Application.
Haitao Zhang, Jing Wang 0141, Ziyue Wang, Ziyi Zhao, Zhuo Cheng
ASE2024AI / LLM for SE
A Conceptual Framework for Quality Assurance of LLM-based Socio-critical Systems.
Luciano Baresi, Matteo Camilli, Tommaso Dolci, Giovanni Quattrocchi
ASE2024AI / LLM for SE
Understanding and Tackling Label Errors in Deep Learning-Based Vulnerability Detection (Experience Paper).
Xu Nie, Ningke Li, Kailong Wang 0001, Shangguang Wang, Xiapu Luo
ISSTA2023AI / LLM for SE
Towards More Realistic Evaluation for Neural Test Oracle Generation.
Zhongxin Liu 0002, Kui Liu 0001, Xin Xia 0001, Xiaohu Yang 0001
ISSTA2023Testing / QA; AI / LLM for SE
Semantic-Based Neural Network Repair.
Richard Schumi, Jun Sun 0001
ISSTA2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Quantitative Robustness Analysis of Neural Networks.
Mara Downing
ISSTA2023AI / LLM for SE
In Defense of Simple Techniques for Neural Network Test Case Selection.
Shenglin Bao, Chaofeng Sha, Bihuan Chen 0001, Xin Peng 0001, Wenyun Zhao
ISSTA2023Testing / QA; AI / LLM for SE
Improving Binary Code Similarity Transformer Models by Semantics-Driven Instruction Deemphasis.
Xiangzhe Xu, Shiwei Feng 0002, Yapeng Ye, Guangyu Shen, Zian Su
ISSTA2023AI / LLM for SE
How Effective Are Neural Networks for Fixing Security Vulnerabilities.
Yi Wu 0023, Nan Jiang 0012, Hung Viet Pham, Thibaud Lutellier, Jordan Davis
ISSTA2023AI / LLM for SE; Security / Privacy / Vulnerability
Fuzzing Deep Learning Compilers with HirGen.
Haoyang Ma, Qingchao Shen, Yongqiang Tian 0001, Junjie Chen 0003, Shing-Chi Cheung
ISSTA2023Testing / QA; AI / LLM for SE
DyCL: Dynamic Neural Network Compilation Via Program Rewriting and Graph Optimization.
Simin Chen, Shiyi Wei, Cong Liu 0005, Wei Yang 0013
ISSTA2023AI / LLM for SE; Performance / Energy / Reliability
Detecting Condition-Related Bugs with Control Flow Graph Neural Network.
Jian Zhang 0087, Xu Wang 0007, Hongyu Zhang 0002, Hailong Sun 0001, Xudong Liu 0001
ISSTA2023AI / LLM for SE
DeepAtash: Focused Test Generation for Deep Learning Systems.
Tahereh Zohdinasab, Vincenzo Riccio, Paolo Tonella
ISSTA2023Testing / QA; AI / LLM for SE
CoopHance: Cooperative Enhancement for Robustness of Deep Learning Systems.
Quan Zhang 0003, Yongqiang Tian 0001, Yifeng Ding, Shanshan Li 0001, Chengnian Sun
ISSTA2023AI / LLM for SE
COME: Commit Message Generation with Modification Embedding.
Yichen He, Liran Wang, Kaiyi Wang, Yupeng Zhang, Hang Zhang
ISSTA2023AI / LLM for SE; DevOps / CI / Build / Release
An Empirical Study on the Effects of Obfuscation on Static Machine Learning-Based Malicious JavaScript Detectors.
Kunlun Ren, Weizhong Qiang, Yueming Wu 0001, Yi Zhou, Deqing Zou
ISSTA2023AI / LLM for SE; Human / Empirical / Socio-technical
ACETest: Automated Constraint Extraction for Testing Deep Learning Operators.
Jingyi Shi, Yang Xiao 0011, Yuekang Li, Yeting Li, Dongsong Yu
ISSTA2023Testing / QA; AI / LLM for SE
When and Why Test Generators for Deep Learning Produce Invalid Inputs: an Empirical Study.
Vincenzo Riccio, Paolo Tonella
ICSE2023Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical
VULGEN: Realistic Vulnerability Generation Via Pattern Mining and Deep Learning.
Yu Nong, Yuzhe Ou, Michael Pradel, Feng Chen 0001, Haipeng Cai
ICSE2023AI / LLM for SE
Two Sides of the Same Coin: Exploiting the Impact of Identifiers in Neural Code Comprehension.
Shuzheng Gao, Cuiyun Gao 0001, Chaozheng Wang, Jun Sun 0001, David Lo 0001
ICSE2023AI / LLM for SE; Education / Program Comprehension
Towards Understanding Fairness and its Composition in Ensemble Machine Learning.
Usman Gohar, Sumon Biswas, Hridesh Rajan
ICSE2023AI / LLM for SE
The Road Toward Dependable AI Based Systems.
Paolo Tonella
ICSE2023AI / LLM for SE
Template-based Neural Program Repair.
Xiangxin Meng, Xu Wang 0007, Hongyu Zhang 0002, Hailong Sun 0001, Xudong Liu 0001
ICSE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Tare: Type-Aware Neural Program Repair.
Qihao Zhu, Zeyu Sun 0004, Wenjie Zhang 0007, Yingfei Xiong 0001, Lu Zhang 0023
ICSE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods
Revisiting Learning-based Commit Message Generation.
Jinhao Dong, Yiling Lou, Dan Hao 0001, Lin Tan 0001
ICSE2023AI / LLM for SE; DevOps / CI / Build / Release
Reusing Deep Neural Network Models through Model Re-engineering.
Binhang Qi, Hailong Sun 0001, Xiang Gao 0012, Hongyu Zhang 0002, Zhaotian Li
ICSE2023AI / LLM for SE
Reliability Assurance for Deep Neural Network Architectures Against Numerical Defects.
Linyi Li 0001, Yuhao Zhang 0005, Luyao Ren, Yingfei Xiong 0001, Tao Xie 0001
ICSE2023AI / LLM for SE; Performance / Energy / Reliability
Regression Fuzzing for Deep Learning Systems.
Hanmo You, Zan Wang, Junjie Chen 0003, Shuang Liu 0007, Shuochuan Li
ICSE2023Testing / QA; AI / LLM for SE
On-Demand Security Requirements Synthesis with Relational Generative Adversarial Networks.
Viktoria Koscinski, Sara Hashemi, Mehdi Mirakhorli
ICSE2023AI / LLM for SE; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture
Leveraging Feature Bias for Scalable Misprediction Explanation of Machine Learning Models.
Jiri Gesi, Xinyun Shen, Yunfan Geng, Qihong Chen, Iftekhar Ahmed 0001
ICSE2023AI / LLM for SE
Large Language Models are Few-shot Testers: Exploring LLM-based General Bug Reproduction.
Sungmin Kang, Juyeon Yoon, Shin Yoo
ICSE2023Testing / QA; AI / LLM for SE
Information-Theoretic Testing and Debugging of Fairness Defects in Deep Neural Networks.
Verya Monjezi, Ashutosh Trivedi 0001, Gang Tan, Saeid Tizpaz-Niari
ICSE2023Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Fairify: Fairness Verification of Neural Networks.
Sumon Biswas, Hridesh Rajan
ICSE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
Explaining Software Bugs Leveraging Code Structures in Neural Machine Translation.
Parvez Mahbub, Ohiduzzaman Shuvo, Mohammad Masudur Rahman 0001
ICSE2023AI / LLM for SE
Enhancing Deep Learning-based Vulnerability Detection by Building Behavior Graph Model.
Bin Yuan, Yifan Lu, Yilin Fang, Yueming Wu 0001, Deqing Zou
ICSE2023AI / LLM for SE; DevOps / CI / Build / Release
Does data sampling improve deep learning-based vulnerability detection? Yeas! and Nays!
Xu Yang, Shaowei Wang 0002, Yi Li 0048, Shaohua Wang 0002
ICSE2023AI / LLM for SE
DeepVD: Toward Class-Separation Features for Neural Network Vulnerability Detection.
Wenbo Wang, Tien N. Nguyen, Shaohua Wang 0002, Yi Li 0048, Jiyuan Zhang
ICSE2023AI / LLM for SE
DeepArc: Modularizing Neural Networks for the Model Maintenance.
Xiaoning Ren, Yun Lin 0001, Yinxing Xue, Ruofan Liu, Jun Sun 0001
ICSE2023AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Decomposing a Recurrent Neural Network into Modules for Enabling Reusability and Replacement.
Sayem Mohammad Imtiaz, Fraol Batole, Astha Singh, Rangeet Pan, Breno Dantas Cruz
ICSE2023AI / LLM for SE
DLInfer: Deep Learning with Static Slicing for Python Type Inference.
Yanyan Yan, Yang Feng 0003, Hongcheng Fan, Baowen Xu
ICSE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
CCRep: Learning Code Change Representations via Pre-Trained Code Model and Query Back.
Zhongxin Liu 0002, Zhijie Tang, Xin Xia 0001, Xiaohu Yang 0001
ICSE2023AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
CC: Causality-Aware Coverage Criterion for Deep Neural Networks.
Zhenlan Ji, Pingchuan Ma 0004, Yuanyuan Yuan 0001, Shuai Wang 0011
ICSE2023Testing / QA; AI / LLM for SE
Balancing Effectiveness and Flakiness of Non-Deterministic Machine Learning Tests.
Chunqiu Steven Xia, Saikat Dutta 0001, Sasa Misailovic, Darko Marinov, Lingming Zhang 0001
ICSE2023Testing / QA; AI / LLM for SE
Aries: Efficient Testing of Deep Neural Networks via Labeling-Free Accuracy Estimation.
Qiang Hu, Yuejun Guo 0001, Xiaofei Xie, Maxime Cordy, Mike Papadakis
ICSE2023Testing / QA; AI / LLM for SE
An Empirical Study of Pre-Trained Model Reuse in the Hugging Face Deep Learning Model Registry.
Wenxin Jiang 0001, Nicholas Synovic, Matt Hyatt, Taylor R. Schorlemmer, Rohan Sethi
ICSE2023AI / LLM for SE; Human / Empirical / Socio-technical
An Empirical Study of Deep Learning Models for Vulnerability Detection.
Benjamin Steenhoek, Md Mahbubur Rahman, Richard Jiles, Wei Le
ICSE2023AI / LLM for SE; Human / Empirical / Socio-technical
AI-based Question Answering Assistance for Analyzing Natural-language Requirements.
Saad Ezzini, Sallam Abualhaija, Chetan Arora 0002, Mehrdad Sabetzadeh
ICSE2023AI / LLM for SE; Requirements / Modeling / Architecture
A Comprehensive Study of Real-World Bugs in Machine Learning Model Optimization.
Hao Guan 0001, Ying Xiao, Jiaying Li 0001, Yepang Liu 0001, Guangdong Bai
ICSE2023AI / LLM for SE; Human / Empirical / Socio-technical; Performance / Energy / Reliability
TransMap: Pinpointing Mistakes in Neural Code Translation.
Bo Wang 0146, Ruishi Li, Mingkai Li, Prateek Saxena
FSE2023AI / LLM for SE
Towards Feature-Based Analysis of the Machine Learning Development Lifecycle.
Boyue Caroline Hu, Marsha Chechik
FSE2023AI / LLM for SE
Towards AI-Driven Software Development: Challenges and Lessons from the Field (Keynote).
Eran Yahav
FSE2023AI / LLM for SE
Revisiting Neural Program Smoothing for Fuzzing.
Maria-Irina Nicolae, Max Eisele, Andreas Zeller
FSE2023Testing / QA; AI / LLM for SE
Recommending Analogical APIs via Knowledge Graph Embedding.
Mingwei Liu 0002, Yanjun Yang, Yiling Lou, Xin Peng 0001, Zhong Zhou
FSE2023AI / LLM for SE
On Using Information Retrieval to Recommend Machine Learning Good Practices for Software Engineers.
Laura Cabra-Acela, Anamaria Mojica-Hanke, Mario Linares-Vásquez, Steffen Herbold
FSE2023AI / LLM for SE
Neural-Based Test Oracle Generation: A Large-Scale Evaluation and Lessons Learned.
Soneya Binta Hossain, Antonio Filieri, Matthew B. Dwyer, Sebastian G. Elbaum, Willem Visser
FSE2023Testing / QA; AI / LLM for SE
LLM-Based Code Generation Method for Golang Compiler Testing.
Qiuhan Gu
FSE2023Testing / QA; AI / LLM for SE
Knowledge-Based Version Incompatibility Detection for Deep Learning.
Zhongkai Zhao, Bonan Kou, Mohamed Yilmaz Ibrahim, Muhao Chen 0001, Tianyi Zhang 0001
FSE2023AI / LLM for SE
Efficient Text-to-Code Retrieval with Cascaded Fast and Slow Transformer Models.
Akhilesh Deepak Gotmare, Junnan Li 0001, Shafiq Joty, Steven C. H. Hoi
FSE2023AI / LLM for SE
Dynamic Data Fault Localization for Deep Neural Networks.
Yining Yin, Yang Feng 0003, Shihao Weng, Zixi Liu, Yuan Yao 0001
FSE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
DistXplore: Distribution-Guided Testing for Evaluating and Enhancing Deep Learning Systems.
Longtian Wang, Xiaofei Xie, Xiaoning Du 0001, Meng Tian, Qing Guo 0005
FSE2023Testing / QA; AI / LLM for SE
Detecting Overfitting of Machine Learning Techniques for Automatic Vulnerability Detection.
Niklas Risse
FSE2023AI / LLM for SE
Design by Contract for Deep Learning APIs.
Shibbir Ahmed, Sayem Mohammad Imtiaz, Syeda Khairunnesa Samantha, Breno Dantas Cruz, Hridesh Rajan
FSE2023AI / LLM for SE; Requirements / Modeling / Architecture
Demystifying Dependency Bugs in Deep Learning Stack.
Kaifeng Huang 0001, Bihuan Chen 0001, Susheng Wu, Junming Cao, Lei Ma 0003
FSE2023AI / LLM for SE
DeepRover: A Query-Efficient Blackbox Attack for Deep Neural Networks.
Fuyuan Zhang, Xinwen Hu, Lei Ma 0003, Jianjun Zhao 0001
FSE2023AI / LLM for SE; Security / Privacy / Vulnerability
Deep Learning Based Feature Envy Detection Boosted by Real-World Examples.
Bo Liu 0094, Hui Liu 0003, Guangjie Li, Nan Niu, Zimao Xu
FSE2023AI / LLM for SE
DeMinify: Neural Variable Name Recovery and Type Inference.
Yi Li 0048, Aashish Yadavally, Jiaxing Zhang 0002, Shaohua Wang 0002, Tien N. Nguyen
FSE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
DENT: A Tool for Tagging Stack Overflow Posts with Deep Learning Energy Patterns.
Shriram Shanbhag, Sridhar Chimalakonda, Vibhu Saujanya Sharma, Vikrant Kaulgud
FSE2023AI / LLM for SE; Performance / Energy / Reliability
Compatibility Issues in Deep Learning Systems: Problems and Opportunities.
Jun Wang 0167, Guanping Xiao, Shuai Zhang 0046, Huashan Lei, Yepang Liu 0001
FSE2023AI / LLM for SE
Commit-Level, Neural Vulnerability Detection and Assessment.
Yi Li 0048, Aashish Yadavally, Jiaxing Zhang 0002, Shaohua Wang 0002, Tien N. Nguyen
FSE2023AI / LLM for SE; DevOps / CI / Build / Release
CodeMark: Imperceptible Watermarking for Code Datasets against Neural Code Completion Models.
Zhensu Sun, Xiaoning Du 0001, Fu Song, Li Li 0029
FSE2023AI / LLM for SE
Can Machine Learning Pipelines Be Better Configured?
Yibo Wang 0008, Ying Wang 0038, Tingwei Zhang, Yue Yu 0001, Shing-Chi Cheung
FSE2023AI / LLM for SE
BiasAsker: Measuring the Bias in Conversational AI System.
Yuxuan Wan, Wenxuan Wang 0001, Pinjia He, Jiazhen Gu, Haonan Bai
FSE2023AI / LLM for SE
Benchmarking Robustness of AI-Enabled Multi-sensor Fusion Systems: Challenges and Opportunities.
Xinyu Gao, Zhijie Wang 0014, Yang Feng 0003, Lei Ma 0003, Zhenyu Chen 0001
FSE2023AI / LLM for SE
Assisting Static Analysis with Large Language Models: A ChatGPT Experiment.
Haonan Li 0009, Yu Hao 0006, Yizhuo Zhai, Zhiyun Qian
FSE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
A Generative and Mutational Approach for Synthesizing Bug-Exposing Test Cases to Guide Compiler Fuzzing.
Guixin Ye, Tianmin Hu, Zhanyong Tang, Zhenye Fan, Shin Hwei Tan
FSE2023Testing / QA; AI / LLM for SE
Using Deep Learning to Automatically Improve Code Readability.
Antonio Vitale, Valentina Piantadosi, Simone Scalabrino, Rocco Oliveto
ASE2023AI / LLM for SE; Education / Program Comprehension
Unifying Defect Prediction, Categorization, and Repair by Multi-Task Deep Learning.
Chao Ni 0001, Kaiwen Yang, Yan Zhu, Xiang Chen 0005, Xiaohu Yang 0001
ASE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Towards Self-Adaptive Machine Learning-Enabled Systems Through QoS-Aware Model Switching.
Shubham Kulkarni, Arya Marda, Karthik Vaidhyanathan
ASE2023AI / LLM for SE
Towards Safe Automated Refactoring of Imperative Deep Learning Programs to Graph Execution.
Raffi Khatchadourian, Tatiana Castro Vélez, Mehdi Bagherzadeh 0001, Nan Jia, Anita Raja
ASE2023AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Semantic Data Augmentation for Deep Learning Testing Using Generative AI.
Sondess Missaoui, Simos Gerasimou, Nicholas Matragkas
ASE2023Testing / QA; AI / LLM for SE
Robin: A Novel Method to Produce Robust Interpreters for Deep Learning-Based Code Classifiers.
Zhen Li 0027, Ruqian Zhang, Deqing Zou, Ning Wang 0098, Yating Li
ASE2023AI / LLM for SE; Performance / Energy / Reliability
On the Evaluation of Neural Code Translation: Taxonomy and Benchmark.
Mingsheng Jiao, Tingrui Yu, Xuan Li, Guanjie Qiu, Xiaodong Gu 0002
ASE2023AI / LLM for SE
Nuances are the Key: Unlocking ChatGPT to Find Failure-Inducing Tests with Differential Prompting.
Tsz On Li, Wenxi Zong, Yibo Wang 0008, Haoye Tian, Ying Wang 0038
ASE2023Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Neural SZZ Algorithm.
Lingxiao Tang, Lingfeng Bao, Xin Xia 0001, Zhongdong Huang
ASE2023AI / LLM for SE
Mutation-based Fault Localization of Deep Neural Networks.
Ali Ghanbari 0001, Deepak-George Thomas, Muhammad Arbab Arshad, Hridesh Rajan
ASE2023Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Log Parsing: How Far Can ChatGPT Go?
Van-Hoang Le, Hongyu Zhang 0002
ASE2023AI / LLM for SE
Let's Chat to Find the APIs: Connecting Human, LLM and Knowledge Graph through AI Chain.
Qing Huang, Zhenyu Wan, Zhenchang Xing, Changjing Wang, Jieshan Chen
ASE2023AI / LLM for SE; Human / Empirical / Socio-technical
Identify and Update Test Cases When Production Code Changes: A Transformer-Based Approach.
Xing Hu 0008, Zhuang Liu, Xin Xia 0001, Zhongxin Liu 0002, Tongtong Xu
ASE2023Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
How to Train Your Neural Bug Detector: Artificial vs Real Bugs.
Cedric Richter, Heike Wehrheim
ASE2023AI / LLM for SE
HOBAT: Batch Verification for Homogeneous Structural Neural Networks.
Jingyang Li, Guoqiang Li 0001
ASE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
Green AI Quotient: Assessing Greenness of AI-based software and the way forward.
Samarth Sikand, Vibhu Saujanya Sharma, Vikrant Kaulgud, Sanjay Podder
ASE2023AI / LLM for SE
Generative Type Inference for Python.
Yun Peng 0003, Chaozheng Wang, Wenxuan Wang 0001, Cuiyun Gao 0001, Michael R. Lyu
ASE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
Generative Model-Based Testing on Decision-Making Policies.
Zhuo Li 0021, Xiongfei Wu, Derui Zhu, Mingfei Cheng, Siyuan Chen
ASE2023Testing / QA; AI / LLM for SE
From Misuse to Mastery: Enhancing Code Generation with Knowledge-Driven AI Chaining.
Xiaoxue Ren, Xinyuan Ye, Dehai Zhao, Zhenchang Xing, Xiaohu Yang 0001
ASE2023AI / LLM for SE
Fixing Privilege Escalations in Cloud Access Control with MaxSAT and Graph Neural Networks.
Yang Hu, Wenxi Wang, Sarfraz Khurshid, Kenneth L. McMillan, Mohit Tiwari
ASE2023AI / LLM for SE; Cloud / Microservices / Distributed Systems
Fine-Grained In-Context Permission Classification for Android Apps Using Control-Flow Graph Embedding.
Vikas Kumar Malviya, Yan Naing Tun, Chee Wei Leow, Ailys Tee Xynyn, Lwin Khin Shar
ASE2023AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Fault Localization for Buggy Deep Learning Framework Conversions in Image Recognition.
Nikolaos Louloudakis, Perry Gibson, José Cano 0001, Ajitha Rajan
ASE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Expediting Neural Network Verification via Network Reduction.
Yuyi Zhong, Ruiwei Wang, Siau-Cheng Khoo
ASE2023AI / LLM for SE; Program Analysis / Verification / Formal Methods
Dynamic Graph Neural Networks-Based Alert Link Prediction for Online Service Systems.
Yiru Chen, Chenxi Zhang 0003, Zhen Dong, Dingyu Yang, Xin Peng 0001
ASE2023AI / LLM for SE
CertPri: Certifiable Prioritization for Deep Neural Networks via Movement Cost in Feature Space.
Haibin Zheng, Jinyin Chen, Haibo Jin
ASE2023AI / LLM for SE; Performance / Energy / Reliability
Causality-Aided Trade-Off Analysis for Machine Learning Fairness.
Zhenlan Ji, Pingchuan Ma 0004, Shuai Wang 0011, Yanhui Li
ASE2023AI / LLM for SE
Bridging the Gap Between Academia and Industry in Machine Learning Software Defect Prediction: Thirteen Considerations.
Szymon Stradowski, Lech Madeyski
ASE2023AI / LLM for SE
Better Patching Using LLM Prompting, via Self-Consistency.
Toufique Ahmed, Premkumar T. Devanbu
ASE2023AI / LLM for SE
Are We Ready to Embrace Generative AI for Software Q&A?
Bowen Xu, Thanh-Dat Nguyen, Thanh Le-Cong, Thong Hoang, Jiakun Liu
ASE2023AI / LLM for SE
An Energy-Aware Approach to Design Self-Adaptive AI-based Applications on the Edge.
Alessandro Tundo, Marco Mobilio, Shashikant Ilager, Ivona Brandic, Ezio Bartocci
ASE2023AI / LLM for SE; Requirements / Modeling / Architecture; Performance / Energy / Reliability
A Majority Invariant Approach to Patch Robustness Certification for Deep Learning Models.
Qilin Zhou, Zhengyuan Wei, Haipeng Wang 0005, W. K. Chan 0001
ASE2023AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods
A Comparative Study of Transformer-Based Neural Text Representation Techniques on Bug Triaging.
Atish Kumar Dipongkor, Kevin Moran
ASE2023AI / LLM for SE; Human / Empirical / Socio-technical
A Closer Look at Different Difficulty Levels Code Generation Abilities of ChatGPT.
Dapeng Yan, Zhipeng Gao 0002, Zhiming Liu 0001
ASE2023AI / LLM for SE
ε-weakened robustness of deep neural networks.
Pei Huang 0002, Yuting Yang 0002, Minghao Liu 0001, Fuqi Jia, Feifei Ma
ISSTA2022AI / LLM for SE
jTrans: jump-aware transformer for binary code similarity detection.
Hao Wang 0226, Wenjie Qu 0001, Gilad Katz, Wenyu Zhu, Zeyu Gao
ISSTA2022AI / LLM for SE
The raise of machine learning hyperparameter constraints in Python code.
Ingkarat Rak-amnouykit, Ana L. Milanova, Guillaume Baudart, Martin Hirzel, Julian Dolby
ISSTA2022AI / LLM for SE
Simple techniques work surprisingly well for neural network test prioritization and active learning (replicability study).
Michael Weiss 0004, Paolo Tonella
ISSTA2022Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release
Path-sensitive code embedding via contrastive learning for software vulnerability detection.
Xiao Cheng 0002, Guanqin Zhang, Haoyu Wang 0001, Yulei Sui
ISSTA2022AI / LLM for SE
HybridRepair: towards annotation-efficient repair for deep learning models.
Yu Li 0007, Muxi Chen, Qiang Xu 0001
ISSTA2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
DocTer: documentation-guided fuzzing for testing deep learning API functions.
Danning Xie, Yitong Li, Mijung Kim, Hung Viet Pham, Lin Tan 0001
ISSTA2022Testing / QA; AI / LLM for SE
BET: black-box efficient testing for convolutional neural networks.
Jialai Wang, Han Qiu 0001, Yi Rong, Hengkai Ye, Qi Li 0002
ISSTA2022Testing / QA; AI / LLM for SE
ASRTest: automated testing for deep-neural-network-driven speech recognition systems.
Pin Ji, Yang Feng 0003, Jia Liu 0008, Zhihong Zhao, Zhenyu Chen 0001
ISSTA2022Testing / QA; AI / LLM for SE
Using Deep Learning to Generate Complete Log Statements.
Antonio Mastropaolo, Luca Pascarella, Gabriele Bavota
ICSE2022AI / LLM for SE
Unleashing the Power of Compiler Intermediate Representation to Enhance Neural Program Embeddings.
Zongjie Li, Pingchuan Ma 0004, Huaijin Wang 0001, Shuai Wang 0011, Qiyi Tang 0003
ICSE2022AI / LLM for SE
Type4Py: Practical Deep Similarity Learning-Based Type Inference for Python.
Amir M. Mir, Evaldas Latoskinas, Sebastian Proksch 0001, Georgios Gousios
ICSE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods
Training Data Debugging for the Fairness of Machine Learning Software.
Yanhui Li, Linghan Meng, Lin Chen 0015, Li Yu 0008, Di Wu 0014
ICSE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Towards Training Reproducible Deep Learning Models.
Boyuan Chen 0002, Mingzhi Wen, Yong Shi 0010, Dayi Lin, Gopi Krishnan Rajbahadur
ICSE2022AI / LLM for SE
TOGA: A Neural Method for Test Oracle Generation.
Elizabeth Dinella, Gabriel Ryan, Todd Mytkowicz, Shuvendu K. Lahiri
ICSE2022Testing / QA; AI / LLM for SE
Static Inference Meets Deep learning: A Hybrid Type Inference Approach for Python.
Yun Peng 0003, Cuiyun Gao 0001, Zongjie Li, Bowei Gao, David Lo 0001
ICSE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods
Semantic Image Fuzzing of AI Perception Systems.
Trey Woodlief, Sebastian G. Elbaum, Kevin Sullivan
ICSE2022Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical
SAPIENTML: Synthesizing Machine Learning Pipelines by Learning from Human-Written Solutions.
Ripon K. Saha, Akira Ura, Sonal Mahajan, Chenguang Zhu 0002, Linyi Li 0001
ICSE2022AI / LLM for SE; Human / Empirical / Socio-technical
REFTY: Refinement Types for Valid Deep Learning Models.
Yanjie Gao, Zhengxian Li, Haoxiang Lin, Hongyu Zhang 0002, Ming Wu 0007
ICSE2022AI / LLM for SE
PROMAL: Precise Window Transition Graphs for Android via Synergy of Program Analysis and Machine Learning.
Changlin Liu, Hanlin Wang, Tianming Liu 0002, Diandian Gu, Yun Ma 0002
ICSE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods; Mobile / Web / GUI / Android
On the Importance of Building High-quality Training Datasets for Neural Code Search.
Zhensu Sun, Li Li 0091, Yan Liu, Xiaoning Du 0001, Li Li 0029
ICSE2022AI / LLM for SE; DevOps / CI / Build / Release
On the Evaluation of Neural Code Summarization.
Ensheng Shi, Yanlin Wang 0001, Lun Du, Junjie Chen 0003, Shi Han
ICSE2022AI / LLM for SE
Neural Program Repair with Execution-based Backpropagation.
He Ye, Matias Martinez, Martin Monperrus
ICSE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Muffin: Testing Deep Learning Libraries via Neural Architecture Fuzzing.
Jiazhen Gu, Xuchuan Luo, Yangfan Zhou 0002, Xin Wang 0002
ICSE2022Testing / QA; AI / LLM for SE; Requirements / Modeling / Architecture
MVD: Memory-Related Vulnerability Detection Based on Flow-Sensitive Graph Neural Networks.
Sicong Cao, Xiaobing Sun 0001, Lili Bo, Rongxin Wu, Bin Li 0006
ICSE2022AI / LLM for SE
Log-based Anomaly Detection with Deep Learning: How Far Are We?
Van-Hoang Le, Hongyu Zhang 0002
ICSE2022AI / LLM for SE; Cloud / Microservices / Distributed Systems
Green AI: Do Deep Learning Frameworks Have Different Costs?
Stefanos Georgiou, Maria Kechagia, Tushar Sharma 0001, Federica Sarro, Ying Zou 0001
ICSE2022AI / LLM for SE
Fairneuron: Improving Deep Neural Network Fairness with Adversary Games on Selective Neurons.
Xuanqi Gao, Juan Zhai, Shiqing Ma, Chao Shen 0001, Yufei Chen 0001
ICSE2022AI / LLM for SE
Fairness-aware Configuration of Machine Learning Libraries.
Saeid Tizpaz-Niari, Ashish Kumar, Gang Tan, Ashutosh Trivedi 0001
ICSE2022AI / LLM for SE; DevOps / CI / Build / Release
ExAIS: Executable AI Semantics.
Richard Schumi, Jun Sun 0001
ICSE2022AI / LLM for SE
Evaluating and Improving Neural Program-Smoothing-based Fuzzing.
Mingyuan Wu, Ling Jiang, Jiahong Xiang, Yuqun Zhang, Guowei Yang 0001
ICSE2022Testing / QA; AI / LLM for SE
EREBA: Black-box Energy Testing of Adaptive Neural Networks.
Mirazul Haque, Yaswanth Yadlapalli, Wei Yang 0013, Cong Liu 0005
ICSE2022Testing / QA; AI / LLM for SE; Performance / Energy / Reliability
EAGLE: Creating Equivalent Graphs to Test Deep Learning Libraries.
Jiannan Wang 0002, Thibaud Lutellier, Shangshu Qian, Hung Viet Pham, Lin Tan 0001
ICSE2022Testing / QA; AI / LLM for SE
DeepTraLog: Trace-Log Combined Microservice Anomaly Detection through Graph-based Deep Learning.
Chenxi Zhang 0003, Xin Peng 0001, Chaofeng Sha, Ke Zhang, Zhenqing Fu
ICSE2022AI / LLM for SE; Cloud / Microservices / Distributed Systems
DeepState: Selecting Test Suites to Enhance the Robustness of Recurrent Neural Networks.
Zixi Liu, Yang Feng 0003, Yining Yin, Zhenyu Chen 0001
ICSE2022Testing / QA; AI / LLM for SE
DeepStability: A Study of Unstable Numerical Methods and Their Solutions in Deep Learning.
Eliska Kloberdanz, Kyle G. Kloberdanz, Wei Le
ICSE2022AI / LLM for SE; Human / Empirical / Socio-technical
DeepFD: Automated Fault Diagnosis and Localization for Deep Learning Programs.
Jialun Cao, Meiziniu Li, Xiao Chen 0026, Ming Wen 0001, Yongqiang Tian 0001
ICSE2022AI / LLM for SE
DeepDiagnosis: Automatically Diagnosing Faults and Recommending Actionable Fixes in Deep Learning Programs.
Mohammad Wardat, Breno Dantas Cruz, Wei Le, Hridesh Rajan
ICSE2022AI / LLM for SE
Decomposing Convolutional Neural Networks into Reusable and Replaceable Modules.
Rangeet Pan, Hridesh Rajan
ICSE2022AI / LLM for SE
DEAR: A Novel Deep Learning-based Approach for Automated Program Repair.
Yi Li 0048, Shaohua Wang 0002, Tien N. Nguyen
ICSE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Causality-Based Neural Network Repair.
Bing Sun, Jun Sun 0001, Long H. Pham, Tie Shi
ICSE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Automated Testing of Software that Uses Machine Learning APIs.
Chengcheng Wan 0001, Shicheng Liu, Sophie Xie, Yifan Liu, Henry Hoffmann
ICSE2022Testing / QA; AI / LLM for SE
Automated Assertion Generation via Information Retrieval and Its Integration with Deep learning.
Hao Yu 0016, Yiling Lou, Ke Sun 0017, Dezhi Ran, Tao Xie 0001
ICSE2022Testing / QA; AI / LLM for SE
An Exploratory Study of Deep learning Supply Chain.
Xin Tan 0003, Kai Gao 0008, Minghui Zhou 0001, Li Zhang 0029
ICSE2022AI / LLM for SE; Human / Empirical / Socio-technical
Adaptive Test Selection for Deep Neural Networks.
Xinyu Gao, Yang Feng 0003, Yining Yin, Zixi Liu, Zhenyu Chen 0001
ICSE2022Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
You see what I want you to see: poisoning vulnerabilities in neural code search.
Yao Wan 0001, Shijie Zhang, Hongyu Zhang 0002, Yulei Sui, Guandong Xu
FSE2022AI / LLM for SE
Using graph neural networks for program termination.
Yoav Alon, Cristina David
FSE2022AI / LLM for SE
Understanding performance problems in deep learning systems.
Junming Cao, Bihuan Chen 0001, Chao Sun, Longjie Hu, Shuaihong Wu
FSE2022AI / LLM for SE; Performance / Energy / Reliability
Testing of machine learning models with limited samples: an industrial vacuum pumping application.
Ayan Chatterjee, Bestoun S. Ahmed, Erik Hallin, Anton Engman
FSE2022Testing / QA; AI / LLM for SE
Semi-supervised pre-processing for learning-based traceability framework on real-world software projects.
Liming Dong 0001, He Zhang 0001, Wei Liu, Zhiluo Weng, Hongyu Kuang
FSE2022AI / LLM for SE; Requirements / Modeling / Architecture
RULER: discriminative and iterative adversarial training for deep neural network fairness.
Guanhong Tao 0001, Weisong Sun, Tingxu Han, Chunrong Fang, Xiangyu Zhang 0001
FSE2022AI / LLM for SE
Program merge conflict resolution via neural transformers.
Alexey Svyatkovskiy, Sarah Fakhoury, Negar Ghorbani, Todd Mytkowicz, Elizabeth Dinella
FSE2022AI / LLM for SE
On-the-fly syntax highlighting using neural networks.
Marco Edoardo Palma, Pasquale Salza, Harald C. Gall
FSE2022AI / LLM for SE
Neural termination analysis.
Mirco Giacobbe, Daniel Kroening, Julian Parsert
FSE2022AI / LLM for SE
NeuDep: neural binary memory dependence analysis.
Kexin Pei, Dongdong She, Michael Wang, Scott Geng, Zhou Xuan
FSE2022AI / LLM for SE
NatGen: generative pre-training by "naturalizing" source code.
Saikat Chakraborty 0001, Toufique Ahmed, Yangruibo Ding, Premkumar T. Devanbu, Baishakhi Ray
FSE2022AI / LLM for SE
NMTSloth: understanding and testing efficiency degradation of neural machine translation systems.
Simin Chen, Cong Liu 0005, Mirazul Haque, Zihe Song, Wei Yang 0013
FSE2022Testing / QA; AI / LLM for SE; Performance / Energy / Reliability
MpBP: verifying robustness of neural networks with multi-path bound propagation.
Ye Zheng, Jiaxiang Liu 0001, Xiaomu Shi
FSE2022AI / LLM for SE
Machine learning and natural language processing for automating software testing (tutorial).
Mauro Pezzè
FSE2022Testing / QA; AI / LLM for SE
MAAT: a novel ensemble approach to addressing fairness and performance bugs for machine learning software.
Zhenpeng Chen, Jie M. Zhang, Federica Sarro, Mark Harman
FSE2022AI / LLM for SE; Performance / Energy / Reliability
Generating realistic vulnerabilities via neural code editing: an empirical study.
Yu Nong, Yuzhe Ou, Michael Pradel, Feng Chen 0001, Haipeng Cai
FSE2022AI / LLM for SE; Human / Empirical / Socio-technical
Effective and scalable fault injection using bug reports and generative language models.
Ahmed Khanfir
FSE2022AI / LLM for SE
Discrepancies among pre-trained deep neural networks: a new threat to model zoo reliability.
Diego Montes, Pongpatapee Peerapatanapokin, Jeff Schultz, Chengjun Guo, Wenxin Jiang 0001
FSE2022AI / LLM for SE; Performance / Energy / Reliability
DeepDev-PERF: a deep learning-based approach for improving software performance.
Spandan Garg, Roshanak Zilouchian Moghaddam, Colin B. Clement, Neel Sundaresan, Chen Wu
FSE2022AI / LLM for SE; Performance / Energy / Reliability
AutoPruner: transformer-based call graph pruning.
Thanh Le-Cong, Hong Jin Kang, Truong Giang Nguyen, Stefanus Agus Haryono, David Lo 0001
FSE2022AI / LLM for SE
An empirical study of deep transfer learning-based program repair for Kotlin projects.
Misoo Kim, Youngkyoung Kim, Hohyeon Jeong, Jinseok Heo, Sungoh Kim
FSE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical
API recommendation for machine learning libraries: how far are we?
Moshi Wei, Yuchao Huang, Junjie Wang 0001, Jiho Shin, Nima Shiri Harzevili
FSE2022AI / LLM for SE
AI-assisted programming: applications, user experiences, and neuro-symbolic techniques (keynote).
Sumit Gulwani
FSE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods
23 shades of self-admitted technical debt: an empirical study on machine learning software.
David O'Brien, Sumon Biswas, Sayem Imtiaz, Rabe Abdalkareem, Emad Shihab
FSE2022AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Towards Understanding the Faults of JavaScript-Based Deep Learning Systems.
Lili Quan, Qianyu Guo, Xiaofei Xie, Sen Chen 0001, Xiaohong Li 0001
ASE2022AI / LLM for SE
Toward Improving the Robustness of Deep Learning Models via Model Transformation.
Yingyi Zhang, Zan Wang, Jiajun Jiang, Hanmo You, Junjie Chen 0003
ASE2022AI / LLM for SE
Test-Driven Multi-Task Learning with Functionally Equivalent Code Transformation for Neural Code Generation.
Xin Wang 0114, Xiao Liu 0004, Pingyi Zhou, Qixia Liu, Jin Liu 0016
ASE2022Testing / QA; AI / LLM for SE
StandUp4NPR: Standardizing SetUp for Empirically Comparing Neural Program Repair Systems.
Wenkang Zhong, Hongliang Ge, Hongfei Ai, Chuanyi Li, Kui Liu 0001
ASE2022AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
SmOOD: Smoothness-based Out-of-Distribution Detection Approach for Surrogate Neural Networks in Aircraft Design.
Houssem Ben Braiek, Ali Tfaily, Foutse Khomh, Thomas Reid, Ciro Guida
ASE2022AI / LLM for SE; Requirements / Modeling / Architecture
Safety and Performance, Why not Both? Bi-Objective Optimized Model Compression toward AI Software Deployment.
Jie Zhu, Leye Wang, Xiao Han 0001
ASE2022AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
Reentrancy Vulnerability Detection and Localization: A Deep Learning Based Two-phase Approach.
Zhuo Zhang 0007, Yan Lei, Meng Yan 0001, Yue Yu 0001, Jiachi Chen
ASE2022AI / LLM for SE
Rank Learning-Based Code Readability Assessment with Siamese Neural Networks.
Qing Mi
ASE2022AI / LLM for SE; Education / Program Comprehension
QVIP: An ILP-based Formal Verification Approach for Quantized Neural Networks.
Yedi Zhang, Zhe Zhao 0007, Guangke Chen, Fu Song, Min Zhang 0002
ASE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods
Provably Tightest Linear Approximation for Robustness Verification of Sigmoid-like Neural Networks.
Zhaodi Zhang, Yiting Wu, Si Liu 0003, Jing Liu 0012, Min Zhang 0002
ASE2022Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
Prototyping Deep Learning Applications with Non-Experts: An Assistant Proposition.
Gustavo Rodrigues dos Reis, Adrian Mos, Mario Cortes Cornax, Cyril Labbé
ASE2022AI / LLM for SE
Prompt-tuned Code Language Model as a Neural Knowledge Base for Type Inference in Statically-Typed Partial Code.
Qing Huang, Zhiqiang Yuan, Zhenchang Xing, Xiwei Xu 0001, Liming Zhu 0001
ASE2022AI / LLM for SE; Program Analysis / Verification / Formal Methods
Patching Weak Convolutional Neural Network Models through Modularization and Composition.
Binhang Qi, Hailong Sun 0001, Xiang Gao 0012, Hongyu Zhang 0002
ASE2022AI / LLM for SE
DeepPerform: An Efficient Approach for Performance Testing of Resource-Constrained Neural Networks.
Simin Chen, Mirazul Haque, Cong Liu 0005, Wei Yang 0013
ASE2022Testing / QA; AI / LLM for SE; Performance / Energy / Reliability
CARGO: AI-Guided Dependency Analysis for Migrating Monolithic Applications to Microservices Architecture.
Vikram Nitin, Shubhi Asthana, Baishakhi Ray, Rahul Krishna
ASE2022AI / LLM for SE; Requirements / Modeling / Architecture
Boosting the Revealing of Detected Violations in Deep Learning Testing: A Diversity-Guided Method.
Xiaoyuan Xie, Pengbo Yin, Songqiang Chen
ASE2022Testing / QA; AI / LLM for SE
B-AIS: An Automated Process for Black-box Evaluation of Visual Perception in AI-enabled Software against Domain Semantics.
Hamed Barzamini, Mona Rahimi
ASE2022AI / LLM for SE; Human / Empirical / Socio-technical
Automatically Tagging the "AAA" Pattern in Unit Test Cases Using Machine Learning Models.
Chenhao Wei, Lu Xiao 0001, Tingting Yu 0001, Xinyu Chen, Xiao Wang 0030
ASE2022Testing / QA; AI / LLM for SE
Automatic Generation of Visualizations for Machine Learning Pipelines.
Lei Liu 0061, Wei-Peng Chen, Mehdi Bahrami, Mukul R. Prasad
ASE2022AI / LLM for SE
Automatic Code Documentation Generation Using GPT-3.
Junaed Younus Khan, Gias Uddin 0001
ASE2022AI / LLM for SE
Are Neural Bug Detectors Comparable to Software Developers on Variable Misuse Bugs?
Cedric Richter, Jan Haltermann, Marie-Christine Jakobs, Felix Pauck, Stefan Schott
ASE2022AI / LLM for SE; Human / Empirical / Socio-technical
Answering Software Deployment Questions via Neural Machine Reading at Scale.
Guanjie Qiu, Diwei Chen, Shuai Zhang, Yitian Chai, Xiaodong Gu 0002
ASE2022AI / LLM for SE; DevOps / CI / Build / Release
An Empirical Study on Numerical Bugs in Deep Learning Programs.
Gan Wang, Zan Wang, Junjie Chen 0003, Xiang Chen 0005, Ming Yan 0010
ASE2022AI / LLM for SE; Human / Empirical / Socio-technical
A transformer-based IDE plugin for vulnerability detection.
Cláudia Mamede, Eduard Pinconschi, Rui Abreu 0001
ASE2022AI / LLM for SE
A Transferable Time Series Forecasting Service Using Deep Transformer Model for Online Systems.
Tao Huang 0021, Pengfei Chen 0002, Jingrun Zhang, Ruipeng Li, Rui Wang
ASE2022AI / LLM for SE
A Review of AI-augmented End-to-End Test Automation Tools.
Phuoc Pham, Vu Nguyen 0003, Tien N. Nguyen
ASE2022Testing / QA; AI / LLM for SE
TauMed: test augmentation of deep learning in medical diagnosis.
Yunhan Hou, Jiawei Liu, Daiwei Wang, Jiawei He, Chunrong Fang
ISSTA2021Testing / QA; AI / LLM for SE
TERA: optimizing stochastic regression tests in machine learning projects.
Saikat Dutta 0001, Jeeva Selvam, Aryaman Jain, Sasa Misailovic
ISSTA2021Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
Predoo: precision testing of deep learning operators.
Xufan Zhang, Ning Sun, Chunrong Fang, Jiawei Liu, Jia Liu 0015
ISSTA2021Testing / QA; AI / LLM for SE
Exposing previously undetectable faults in deep neural networks.
Isaac Dunn, Hadrien Pouget, Daniel Kroening, Tom Melham
ISSTA2021AI / LLM for SE
DialTest: automated testing for recurrent-neural-network-driven dialogue systems.
Zixi Liu, Yang Feng 0003, Zhenyu Chen 0001
ISSTA2021Testing / QA; AI / LLM for SE
DeepHyperion: exploring the feature space of deep learning-based systems through illumination search.
Tahereh Zohdinasab, Vincenzo Riccio, Alessio Gambi, Paolo Tonella
ISSTA2021AI / LLM for SE
DeepCrime: mutation testing of deep learning systems based on real faults.
Nargiz Humbatova, Gunel Jahangirova, Paolo Tonella
ISSTA2021Testing / QA; AI / LLM for SE
AdvDoor: adversarial backdoor attack of deep learning system.
Quan Zhang 0003, Yifeng Ding, Yongqiang Tian 0001, Jianmin Guo, Min Yuan
ISSTA2021AI / LLM for SE; Security / Privacy / Vulnerability
White-Box Analysis over Machine Learning: Modeling Performance of Configurable Systems.
Miguel Velez, Pooyan Jamshidi, Norbert Siegmund, Sven Apel, Christian Kästner
ICSE2021AI / LLM for SE; Requirements / Modeling / Architecture; Performance / Energy / Reliability
Studying the Usage of Text-To-Text Transfer Transformer to Support Code-Related Tasks.
Antonio Mastropaolo, Simone Scalabrino, Nathan Cooper, David Nader-Palacio, Denys Poshyvanyk
ICSE2021AI / LLM for SE
Self-Checking Deep Neural Networks in Deployment.
Yan Xiao 0002, Ivan Beschastnikh, David S. Rosenblum, Changsheng Sun, Sebastian G. Elbaum
ICSE2021AI / LLM for SE; DevOps / CI / Build / Release
Scalable Quantitative Verification For Deep Neural Networks.
Teodora Baluta, Zheng Leong Chua, Kuldeep S. Meel, Prateek Saxena
ICSE2021AI / LLM for SE; Program Analysis / Verification / Formal Methods
RobOT: Robustness-Oriented Testing for Deep Learning Systems.
Jingyi Wang 0004, Jialuo Chen, Youcheng Sun, Xingjun Ma, Dongxia Wang 0002
ICSE2021Testing / QA; AI / LLM for SE
Resource-Guided Configuration Space Reduction for Deep Learning Models.
Yanjie Gao, Yonghao Zhu, Hongyu Zhang 0002, Haoxiang Lin, Mao Yang 0004
ICSE2021AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
Prioritizing Test Inputs for Deep Neural Networks via Mutation Analysis.
Zan Wang, Hanmo You, Junjie Chen 0003, Yingyi Zhang, Xuyuan Dong
ICSE2021Testing / QA; AI / LLM for SE
Measuring Discrimination to Boost Comparative Testing for Multiple Deep Learning Models.
Linghan Meng, Yanhui Li, Lin Chen 0015, Zhi Wang, Di Wu 0014
ICSE2021Testing / QA; AI / LLM for SE
Graph-based Fuzz Testing for Deep Learning Inference Engines.
Weisi Luo, Dong Chai, Xiaoyue Run, Jiang Wang, Chunrong Fang
ICSE2021Testing / QA; AI / LLM for SE
GUIGAN: Learning to Generate GUI Designs Using Generative Adversarial Networks.
Tianming Zhao 0005, Chunyang Chen 0001, Yuanning Liu, Xiaodong Zhu 0001
ICSE2021AI / LLM for SE; Mobile / Web / GUI / Android
Distribution-Aware Testing of Neural Networks Using Generative Models.
Swaroopa Dola, Matthew B. Dwyer, Mary Lou Soffa
ICSE2021Testing / QA; AI / LLM for SE
DeepPayload: Black-box Backdoor Attack on Deep Learning Models through Neural Payload Injection.
Yuanchun Li 0003, Jiayi Hua, Haoyu Wang 0001, Chunyang Chen 0001, Yunxin Liu 0001
ICSE2021AI / LLM for SE; Security / Privacy / Vulnerability
DeepLocalize: Fault Localization for Deep Neural Networks.
Mohammad Wardat, Wei Le, Hridesh Rajan
ICSE2021AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
DeepLV: Suggesting Log Levels Using Ordinal Based Neural Networks.
Zhenhao Li 0002, Heng Li 0007, Tse-Hsun Peter Chen, Weiyi Shang
ICSE2021AI / LLM for SE
CURE: Code-Aware Neural Machine Translation for Automatic Program Repair.
Nan Jiang 0012, Thibaud Lutellier, Lin Tan 0001
ICSE2021AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Automatic Unit Test Generation for Machine Learning Libraries: How Far Are We?
Song Wang 0009, Nishtha Shrestha, Abarna Kucheri Subburaman, Junjie Wang 0001, Moshi Wei
ICSE2021Testing / QA; AI / LLM for SE
Are Machine Learning Cloud APIs Used Correctly?
Chengcheng Wan 0001, Shicheng Liu, Henry Hoffmann, Michael Maire, Shan Lu 0001
ICSE2021AI / LLM for SE; Cloud / Microservices / Distributed Systems
An Empirical Study on Deployment Faults of Deep Learning Based Mobile Applications.
Zhenpeng Chen, Huihan Yao, Yiling Lou, Yanbin Cao, Yuanqiang Liu
ICSE2021AI / LLM for SE; Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Mobile / Web / GUI / Android
An Empirical Study of Refactorings and Technical Debt in Machine Learning Systems.
Yiming Tang 0002, Raffi Khatchadourian, Mehdi Bagherzadeh 0001, Rhia Singh, Ajani Stewart
ICSE2021AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Understanding neural code intelligence through program simplification.
Md. Rafiqul Islam Rabin, Vincent J. Hellendoorn, Mohammad Amin Alipour
FSE2021AI / LLM for SE
StateFormer: fine-grained type recovery from binaries using generative state modeling.
Kexin Pei, Jonas Guan, Matthew Broughton, Zhongtian Chen, Songchen Yao
FSE2021AI / LLM for SE; Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture
Semantic bug seeding: a learning-based approach for creating realistic bugs.
Jibesh Patra, Michael Pradel
FSE2021AI / LLM for SE
Multi-location cryptographic code repair with neural-network-based methodologies.
Ya Xiao 0002
FSE2021AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
Learning-based extraction of first-order logic representations of API directives.
Mingwei Liu 0002, Xin Peng 0001, Andrian Marcus, Christoph Treude, Xuefang Bai
FSE2021AI / LLM for SE
Freeing hybrid distributed AI training configuration.
Haoran Wang
FSE2021AI / LLM for SE; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems
Fair preprocessing: towards understanding compositional fairness of data transformers in machine learning pipeline.
Sumon Biswas, Hridesh Rajan
FSE2021AI / LLM for SE; DevOps / CI / Build / Release
FLEX: fixing flaky tests in machine learning projects by updating assertion bounds.
Saikat Dutta 0001, August Shi, Sasa Misailovic
FSE2021Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Exposing numerical bugs in deep learning via gradient back-propagation.
Ming Yan 0010, Junjie Chen 0003, Xiangyu Zhang 0001, Lin Tan 0001, Gan Wang
FSE2021AI / LLM for SE
Explaining mispredictions of machine learning models using rule induction.
Jürgen Cito, Isil Dillig, Seohyun Kim 0001, Vijayaraghavan Murali, Satish Chandra 0001
FSE2021AI / LLM for SE
Embedding app-library graph for neural third party library recommendation.
Bo Li 0103, Qiang He 0001, Feifei Chen 0001, Xin Xia 0001, Li Li 0029
FSE2021AI / LLM for SE; Mobile / Web / GUI / Android
Documenting evidence of a reuse of 'on the number of linear regions of deep neural networks'.
Rahul Yedida, Tim Menzies
FSE2021AI / LLM for SE
Documenting evidence of a reuse of 'a systematic study of the class imbalance problem in convolutional neural networks'.
Rahul Yedida, Tim Menzies
FSE2021AI / LLM for SE; Human / Empirical / Socio-technical
Code integrity attestation for PLCs using black box neural network predictions.
Yuqi Chen 0001, Christopher M. Poskitt, Jun Sun 0001
FSE2021Testing / QA; AI / LLM for SE
Bias in machine learning software: why? how? what to do?
Joymallya Chakraborty, Suvodeep Majumder, Tim Menzies
FSE2021AI / LLM for SE
A syntax-guided edit decoder for neural program repair.
Qihao Zhu, Zeyu Sun 0004, Yuan-an Xiao, Wenjie Zhang 0007, Kang Yuan
FSE2021AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
A comprehensive study on learning-based PE malware family classification methods.
Yixuan Ma, Shuang Liu 0007, Jiajun Jiang, Guanhong Chen, Keqiu Li
FSE2021AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
A comprehensive study of deep learning compiler bugs.
Qingchao Shen, Haoyang Ma, Junjie Chen 0003, Yongqiang Tian 0001, Shing-Chi Cheung
FSE2021AI / LLM for SE; Human / Empirical / Socio-technical
Towards the generation of machine learning defect reports.
Tuan Dung Lai
ASE2021AI / LLM for SE
Towards Fluid Software Architectures: Bidirectional Human-AI Interaction.
Ammar Yasser, Mervat Abu-Elkheir
ASE2021AI / LLM for SE; Human / Empirical / Socio-technical
Thinking Like a Developer? Comparing the Attention of Humans with Neural Models of Code.
Matteo Paltenghi, Michael Pradel
ASE2021AI / LLM for SE; Human / Empirical / Socio-technical
Log Anomaly to Resolution: AI Based Proactive Incident Remediation.
Ruchi Mahindru, Harshit Kumar, Sahil Bansal
ASE2021AI / LLM for SE
Learning-based Assistant for Data Migration of Enterprise Information Systems.
Sayandeep Mitra, Debayan Mukherjee, Atreya Bandyopadhyay, Rajdip Chowdhury, Raveendra Kumar Medicherla
ASE2021AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Explainable AI for Software Engineering.
Chakkrit Kla Tantithamthavorn, Jirayus Jiarpakdee
ASE2021AI / LLM for SE
DeepMetis: Augmenting a Deep Learning Test Set to Increase its Mutation Score.
Vincenzo Riccio, Nargiz Humbatova, Gunel Jahangirova, Paolo Tonella
ASE2021Testing / QA; AI / LLM for SE
DeepMemory: Model-based Memorization Analysis of Deep Neural Language Models.
Derui Zhu, Jinfu Chen 0002, Weiyi Shang, Xuebing Zhou, Jens Grossklags
ASE2021AI / LLM for SE
Deep GUI: Black-box GUI Input Generation with Deep Learning.
Faraz Yazdani Banafshe Daragh, Sam Malek
ASE2021AI / LLM for SE; Mobile / Web / GUI / Android
DEVIATE: A Deep Learning Variance Testing Framework.
Hung Viet Pham, Mijung Kim, Lin Tan 0001, Yaoliang Yu, Nachiappan Nagappan
ASE2021Testing / QA; AI / LLM for SE
Can Neural Clone Detection Generalize to Unseen Functionalitiesƒ.
Chenyao Liu, Zeqi Lin, Jian-Guang Lou, Lijie Wen 0001, Dongmei Zhang 0001
ASE2021AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
AST-Transformer: Encoding Abstract Syntax Trees Efficiently for Code Summarization.
Ze Tang 0002, Chuanyi Li, Jidong Ge, Xiaoyu Shen 0001, Zheling Zhu
ASE2021AI / LLM for SE
A First Look at the Effect of Deep Learning in Coverage-guided Fuzzing.
Siqi Li, Yun Lin 0001, Xiaofei Xie, Yuekang Li, Xiaohong Li 0001
ASE2021Testing / QA; AI / LLM for SE