Software Engineering Empirical Research Radar

2025 Papers

Major-venue software engineering papers from 2025.

PaperVenueYearTopics
"My productivity is boosted, but ..." Demystifying Users' Perception on AI Coding Assistants.
Yunbo Lyu, Zhou Yang 0003, Jieke Shi, Jianming Chang, Yue Liu 0011
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
A Characterization Study of Bugs in LLM Agent Workflow Orchestration Frameworks.
Ziluo Xue, Yanjie Zhao 0001, Shenao Wang 0001, Kai Chen 0012, Haoyu Wang 0001
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
A Large Scale Study of AI-based Binary Function Similarity Detection Techniques for Security Researchers and Practitioners.
Jingyi Shi, Yufeng Chen, Yang Xiao 0011, Yuekang Li, Zhengzi Xu
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
A Large-Scale Evolvable Dataset for Model Context Protocol Ecosystem and Security Analysis.
Zhiwei Lin, Bonan Ruan, Jiahao Liu 0005, Weibo Zhao
ASE2025Security / Privacy / Vulnerability
A Multi-Modality Evaluation of the Reality Gap in Autonomous Driving Systems.
Stefano Carlo Lambertenghi, Mirena Flores Valdez, Andrea Stocco 0001
ASE2025Other
A Secure Mocking Approach towards Software Supply Chain Security.
Daisuke Yamaguchi, Shinobu Saito, Takuya Iwatsuka, Nariyoshi Chida, Tachio Terauchi
ASE2025Security / Privacy / Vulnerability
ACTaint: Agent-Based Taint Analysis for Access Control Vulnerabilities in Smart Contracts.
Huarui Lin, Zhipeng Gao 0002, Jiachi Chen, Xiang Chen 0005, Xiaohu Yang 0001
ASE2025Security / Privacy / Vulnerability
ADPerf: Investigating and Testing Performance in Autonomous Driving Systems.
Tri Minh-Triet Pham, Diego Elias Costa, Weiyi Shang, Jinqiu Yang 0001
ASE2025Testing / QA; Performance / Energy / Reliability
AMPLE: Fine-grained File Access Policies for Server Applications.
Seyedhamed Ghavamnia, Julien Vanegue
ASE2025Other
APIDA-Chat: Structured Synthesis of API Search Dialogues to Bootstrap Conversational Agents.
Zachary Eberhart, Collin McMillan
ASE2025Other
APKARMOR: Low-Cost Lightweight Anti-Decompilation Techniques for Android Apps.
Jiayang Liu, Yanjie Zhao, Pengcheng Xia, Haoyu Wang
ASE2025Mobile / Web / GUI / Android; Performance / Energy / Reliability
ARG: Testing Query Rewriters via Abstract Rule Guided Fuzzing.
Dawei Li, Yuxiao Guo, Qifan Liu, Jie Liang 0006, Zhiyong Wu 0010
ASE2025Testing / QA
Acceleration of Automotive Software Development by Retrieval Augmented Integration Test Script Generation.
Masashi Mizoguchi, Kentaro Yoshimura, Keita Nakazawa, Yasuomi Sato, Takahiro Iida
ASE2025Testing / QA
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation.
Tanghaoran Zhang, Xinjun Mao, Shangwen Wang, Yuxin Zhao, Yao Lu 0003
ASE2025Other
Adaptive Performance Regression Detection Using A Semi-Supervised Siamese Network.
Yongqian Sun, Mengyao Li, Xiao Xiong, Lei Tao, Yimin Zuo
ASE2025Testing / QA; Performance / Energy / Reliability
AdaptiveGuard: Towards Adaptive Runtime Safety for LLM-Powered Software.
Rui Yang, Michael Fu, Chakkrit Tantithamthavorn, Chetan Arora 0002, Gunel Gulmammadova
ASE2025AI / LLM for SE
Advancing Automated Ethical Profiling in SE: a Zero-Shot Evaluation of LLM Reasoning.
Patrizio Migliarini, Mashal Afzal Memon, Marco Autili, Paola Inverardi
ASE2025AI / LLM for SE
Advancing Binary Code Similarity Detection via Context-Content Fusion and LLM Verification.
Chaopeng Dong, Jingdong Guo, Shouguo Yang, Yi Li, Dongliang Fang
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
AgentDroid: A Multi-Agent Tool for Detecting Fraudulent Android Applications.
Ruwei Pan, Hongyu Zhang, Zhonghao Jiang, Ran Hou
ASE2025Mobile / Web / GUI / Android
Agentic Specification Generator for Move Programs.
Yu-Fu Fu, Meng Xu, Taesoo Kim
ASE2025Program Analysis / Verification / Formal Methods
Agents in the Sandbox: End-to-End Crash Bug Reproduction for Minecraft.
Eray Yapagci, Yavuz Alp Sencer Öztürk, Eray Tüzün
ASE2025Debugging / Fault Localization / Diagnosis / Repair
AlertGuardian: Intelligent Alert Life-Cycle Management for Large-scale Cloud Systems.
Guangba Yu, Genting Mai, Rui Wang, Ruipeng Li, Pengfei Chen 0002
ASE2025Cloud / Microservices / Distributed Systems
Algernon: A Flag-Guided Hybrid Fuzzer for Unlocking Hidden Program Paths.
Peng Deng, Lei Zhang 0006, Jingqi Long, Wenzheng Hong, Zhemin Yang
ASE2025Testing / QA
AlignCoder: Aligning Retrieval with Target Intent for Repository-Level Code Completion.
Tianyue Jiang, Yanlin Wang 0001, Yanli Wang 0001, Daya Guo, Ensheng Shi
ASE2025DevOps / CI / Build / Release
Aligning LLMs to Fully Utilize the Cross-file Context in Repository-level Code Completion.
Jia Li 0012, Hao Zhu, Huanyu Liu 0001, Xianjie Shi, He Zong
ASE2025DevOps / CI / Build / Release
Altered Histories in Version Control System Repositories: Evidence from the Trenches.
Solal Rapaport, Laurent Pautet, Samuel Tardieu, Stefano Zacchiroli
ASE2025DevOps / CI / Build / Release
Amur: Fixing Multi-Resource Leaks Guided by Resource Flow Analysis.
Jinyoung Kim, Eunseok Lee
ASE2025Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
An Agent-based Evaluation Framework for Complex Code Generation.
Xinchen Wang, Ruida Hu, Pengfei Gao, Chao Peng 0002, Cuiyun Gao 0001
ASE2025Other
An Empirical Study of Knowledge Transfer in AI Pair Programming.
Alisa Welter, Niklas Schneider, Tobias Dick, Kallistos Weis, Christof Tinnes
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
An Empirical Study of Python Library Migration Using Large Language Models.
Mohayeminul Islam, Ajay Kumar Jha, May Mahmoud, Ildar Akhmetov, Sarah Nadi
ASE2025Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
An Empirical Study on UI Overlap in OpenHarmony Applications.
Farong Liu, Mingyi Zhou, Li Li 0029
ASE2025Human / Empirical / Socio-technical; Mobile / Web / GUI / Android
An LLM-based multi-agent framework for agile effort estimation.
Thanh-Long Bui, Hoa Khanh Dam, Rashina Hoda
ASE2025AI / LLM for SE
AndroFL: Evolutionary-Driven Fault Localization for Android Apps.
Vishal Singh, Ravi Shankar Das, Prajwal H. G, Subhajit Roy 0001
ASE2025Debugging / Fault Localization / Diagnosis / Repair; Mobile / Web / GUI / Android
AppBDS: LLM-Powered Description Synthesis for Sensitive Behaviors in Mobile Apps.
Zichen Liu, Xusheng Xiao
ASE2025AI / LLM for SE; Mobile / Web / GUI / Android
Are We SOLID Yet? An Empirical Study on Prompting LLMs to Detect Design Principle Violations.
Fatih Pehlivan, Arçin Ülkü Ergüzen, Sahand Moslemi Yengejeh, Mayasah Lami, Anil Koyuncu
ASE2025Human / Empirical / Socio-technical; Requirements / Modeling / Architecture
Argus: Resilience-Oriented Safety Assurance Framework for End-to-End ADSs.
Dingji Wang, You Lu 0005, Bihuan Chen 0001, Shuo Hao, Haowen Jiang
ASE2025Other
AutoFid: Adaptive and Noise-Aware Fidelity Measurement for Quantum Programs via Circuit Graph Analysis.
Tingting Li 0004, Ziming Zhao 0008, Jianwei Yin
ASE2025Other
AutoPLC: Generating Vendor-Aware Structured Text for Programmable Logic Controllers.
Donghao Yang, Aolang Wu, Tianyi Zhang, Li Zhang 0029, Xiaoli Lian
ASE2025Other
Automated Combinatorial Test Generation for Alloy.
Agustín Borda, Germán Regis, Nazareno Aguirre, Marcelo F. Frias, Pablo Ponzio
ASE2025Testing / QA
Automated Detection of Web Application Navigation Barriers for Screen Reader Users.
Shubhi Jain, Syed Fatiul Huq, Ziyao He, Sam Malek
ASE2025Mobile / Web / GUI / Android
Automated Generation of Issue-Reproducing Tests by Combining LLMs and Search-Based Testing.
Konstantinos Kitsios, Marco Castelluccio, Alberto Bacchelli
ASE2025Testing / QA
Automated Inline Comment Smell Detection and Repair with Large Language Models.
Hatice Kübra Çaglar, Semih Çaglar, Eray Tüzün
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Automated Insertion of Flushes and Fences for Persistency.
Yutong Guo, Weiyu Luo, Brian Demsky
ASE2025Other
Automated Proactive Logging Quality Improvement for Large-Scale Codebases.
Yichen Li 0003, Jinyang Liu 0002, Junsong Pu, Zhihan Jiang, Zhuangbin Chen
ASE2025Other
Automated Prompt Generation for Code Intelligence: An Empirical study and Experience in WeChat.
Kexing Ji, Shiyun Fu, Cuiyun Gao 0001, Yujia Chen, Zezhou Yang
ASE2025Human / Empirical / Socio-technical
Automated Repair of Ambiguous Problem Descriptions for LLM-Based Code Generation.
Haoxiang Jia, Robbie Morris, He Ye, Federica Sarro, Sergey Mechtaev
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Automated Repair of OpenID Connect Programs.
Tamjid Al Rahat, Yanju Chen, Yu Feng 0001, Yuan Tian 0001
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Automatic Fixing of Missing Dependency Errors.
Jun Lyu, He Zhang 0001, Lanxin Yang, Yue Li 0047, Chenxing Zhong
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Autonomous Agents for Accessibility: Simulating Visual Impairments in Web Interfaces.
Juan Diego Yepes-Parra, Camilo Escobar-Velásquez
ASE2025Mobile / Web / GUI / Android
BASHIRI: Learning Failure Oracles from Execution Features.
Marius Smytzek, Martin Eberlein, Tural Mammadov, Lars Grunske, Andreas Zeller
ASE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
BCFuzz: Bytecode-Driven Fuzzing for JavaScript Engines.
Jiming Wang, Chenggang Wu 0002, Jikai Ren, Yuhao Hu, Yan Kang 0002
ASE2025Testing / QA
Backdoors in Code Summarizers: How Bad Is It?
Chenyu Wang 0005, Zhou Yang 0003, Yaniv Harel, David Lo 0001
ASE2025Other
Belief Propagation with Local Structure and Its Applications in Program Analysis.
Yiqian Wu, Yifan Chen, Yingfei Xiong 0001, Xin Zhang 0035
ASE2025Program Analysis / Verification / Formal Methods
BenGQL: An Extensible Benchmarking Framework for Automated GraphQL Testing.
Abenezer Angamo, Marcello Maugeri
ASE2025Testing / QA
Better Safe than Sorry: Preventing Policy Violations through Predictive Root-Cause-Analysis for IoT Systems.
Michael Norris, Syed Rafiul Hussain, Gang Tan
ASE2025Other
Beyond Static GUI Agent: Evolving LLM-based GUI Testing via Dynamic Memory.
Mengzhuo Chen, Zhe Liu 0025, Chunyang Chen 0001, Junjie Wang 0001, Yangguang Xue
ASE2025Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review; Mobile / Web / GUI / Android
BinStruct: Binary Structure Recovery Combining Static Analysis and Semantics.
Yiran Zhang, Zhengzi Xu, Zhe Lang, Chengyue Liu, Yuqiang Sun 0001
ASE2025Program Analysis / Verification / Formal Methods
BitsAI-Fix: LLM-Driven Approach for Automated Lint Error Resolution in Practice.
Yuanpeng Li, Qi Long, Zhiyuan Yao, Jian Xu, Lintao Xie
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Breaking the Traffic Barrier: Unveiling Multi-Format of Protocols via Autonomous Program Exploration.
Dingzhao Xue, Yibo Qu, Bowen Jiang, Xin Chen, Shuaizong Si
ASE2025Other
Bridging Natural Language and Formal Specification-Automated Translation of Software Requirements to LTL via Hierarchical Semantics Decomposition Using LLMs.
Zhi Ma, Cheng Wen 0002, Zhexin Su, Xiao Liang, Cong Tian 0001
ASE2025Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture
Bridging Research and Practice in Simulation-based Testing of Industrial Robot Navigation Systems.
Sajad Mazraeh Khatiri, Francisco Eli Vina Barrientos, Maximilian Wulf, Paolo Tonella, Sebastiano Panichella
ASE2025Testing / QA
BuilDroid: A Self-Correcting LLM Agent for Automated Android Builds.
Jaehyeon Kim, Rui Rua, Karim Ali 0001
ASE2025AI / LLM for SE; DevOps / CI / Build / Release; Mobile / Web / GUI / Android
Can Mamba Be Better? An Experimental Evaluation of Mamba in Code Intelligence.
Shuo Liu 0020, Jacky Keung, Zhen Yang 0022, Zhenyu Mao, Yicheng Sun
ASE2025Other
Characterizing Multi-Hunk Patches: Divergence, Proximity, and LLM Repair Challenges.
Noor Nashid, Daniel Ding, Keheliya Gallaba, Ahmed E. Hassan, Ali Mesbah 0001
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Characterizing and Repairing Color-Related Accessibility Issues in Android Apps.
Jiahao Gu, Huaxun Huang
ASE2025Debugging / Fault Localization / Diagnosis / Repair; Mobile / Web / GUI / Android
Chrysalis: A Lightweight Logging and Replay Framework for Metamorphic Testing in Python.
Jai Parera, Nathan Huey, Ben Limpanukorn, Miryung Kim
ASE2025Testing / QA
Clara: A Developer's Companion for Code Comprehension and Analysis.
Ahmed Adnan, Mushfiqur Rahman, Saad Sakib Noor, Kazi Sakib
ASE2025Human / Empirical / Socio-technical; Education / Program Comprehension
Clarifying Semantics of In-Context Examples for Unit Test Generation.
Chen Yang, Lin Yang 0030, Ziqi Wang, Dong Wang 0044, Jianyi Zhou
ASE2025Testing / QA
CoTune: Co-evolutionary Configuration Tuning.
Gangda Xiong, Tao Chen
ASE2025DevOps / CI / Build / Release
Code-DiTing: Automatic Evaluation of Code Generation without References or Test Cases.
Guang Yang 0019, Yu Zhou 0010, Xiang Chen 0005, Wei Zheng 0006, Xing Hu 0008
ASE2025Testing / QA
CodeACT-R: A Cognitive Simulation Framework for Human Attention in Code Reading.
Yueke Zhang, Zihan Fang, Greg Trafton, Daniel Levin, Kevin Leach
ASE2025Human / Empirical / Socio-technical
CodeGenLink: A Tool to Find the Likely Origin and License of Automatically Generated Code.
Daniele Bifolco, Guido Annicchiarico, Pierluigi Barbiero, Massimiliano Di Penta, Fiorella Zampetti
ASE2025Other
Coding-Fuse: Efficient Fusion of Code Pre-Trained Models for Classification Tasks.
Yu Zhao, Lina Gong, Zhiqiu Huang, Yuchen Jin, Mingqiang Wei
ASE2025Other
Comprehend, Imitate, and then Update: Unleashing the Power of LLMs in Test Suite Evolution.
Tangzhi Xu, Jianhan Liu, Yuan Yao 0001, Cong Li 0003, Feng Xu 0007
ASE2025Testing / QA; Maintenance / Evolution / Refactoring / Review
ConfuseTaint: Exploiting Vulnerabilities to Bypass Dynamic Taint Analysis.
Yufei Wu, Alexandre Bartel
ASE2025Security / Privacy / Vulnerability
Context-Aware CodeLLM Eviction for AI-assisted Coding.
Kishanthan Thangarajah, Boyuan Chen 0002, Shi Chang, Ahmed E. Hassan
ASE2025AI / LLM for SE
Context-Sensitive Pointer Analysis for ArkTS.
Yizhuo Yang 0005, Lingyun Xu, Mingyi Zhou, Li Li 0029
ASE2025Program Analysis / Verification / Formal Methods
CoorLog: Efficient-Generalizable Log Anomaly Detection via Adaptive Coordinator in Software Evolution.
Pei Xiao 0007, Chiming Duan, Minghua He, Tong Jia, Yifan Wu 0002
ASE2025Maintenance / Evolution / Refactoring / Review
Coverage-Based Harmfulness Testing for LLM Code Transformation.
Honghao Tan, Haibo Wang, Diany Pressato, Yisen Xu, Shin Hwei Tan
ASE2025Testing / QA; AI / LLM for SE
Cross2OH: Enabling Seamless Porting of C/C++ Software Libraries to OpenHarmony.
Qian Zhang, Tsz-On Li, Ying Wang 0038, Li Li 0029, Shing-Chi Cheung
ASE2025Other
Cryptbara: Dependency-Guided Detection of Python Cryptographic API Misuses.
Seogyeong Cho, Seungeun Yu, Seunghoon Woo
ASE2025Security / Privacy / Vulnerability
DALEQ - Explainable Equivalence for Java Bytecode.
Jens Dietrich 0001, Behnaz Hassanshahi
ASE2025Other
DESIGNATOR: a Toolset for Automated GAN-enhanced Search-based Testing and Retraining of DNNs in Martian Environments.
Mohammed Oualid Attaoui, Fabrizio Pastore
ASE2025Testing / QA
DLBench: A Comprehensive Benchmark for SQL Translation with Large Language Models.
Li Lin, Hongqiao Chen, Qinglin Zhu, Liehang Chen, Linlong Tang
ASE2025Other
DNAFuzz: Descriptor-Aware Fuzzing for USB Drivers.
Zhengshu Wang, Peng He, Fuchen Ma, Yuanliang Chen, Shuoshuo Duan
ASE2025Testing / QA
DRIFT: Debug-based Trace Inference for Firmware Testing.
Changming Liu, Alejandro Mera, Meng Xu, Engin Kirda
ASE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
DSBox: A Data Selection Framework for Efficient Deep Code Learning.
Xinyang Liu, Lili Quan, Qiang Hu
ASE2025Other
Data Dependency-Aware Code Generation from Enhanced UML Sequence Diagrams.
Wenxin Mao, Zhitao Wang, Long Wang, Sirong Chen, Cuiyun Gao 0001
ASE2025Requirements / Modeling / Architecture
DebCovDiff: Differential Testing of Coverage Measurement Tools on Real-World Projects.
Wentao Zhang, Jinghao Jia, Erkai Yu, Darko Marinov, Tianyin Xu
ASE2025Testing / QA
Debugging the Undebuggable: Why Multi-Fault Programs Break Debugging and Repair Tools.
Omar I. Al-Bataineh
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Debun: Detecting Bundled JavaScript Libraries on Web using Property-Order Graphs.
Seojin Kim, Sungmin Park, Jihyeok Park
ASE2025Mobile / Web / GUI / Android
DeepExploitor: LLM-Enhanced Automated Exploitation of DeepLink Attack in Hybrid Apps.
Zhangyue Zhang, Lei Zhang 0096, Zhibo Zhang 0006, Yongheng Liu, Zhemin Yang
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
DeepTx: Real-Time Transaction Risk Analysis via Multi-Modal Features and LLM Reasoning.
Yixuan Liu, Xinlei Li, Yi Li
ASE2025AI / LLM for SE
Defects4C: Benchmarking Large Language Model Repair Capability with C/C++ Bugs.
Jian Wang 0067, Xiaofei Xie, Qiang Hu, Shangqing Liu, Jiongchi Yu
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Defects4Log: Benchmarking LLMs for Logging Code Defect Detection and Reasoning.
Xin Wang, Zhenhao Li, Zishuo Ding
ASE2025Other
Democratizing the Cryptocurrency Ecosystem by Just-In-Time Transformation of Mining Programs.
Wei Liu 0148, Zhenhua Li 0001, Feng Qian 0001, Feiyu Jin, Hao Lin 0005
ASE2025Other
Demystifying Cookie Sharing Risks in WebView-based Mobile App-in-app Ecosystems.
Miao Zhang 0011, Shenao Wang 0001, Guilin Zheng, Yanjie Zhao 0001, Haoyu Wang 0001
ASE2025Mobile / Web / GUI / Android
Demystifying Cross-Language C/C++ Binaries: A Robust Software Component Analysis Approach.
Meiqiu Xu, Ying Wang 0038, Wei Tang, Xian Zhan, Shing-Chi Cheung
ASE2025Performance / Energy / Reliability
Demystifying OpenZeppelin's Own Vulnerabilities and Analyzing Their Propagation in Smart Contracts.
Han Liu 0012, Daoyuan Wu, Yuqiang Sun 0001, Shuai Wang, Yang Liu
ASE2025Other
Demystifying the Evolution of Neural Networks with BOM Analysis: Insights from a Large-Scale Study of 55,997 GitHub Repositories.
Xiaoning Ren, Yuhang Ye 0004, Xiongfei Wu, Yueming Wu 0001, Yinxing Xue
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Destabilizing Neurons to Generate Challenging Neural Network Verification Benchmarks.
Linhan Li, ThanhVu Nguyen
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
Detecting Semantic Clones of Unseen Functionality.
Konstantinos Kitsios, Francesco Sovrano, Earl T. Barr, Alberto Bacchelli
ASE2025Other
Detecting Various DeFi Price Manipulations with LLM Reasoning.
Juantao Zhong, Daoyuan Wu, Ye Liu 0012, Maoyi Xie, Yang Liu 0003
ASE2025AI / LLM for SE
Detecting Vulnerabilities from Issue Reports for Internet-of-Things.
Sogol Masoumzadeh
ASE2025Other
Detecting and Mitigating Inconsistencies Between Code, Documentation and Tests.
Tobias Kiecker
ASE2025Testing / QA
Detecting and Repairing Incomplete Software Requirements with Multi-LLM Ensembles.
Mohamad Kassab, Marwan AbdElhameed
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Requirements / Modeling / Architecture
Diagnosing Performance Differences in Model Checkers via Runtime-Guided Problem Generation.
Yibo Dong 0001, Yicong Xu, Wenjing Deng, Yu Chen, Xiaoyu Zhang
ASE2025Performance / Energy / Reliability
DiffFix: Incrementally Fixing AST Diffs via Context and Type Information.
Guofeng Zeng, Chang-Ai Sun, Kai Gao 0008, Huai Liu
ASE2025Debugging / Fault Localization / Diagnosis / Repair; Program Analysis / Verification / Formal Methods
Diplomatist: What Do Cross-language Dependencies Reflect Software Ecosystem Health?
Fanyi Meng 0003, Ying Wang 0038, Chun Yong Chong, Hai Yu 0001, Zhiliang Zhu 0001
ASE2025Other
Do LLMs Generate Useful Test Oracles? An Empirical Study with an Unbiased Dataset.
Davide Molinelli, Luca Di Grazia, Alberto Martin-Lopez, Michael D. Ernst, Mauro Pezzè
ASE2025Testing / QA; Human / Empirical / Socio-technical
Don't Mess with Bro's Cheese! An Empirical Study of Resource Conflict in Android Multi-window.
Chenkai Guo, Huimin Zhao, Tianhong Wang 0010, Naipeng Dong, Qingqing Dong
ASE2025Human / Empirical / Socio-technical; Mobile / Web / GUI / Android; Performance / Energy / Reliability
DrainCode: Stealthy Energy Consumption Attacks on Retrieval-Augmented Code Generation via Context Poisoning.
Yanli Wang 0001, Jiadong Wu, Tianyue Jiang, Mingwei Liu 0002, Jiachi Chen
ASE2025Performance / Energy / Reliability
DualFuzz: Detecting Vulnerability in Wi-Fi NICs through Dual-Directional Fuzzing.
Yuanliang Chen, Fuchen Ma, Yanyang Zhao, Yuanyi Li, Yu Jiang 0001
ASE2025Testing / QA
Dynamic Testing of GUI Exercises in Headless Environments.
Benjamin Schmitz
ASE2025Testing / QA; Mobile / Web / GUI / Android
EPSO: A Caching-Based Efficient Superoptimizer for BPF Bytecode.
Qian Zhu, Yuxuan Liu, Ziyuan Zhu, Shangqing Liu, Lei Bu
ASE2025Other
EditFusion: Resolving Code Merge Conflicts via Edit Selection.
Changxin Wang, Lei Xu, Rundong Wang, Yiming Ma, Weifeng Zhang
ASE2025Other
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts.
Yuan Jiang, Zehao Li, Shan Huang, Christoph Treude, Xiaohong Su
ASE2025Other
Efficient Understanding of Machine Learning Model Mispredictions.
Martin Eberlein, Jürgen Cito, Lars Grunske
ASE2025AI / LLM for SE
Efficient and Verifiable Proof Logging for MaxSAT Solving.
Raoul Van Doren, Timos Antonopoulos, Ruzica Piskac
ASE2025Other
EfficientEdit: Accelerating Code Editing via Edit-Oriented Speculative Decoding.
Peiding Wang, Li Zhang, Fang Liu, Yinghao Zhu, Wang Xu
ASE2025Other
Element-Aware Fine-Tuning of Vision-Language Models for Cost-Efficient GUI Testing in an Industrial Setting.
Mengzhou Wu, Yuzhe Guo, Yuan Cao, Haochuan Lu, Hengyu Zhang
ASE2025Testing / QA; Mobile / Web / GUI / Android; Performance / Energy / Reliability
Enhancing LLM to Decompile Optimized PTX to Readable CUDA for Tensor Programs.
Xinyu Sun, Fugen Tang, Yu Zhang, Han Shen, Chengru Song
ASE2025AI / LLM for SE
Enhancing LLM's Ability to Generate More Repository-Aware Unit Tests Through Precise Context Injection.
Xin Yin, Chao Ni 0001, Xinrui Li, Liushan Chen, Guojun Ma
ASE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
Enhancing LLMs with Staged Grouping and Dehallucination for Header File Decomposition.
Yue Wang, Jiaxuan Sun, Yanzhen Zou, Bing Xie
ASE2025Other
Envisioning Intelligent Requirements Engineering via Knowledge-Guided Multi-Agent Collaboration.
Jiangping Huang, Dongming Jin, Weisong Sun, Yang Liu 0003, Zhi Jin 0001
ASE2025Requirements / Modeling / Architecture
ErrorPrism: Reconstructing Error Propagation Paths in Cloud Service Systems.
Junsong Pu, Yichen Li 0003, Zhuangbin Chen, Jinyang Liu 0002, Zhihan Jiang
ASE2025Cloud / Microservices / Distributed Systems
Evaluating Large Language Models for Functional and Maintainable Code in Industrial Settings: A Case Study at ASML.
Yash Mundhra, Max Valk, Maliheh Izadi
ASE2025Human / Empirical / Socio-technical
Evaluating Large Language Models for Time Series Anomaly Detection in Aerospace Software.
Yang Liu, Yixing Luo, Xiaofeng Li, Xiaogang Dong, Bin Gu
ASE2025Other
Evaluating Program Coverage for Code-Model Training.
Nandakishore Menon, Diptikalyan Saha
ASE2025Testing / QA
Evaluating and Improving Framework-based Parallel Code Completion with Large Language Models.
Ke Liu, Qinglin Wang, Xiang Chen, Guang Yang, Yigui Feng
ASE2025Other
Evolution-Aware Heuristics for GR(1) Realizability Checking.
Dor Ma'ayan, Shahar Maoz, Jan Oliver Ringert
ASE2025Maintenance / Evolution / Refactoring / Review
Exact Inference for Quantum Circuits: A Testing Oracle for Quantum Software Stacks.
Kanguk Lee, Jaemin Hong, Sukyoung Ryu
ASE2025Testing / QA
Execution-Aware Program Reduction for WebAssembly via Record and Replay.
Doehyun Baek, Daniel Lehmann 0002, Ben L. Titzer, Sukyoung Ryu, Michael Pradel
ASE2025Other
Explainable Fault Localization for Programming Assignments via LLM-Guided Annotation.
Fang Liu, Tianze Wang, Li Zhang, Zheyu Yang, Jing Jiang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Exploring Autonomous Agents: A Closer Look at Why They Fail When Completing Tasks.
Ruofan Lu, Yichen Li 0003, Yintong Huo
ASE2025Other
Exploring Static Taint Analysis in LLMs: A Dynamic Benchmarking Framework for Measurement and Enhancement.
Haoran Zhao, Lei Zhang 0006, Keke Lian, Fute Sun, Bofei Chen
ASE2025Security / Privacy / Vulnerability
EyeNav: Accessible Webpage Interaction and Testing using Eye-tracking and NLP.
Juan Diego Yepes-Parra, Camilo Escobar-Velásquez
ASE2025Testing / QA
FETT: Fault Injection as an Educational and Training Tool in Cybersecurity.
Anaé De Baets, Guillaume Nguyen, Xavier Devroey, Fabian Gilson
ASE2025Other
FGit: Fault-Guided Fine-Tuning for Code Generation.
Lishui Fan, Zhongxin Liu 0002, Haoye Wang, Lingfeng Bao, Xin Xia 0001
ASE2025Other
Fact-Aligned and Template-Constrained Static Analyzer Rule Enhancement with LLMs.
Zongze Jiang, Ming Wen 0001, Ge Wen, Hai Jin 0001
ASE2025Other
FailMapper: Automated Generation of Unit Tests Guided by Failure Scenarios.
Ruiqi Dong, Zehang Deng, Xiaogang Zhu 0001, Xiaoning Du 0001, Huai Liu
ASE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
FastCoder: Accelerating Repository-level Code Generation via Efficient Retrieval and Verification.
Qianhui Zhao, Li Zhang, Fang Liu, Xiaoli Lian, Qiaoyuanhe Meng
ASE2025Program Analysis / Verification / Formal Methods; DevOps / CI / Build / Release
Faster Runtime Verification during Testing via Feedback-Guided Selective Monitoring.
Shinhae Kim, Saikat Dutta 0001, Owolabi Legunsen
ASE2025Testing / QA; Program Analysis / Verification / Formal Methods
Fault Injection for Simulink-based CPS Models: Insights and Future Directions.
Drishti Yadav, Claudio Mandrioli, Ezio Bartocci, Domenico Bianculli
ASE2025Other
Faultseeker: LLM-Empowered Framework for Blockchain Transaction Fault Localization.
Kairan Sun, Zhengzi Xu, Kaixuan Li 0002, Lyuye Zhang, Yuqiang Sun 0001
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
Finding Bugs in MLIR Compiler Infrastructure via Lowering Space Exploration.
Jingjing Liang, Shan Huang, Ting Su 0001
ASE2025Other
Finding Bugs in WebAssembly Interface Type Binding Generators.
Ethan Stanley, Eric Eide
ASE2025Program Analysis / Verification / Formal Methods
Finding Insecure State Dependency in DApps via Multi-Source Tracing and Semantic Enrichment.
Jingwen Zhang, Yuhong Nan, Wei Li 0121, Kaiwen Ning, Zewei Lin
ASE2025Other
FirmProj: Detecting Firmware Leakage in IoT Update Processes via Companion App Analysis.
Wenzhi Li, Jialong Guo, Jiongyi Chen, Fan Li, Yujie Xing
ASE2025Mobile / Web / GUI / Android
First-Order Quantified Separator in Alloy Analyzer.
One An
ASE2025Other
Fixing Broken Graphs: LLM-Powered Automatic Code Optimization for DNN Programs.
Haotian Wang, Yicheng Sui, Yudong Xie, Yicong Liu, Yufei Sun
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
FlakyGuard: Automatically Fixing Flaky Tests at Industry Scale.
Chengpeng Li 0002, Farnaz Behrang, August Shi, Peng Liu
ASE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
FlowStrider: Low-Friction Continuous Threat Modeling.
Bernd Gruner, Noah Erthel, Clemens-Alexander Brust
ASE2025Requirements / Modeling / Architecture
Forcrat: Automatic I/O API Translation from C to Rust via Origin and Capability Analysis.
Jaemin Hong, Sukyoung Ryu
ASE2025Other
From Characters to Structure: Rethinking Real-Time Collaborative Programming Models.
Leon Freudenthaler, Bernhard Taufner, Karl Michael Göschka
ASE2025Other
From Modules to Marketplaces: A Vision for Composable Capability Sharing Across Organizations.
Wei-Ji Wang
ASE2025Other
From Redundancy to Efficiency: Exploiting Shared UI Interactions towards Efficient LLM-Based Testing.
Xuan Wang, Yingchuan Wang, Yongxiang Hu 0003, Yu Zhang 0165, Hailiang Jin
ASE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android; Performance / Energy / Reliability
From Sparse to Structured: A Diffusion-Enhanced and Feature-Aligned Framework for Coincidental Correctness Detection.
Huan Xie 0002, Chunyan Liu, Yan Lei, Zhenyu Wu, Jinping Wang
ASE2025Other
From Technical Excellence to Practical Adoption: Lessons Learned Building an ML-Enhanced Trace Analysis Tool.
Kaveh Shahedi, Matthew Khouzam, Heng Li 0007, Maxime Lamothe, Foutse Khomh
ASE2025DevOps / CI / Build / Release
Function Clustering-Based Fuzzing Termination: Toward Smarter Early Stopping.
Liang Ding, Wenzhang Yang, Yinxing Xue
ASE2025Testing / QA
GUI-ReRank: Enhancing GUI Retrieval with Multi-Modal LLM-based Reranking.
Kristian Kolthoff, Felix Kretzer, Alexander Maedche, Simone Paolo Ponzetto, Christian Bartelt
ASE2025AI / LLM for SE; Mobile / Web / GUI / Android
GUIFuzz++: Unleashing Grey-box Fuzzing on Desktop Graphical User Interfacing Applications.
Dillon Otto, Tanner Rowlett, Stefan Nagy
ASE2025Testing / QA
Generating Failure-Based Oracles to Support Testing of Reported Bugs in Android Apps.
Jack Johnson, Junayed Mahmud, Oscar Chaparro, Kevin Moran, Mattia Fazzini
ASE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair; Mobile / Web / GUI / Android
GlassWing: A Tailored Static Analysis Approach for Flutter Android Apps.
Xiangyu Zhang, Yucheng Su, Lingling Fan 0003, Miaoying Cai, Sen Chen 0001
ASE2025Program Analysis / Verification / Formal Methods; Mobile / Web / GUI / Android
HFuzzer: Testing Large Language Models for Package Hallucinations via Phrase-based Fuzzing.
Yukai Zhao, Menghan Wu, Xing Hu 0008, Xin Xia 0001
ASE2025Testing / QA
HarmoBridge: Bridging ArkTS and C/C++ for Cross-Language Static Analysis on HarmonyOS.
Jiale Wu, Jiapeng Deng, Yanjie Zhao, Li Li, Haoyu Wang
ASE2025Program Analysis / Verification / Formal Methods
Have We Solved Access Control Vulnerability Detection in Smart Contracts? A Benchmark Study.
Han Liu 0012, Daoyuan Wu, Yuqiang Sun 0001, Shuai Wang 0011, Yang Liu 0003
ASE2025Human / Empirical / Socio-technical
Hierarchical Knowledge Injection for Improving LLM-based Program Repair.
Ramtin Ehsani, Esteban Parra, Sonia Haiduc, Preetha Chatterjee
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Hit The Bullseye On The First Shot: Improving LLMs Using Multi-Sample Self-Reward Feedback for Vulnerability Repair.
Rui Jiao, Yue Zhang, Jinku Li, Jianfeng Ma
ASE2025Debugging / Fault Localization / Diagnosis / Repair
How Big is the Automaton? Certified Lower Bounds on the Size of Presburger DFAs.
Nicolas Amat, Pierre Ganty, Alessio Mansutti
ASE2025Other
How Can Infrastructure as Code Accelerate Data Center Bring-ups? A Case Study at ByteDance.
Xianhao Jin, Yifei Feng, Yufei Gao, Yongning Hu, Jie Huang
ASE2025Human / Empirical / Socio-technical
How Does ChatGPT Make Assumptions When Creating Erroneous Programs?
Sadia Jahan, Xiaoyin Wang
ASE2025AI / LLM for SE
Human-Centered Evaluation of REST API Fuzzing Tools: Bridging Academia and Industry.
Fanny Febriani Susilo
ASE2025Testing / QA; Human / Empirical / Socio-technical
Human-In-The-Loop Oracle Learning for Simulation-Based Testing.
Ben-Hau Chia, Eunsuk Kang, Christopher S. Timperley
ASE2025Testing / QA; Human / Empirical / Socio-technical
HybridSIMD: A Super C++ SIMD Library with Integrated Auto-tuning Capabilities.
Haolin Pan, Xulin Zhou, Mingjie Xing, Yanjun Wu
ASE2025Other
Hypergraph Neural Network-based Multi-Granular Root Cause Localization for Microservice Systems.
Yaxiao Li, Lu Wang 0014, Chenxi Zhang 0003, Qingshan Li, Siming Rong
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
IDBFuzz: Web Storage DataBase Fuzzing with Controllable Semantics.
Jingyi Chen, Jinfu Chen 0001, Saihua Cai, Shengran Wang
ASE2025Testing / QA; Mobile / Web / GUI / Android
IMUFuzzer: Resilience-based Discovery of Signal Injection Attacks on Robotic Aerial Vehicles.
Sudharssan Mohan, Kyeongseok Yang, Zelun Kong, Yonghwi Kwon 0001, Junghwan Rhee
ASE2025Testing / QA
Improving LLM-based Log Parsing by Learning from Errors in Reasoning Traces.
Jialai Wang, Juncheng Lu, Jie Yang, Junjie Wang 0001, Zeyu Gao
ASE2025AI / LLM for SE
Improving NLSAT for Nonlinear Real Arithmetic.
Zhonghan Wang
ASE2025Other
Improving Quality of LLM Code Generation in Low-Resource Programming Languages via Uncertainty Estimation.
Georgii Andriushchenko
ASE2025AI / LLM for SE; Performance / Energy / Reliability
Incremental Program Analysis in the Wild: An Empirical Study on Real-World Program Changes.
Xizao Wang, Xiangrong Bin, Lanxin Huang, Shangqing Liu, Jianhua Zhao
ASE2025Program Analysis / Verification / Formal Methods; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Industry Practice of LLM-Assisted Protocol Fuzzing for Commercial Communication Modules.
Qiang Fu, Changjian Liu, Yuan Ding, Chao Fan, Yulai Fu
ASE2025Testing / QA; AI / LLM for SE
IntelliTopo: An IaC Generation Service for Industrial Network Topology Construction.
Mingyu Shao, Zhao Liu, Weihong Han, Cuiyun Gao 0001, Jiachen Liu
ASE2025Other
Interaction-Aware Patch Assessment for Multi-Fault Automated Program Repair.
Omar I. Al-Bataineh
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Interaction2Code: Benchmarking MLLM-based Interactive Webpage Code Generation from Interactive Prototyping.
Jingyu Xiao, Yuxuan Wan, Yintong Huo, Zixin Wang, Xinyi Xu
ASE2025Other
Interleaved Learning and Exploration: A Self-Adaptive Fuzz Testing Framework for MLIR.
Zeyu Sun 0004, Jingjing Liang, Weiyi Wang, Chenyao Suo, Junjie Chen 0003
ASE2025Testing / QA
Interpretable Vulnerability Detection Reports.
Cláudia Mamede, José Campos 0001, Claire Le Goues, Rui Abreu 0001
ASE2025Other
Is Measurement Enough? Rethinking Output Validation in Quantum Program Testing.
Jiaming Ye, Xiongfei Wu, Shangzhou Xia, Fuyuan Zhang, Jianjun Zhao 0001
ASE2025Testing / QA
Issue Localization via LLM-Driven Iterative Code Graph Searching.
Zhonghao Jiang, Xiaoxue Ren, Meng Yan 0001, Wei Jiang 0041, Yong Li 0004
ASE2025AI / LLM for SE
It's Not Easy Being Green: On the Energy Efficiency of Programming Languages.
Nicolas van Kempen, Hyuk-Je Kwon, Dung Tuan Nguyen, Emery D. Berger
ASE2025Performance / Energy / Reliability
JSidentify-V2: Leveraging Dynamic Memory Fingerprinting for Mini-Game Plagiarism Detection.
Zhihao Li, Chaozheng Wang, Zongjie Li, Xinyong Peng, Qun Xia
ASE2025Other
KAIOPS: A Platform Solution of End-to-End Multi-Modal AIOps for AI Training at Scale.
Zeying Wang, Junhong Liu, Penghao Zhang, Xiaoyang Sun, Xu Wang
ASE2025AI / LLM for SE
Kair: A Statistical and Causal Approach to Pinpointing Stragglers in Distributed Model Training.
Yitang Yang, Junhong Liu, Jiapeng Chen, Xiaoyang Sun, Tianyu Wo
ASE2025Cloud / Microservices / Distributed Systems
LAURA: Enhancing Code Review Generation with Context-Enriched Retrieval-Augmented LLM.
Yuxin Zhang, Yuxia Zhang, Zeyu Sun 0004, Yanjie Jiang, Hui Liu 0003
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
LLM-Assisted Synthesis of High-Assurance C Programs.
Prasita Mukherjee, Minghai Lu, Benjamin Delaware
ASE2025AI / LLM for SE
LLM-Based Identification of Null Pointer Exception Patches.
Tahir Ullah, Waseem Akram 0005, Fiza Khaliq, Hui Liu
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
LLM-Guided Genetic Improvement: Envisioning Semantic Aware Automated Software Evolution.
Karine Even-Mendoza, Alexander E. I. Brownlee, Alina Geiger, Carol Hanna, Justyna Petke
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
LLM-Powered Fully Automated Chaos Engineering: Towards Enabling Anyone to Build Resilient Software Systems at Low Cost.
Daisuke Kikuta, Hiroki Ikeuchi, Kengo Tajiri
ASE2025AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
LLM-Powered Multi-Agent Collaboration for Intelligent Industrial On-Call Automation.
Ruowei Fu, Yang Zhang, Zeyu Che, Xin Wu, Zhenyu Zhong
ASE2025AI / LLM for SE
LLM-assisted Industrial-Scale Differential Testing of Package Incompatibilities in Linux Distributions.
Yuhao Yang, Chijin Zhou, Runzhe Wang, Weibo Zhang, Yuheng Shen
ASE2025Testing / QA; AI / LLM for SE
LLM-based Dynamic Differential Testing for Database Connectors with Reinforcement Learning-Guided Prompt Selection.
Ce Lyu, Yanhao Wang 0001, Jie Liang, Minghao Zhao 0001
ASE2025Testing / QA; AI / LLM for SE
LLMPort: Cross-file Patch Porting via Task Decomposition and Self-correction.
Bofei Chen, Lei Zhang, Peng Deng, Nan Wang, Haoyu Xu
ASE2025Debugging / Fault Localization / Diagnosis / Repair
LLMorph: Automated Metamorphic Testing of Large Language Models.
Steven Cho, Stefano Ruberto, Valerio Terragni
ASE2025Testing / QA
LLMs for Automated Unit Test Generation and Assessment in Java: The AgoneTest Framework.
Andrea Lops, Fedelucio Narducci, Azzurra Ragone, Michelantonio Trizio, Claudio Bartolini
ASE2025Testing / QA
LOSVER: Line-Level Modifiability Signal-Guided Vulnerability Detection and Classification.
Doha Nam, Jongmoon Baik
ASE2025Other
Lares: LLM-driven Code Slice Semantic Search for Patch Presence Testing.
Siyuan Li 0014, Yaowen Zheng, Hong Li 0004, Jingdong Guo, Chaopeng Dong
ASE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Latra: A Template-Based Language-Agnostic Transformation Framework for Effective Program Reduction.
Zhenyang Xu, Yiran Wang, Yongqiang Tian 0001, Mengxiao Zhang, Chengnian Sun
ASE2025Other
Learning Project-wise Subsequent Code Edits via Interleaving Neural-based Induction and Tool-based Deduction.
Chenyan Liu, Yun Lin 0001, Yuhuan Huang, Jiaxin Chang, Binhang Qi
ASE2025AI / LLM for SE
Learning from the Past: Real-World Exploit Migration for Smart Contract PoC Generation.
Kairan Sun, Zhengzi Xu, Kaixuan Li 0002, Lyuye Zhang, Yebo Feng
ASE2025Security / Privacy / Vulnerability; Maintenance / Evolution / Refactoring / Review
Let the Code Speak: Incorporating Program Dynamic State for Better Method-Level Fault Localization.
Yihao Qin, Shangwen Wang, Bo Lin 0011, Xin Peng 0010, Sheng Ouyang
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Leveraging Mixture-of-Experts Framework for Smart Contract Vulnerability Repair with Large Language Model.
Hang Yuan, Xizhi Hou, Lei Yu, Li Yang 0015, Jiayue Tang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
LineBreaker: Finding Token-Inconsistency Bugs with Large Language Models.
Hongbo Chen, Yifan Zhang 0010, Xing Han, Tianhao Mao, Huanyao Rong
ASE2025Other
Linguistic Theories Coincide with Misformalization in Temporal Logic.
Colin S. Gordon
ASE2025Other
LitterBox
Benedikt Fein, Florian Obermüller, Gordon Fraser 0001
ASE2025Other
LogAction: Consistent Cross-system Anomaly Detection through Logs via Active Domain Adaptation.
Chiming Duan, Minghua He, Pei Xiao 0007, Tong Jia, Xin Zhang
ASE2025Cloud / Microservices / Distributed Systems
LogMoE: Lightweight Expert Mixture for Cross-System Log Anomaly Detection.
Jiaxing Qi, Zhongzhi Luan, Shaohan Huang, Carol J. Fung, Yuchen Wang
ASE2025Other
LogPilot: Intent-aware and Scalable Alert Diagnosis for Large-scale Online Service Systems.
Zhihan Jiang, Jinyang Liu 0002, Yichen Li 0003, Haiyu Huang 0008, Xiao He 0008
ASE2025Other
LogSage: An LLM-Based Framework for CI/CD Failure Detection and Remediation with Industrial Validation.
Weiyuan Xu, Juntao Luo, Tao Huang, Kaixin Sui, Jie Geng
ASE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
LongCodeZip: Compress Long Context for Code Language Models.
Yuling Shi, Yichun Qian, Hongyu Zhang 0002, Beijun Shen, Xiaodong Gu 0002
ASE2025Other
Loupe: End-to-End Learning of Loop Unrolling Heuristics for Abstract Interpretation.
Maykel Mattar, Michele Alberti, Valentin Perrelle, Salah Sadou
ASE2025Other
LspFuzz: Hunting Bugs in Language Servers.
Hengcheng Zhu 0001, Songqiang Chen, Valerio Terragni, Lili Wei 0001, Yepang Liu 0001
ASE2025Testing / QA
M2QCode: A Model-Driven Framework for Generating Multi-Platform Quantum Programs.
Xiaoyu Guo 0007, Shinobu Saito, Jianjun Zhao 0001
ASE2025Other
MCTS-Refined CoT: High-Quality Fine-Tuning Data for LLM-Based Repository Issue Resolution.
Yibo Wang 0008, Zhihao Peng 0009, Ying Wang 0038, Zhao Wei, Hai Yu 0001
ASE2025AI / LLM for SE; DevOps / CI / Build / Release
MIMIC: Integrating Diverse Personality Traits for Better Game Testing Using Large Language Model.
Yifei Chen, Sarra Habchi, Lili Wei
ASE2025Testing / QA; AI / LLM for SE
Measuring LLM Code Generation Stability via Structural Entropy.
Yewei Song, Tiezhu Sun, Xunzhu Tang, Prateek Rajput, Tegawendé F. Bissyandé
ASE2025AI / LLM for SE
Measuring Software Resilience Using Socially Aware Truck Factor Estimation.
Alexis Butler, Daniel O'Keeffe, Santanu Kumar Dash 0001
ASE2025Other
Metamorphic Testing for Audio Content Moderation Software.
Wenxuan Wang 0001, Yongjiang Wu, Junyuan Zhang, Shuqing Li 0001, Yun Peng 0003
ASE2025Testing / QA
Metamorphic Testing of Deep Reinforcement Learning Agents with MDPMorph.
Jiapeng Li, Zheng Zheng, Yuning Xing, Daixu Ren, Steven Cho
ASE2025Testing / QA
Metrics Driven Reengineering and Continuous Code Improvement at Meta.
Audris Mockus, Peter C. Rigby, Rui Abreu 0001, Anatoly Akkerman, Yogesh Bhootada
ASE2025Other
Minuku: Detecting Diverse Display Issues in Mobile Apps with Small-scale Dataset.
Yongxiang Hu 0003, Ke Liu, Hailiang Jin, Shiyu Guo, Juxing Yuan
ASE2025Mobile / Web / GUI / Android
Mixture-of-Experts Low-Rank Adaptation for Multilingual Code Summarization.
Tianchen Yu, Li Yuan, Hailing Huang, Jiexin Wang, Yi Cai
ASE2025Other
MobileUPReg: Identifying User-Perceived Performance Regressions in Mobile OS Versions.
Wei Liu 0155, Yi Wen Heng, Feng Lin, Tse-Hsun Peter Chen, Ahmed E. Hassan
ASE2025Mobile / Web / GUI / Android; Performance / Energy / Reliability
Mockingbird: Efficient Excessive Data Exposures Detection via Dynamic Code Instrumentation.
Chenxiao Xia, Jiazheng Sun, Jun Zheng, Yu-an Tan, Hongyi Su
ASE2025Other
Multi-Modal Requirements Data-based Acceptance Criteria Generation using LLMs.
Fanyu Wang, Chetan Arora 0001, Yonghui Liu 0001, Kaicheng Huang, Chakkrit Tantithamthavorn
ASE2025Requirements / Modeling / Architecture
Multi-dimensional Assessment of Crowdsourced Testing Reports via LLMs.
Yue Wang, Yuan Zhang, Shengcheng Yu, Zhenyu Chen 0001
ASE2025Testing / QA
Multiple Schema-Conformant Declarative Code Generation.
Mehant Kammakomati, Srikanth G. Tamilselvam
ASE2025Other
NATE: A Network-Aware Testing Enhancer for Network-Related Fault Detection in Android Apps.
Yuanhong Lan, Shaoheng Cao, Yifei Lu, Minxue Pan, Xuandong Li
ASE2025Testing / QA; Mobile / Web / GUI / Android
Navigating the Labyrinth: Path-Sensitive Unit Test Generation with Large Language Models.
Dianshu Liao, Xin Yin, Shidong Pan, Chao Ni 0001, Zhenchang Xing
ASE2025Testing / QA
Non-termination Witnesses and Their Validation.
Zsófia Ádám, Paulína Ayaziová, Levente Bajczi, Dirk Beyer 0001, Marek Jankola
ASE2025Testing / QA
Not Every Patch is an Island: LLM-Enhanced Identification of Multiple Vulnerability Patches.
Yi Song, Dongchen Xie, Lin Xu, He Zhang, Chunying Zhou
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
NovaQ: Improving Quantum Program Testing through Diversity-Guided Test Case Generation.
Tiancheng Jin, Shangzhou Xia, Jianjun Zhao 0001
ASE2025Testing / QA
ORFuzz: Fuzzing the "Other Side" of LLM Safety - Testing Over-Refusal.
Haonan Zhang 0007, Dongxia Wang 0002, Yi Liu, Kexin Chen, Jiashui Wang
ASE2025Testing / QA; AI / LLM for SE
ORMorpher: An Interactive Framework for ORM Translation and Optimization.
Milan Abrahám, Pavel Koupil
ASE2025Performance / Energy / Reliability
OSSPREY: AI-Driven Forecasting and Intervention for OSS Project Sustainability.
Nafiz Imtiaz Khan, Priyal Soni, Arjun Ashok, Vladimir Filkov
ASE2025AI / LLM for SE
On Automating Configuration Dependency Validation via Retrieval-Augmented Generation.
Sebastian Simon, Alina Mailach, Johannes Dorn, Norbert Siegmund
ASE2025Testing / QA; DevOps / CI / Build / Release
On the (In)Security of Non-resettable Device Identifiers in Custom Android Systems.
Zikan Dong, Liu Wang 0002, Guoai Xu, Haoyu Wang 0001
ASE2025Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
On the Correctness of Software Merge.
Akira Mori, Masatomo Hashimoto
ASE2025Other
On the Robustness Evaluation of 3D Obstacle Detection Against Specifications in Autonomous Driving.
Tri Minh-Triet Pham, Bo Yang 0058, Jinqiu Yang 0001
ASE2025Other
Out of Distribution Detection in Self-adaptive Robots with AI-powered Digital Twins.
Erblin Isaku, Hassan Sartaj, Shaukat Ali 0001, Beatriz Sanguino, Tongtong Wang
ASE2025AI / LLM for SE
PALM: Synergizing Program Analysis and LLMs to Enhance Rust Unit Test Coverage.
Bei Chu, Yang Feng 0003, Kui Liu 0001, Hange Shi, Zifan Nan
ASE2025Testing / QA; Program Analysis / Verification / Formal Methods
PAT-Agent: Autoformalization for Model Checking.
Xinyue Zuo, Yifan Zhang 0019, Hongshu Wang, Yufan Cai 0001, Zhe Hou
ASE2025Program Analysis / Verification / Formal Methods
PEACE: Towards Efficient Project-Level Efficiency Optimization via Hybrid Code Editing.
Xiaoxue Ren, Jun Wan, Yun Peng, Zhongxin Liu 0002, Ming Liang
ASE2025Performance / Energy / Reliability
PROXiFY: A Bytecode Analysis Tool for Detecting and Classifying Proxy Contracts in Ethereum Smart Contracts.
Ilham A. Qasse, Mohammad Hamdaqa, Björn Þór Jónsson 0001
ASE2025Other
PoliCond: Condition-Aware Ontology-Driven LLMs for Privacy Policy Contradiction Analysis.
Yalin Feng, Yifei Lu, Minxue Pan
ASE2025Security / Privacy / Vulnerability
Polyglot: An Extensible Framework to Benchmark Code Translation with LLMs.
Marco Vieira, Priyam Ashish Shah, Bhavain Shah, Rrezarta Krasniqi
ASE2025Other
Practical Escape of Exploration Tarpits for Mini-Game Testing in an Industrial Setting.
Yuan Cao, Dezhi Ran, Haochuan Lu, Chao Guo, Xuran Hao
ASE2025Testing / QA
PrefGen: A Preference-Driven Methodology for Secure Yet Gas-Efficient Smart Contract Generation.
Zhiyuan Peng, Xin Yin, Zijie Zhou 0001, Chenhao Ying 0001, Chao Ni 0001
ASE2025Security / Privacy / Vulnerability
PrioTestCI: Efficient Test Case Prioritization in GitHub Workflows for CI Optimization.
Shubham Vasudeo Desai, Shonil Bhide, Souhaila Serbout, Luciano Marchezan, Wesley K. G. Assunção
ASE2025Testing / QA; Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Performance / Energy / Reliability
ProfMal: Detecting Malicious NPM Packages by the Synergy between Static and Dynamic Analysis.
Yiheng Huang, Wen Zheng, Susheng Wu, Bihuan Chen 0001, You Lu 0005
ASE2025Program Analysis / Verification / Formal Methods
Profile Coverage: Using Android Compilation Profiles to Evaluate Dynamic Testing.
Jakob Bleier, Felix Kehrer, Jürgen Cito, Martina Lindorfer
ASE2025Testing / QA; Mobile / Web / GUI / Android
Programmers' Visual Attention on Function Call Graphs During Code Summarization.
Samantha McLoughlin, Zachary Karas, Robert Wallace, Aakash Bansal, Collin McMillan
ASE2025Other
PromFuzz: Leveraging LLM-Driven and Bug-Oriented Composite Analysis for Detecting Functional Bugs in Smart Contracts.
Xingshuang Lin, Qinge Xie, Binbin Zhao, Yuan Tian 0001, Saman A. Zonouz
ASE2025Testing / QA; AI / LLM for SE
Prompt-with-Me: in-IDE Structured Prompt Management for LLM-Driven Software Engineering.
Ziyou Li, Agnia Sergeyuk, Maliheh Izadi
ASE2025AI / LLM for SE
Propagation-Based Vulnerability Impact Assessment for Software Supply Chains.
Bonan Ruan, Zhiwei Lin, Jiahao Liu 0005, Chuqi Zhang, Kaihang Ji
ASE2025Other
Protecting Source Code Privacy When Hunting Memory Bugs.
Jielun Wu, Bing Shui, Hongcheng Fan, Shengxin Wu, Rongxin Wu
ASE2025Security / Privacy / Vulnerability
Provable Fairness Repair for Deep Neural Networks.
Jianan Ma, Jingyi Wang, Qi Xuan, Zhen Wang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
PseudoFix: Refactoring Distorted Structures in Decompiled C Pseudocode.
Gangyang Li, Xiuwei Shang, Shaoyin Cheng, Junqi Zhang, Li Hu
ASE2025Maintenance / Evolution / Refactoring / Review
PyGress: Tool for Analyzing the Progression of Code Proficiency in Python OSS Projects.
Rujiphart Charatvaraphan, Bunradar Chatchaiyadech, Thitirat Sukijprasert, Chaiyong Ragkhitwetsagul, Morakot Choetkiertikul
ASE2025Other
PyTrim: A Practical Tool for Reducing Python Dependency Bloat.
Konstantinos Karakatsanis, Georgios Alexopoulos, Ioannis Karyotakis, Foivos Timotheos Proestakis, Evangelos Talos
ASE2025Other
QuanBench: Benchmarking Quantum Code Generation with Large Language Models.
Xiaoyu Guo 0007, Minggu Wang, Jianjun Zhao 0001
ASE2025Other
Quantum Machine Learning-based Test Oracle for Autonomous Mobile Robots.
Xinyi Wang 0004, Qinghua Xu, Paolo Arcaini, Shaukat Ali 0001, Thomas Peyrucain
ASE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android
Quirx: A Mutation-Based Framework for Evaluating Prompt Robustness in LLM-based Software.
Souhaila Serbout
ASE2025Testing / QA; AI / LLM for SE
R
Muzhi Yu, Zhengran Zeng, Wei Ye 0004, Jinan Sun, Xiaolong Bai
ASE2025Other
RAML: Toward Retrieval-Augmented Localization of Malicious Payloads in Android Apps.
Tiezhu Sun, Marco Alecci, Yewei Song, Xunzhu Tang, Kisub Kim
ASE2025Mobile / Web / GUI / Android
RFCAudit: AI Agent for Auditing Protocol Implementations Against RFC Specifications.
Mingwei Zheng, Chengpeng Wang 0001, Xuwei Liu, Jinyao Guo, Shiwei Feng 0002
ASE2025AI / LLM for SE
RFCScope: Detecting Logical Ambiguities in Internet Protocol Specifications.
Mrigank Pawagi, Lize Shao, Hyeonmin Lee, Yixin Sun, Wenxi Wang
ASE2025Other
RPG: Linux Kernel Fuzzing Guided by Distribution-Specific Runtime Parameter Interfaces.
Yuhan Chen, Yuheng Shen, Guoyu Yin, Fan Ding, Runzhe Wang
ASE2025Testing / QA
RSFuzz: A Robustness-Guided Swarm Fuzzing Framework Based on Behavioral Constraints.
Ruoyu Zhou, Zhiwei Zhang 0004, Haocheng Han, Xiaodong Zhang 0014, Zehan Chen
ASE2025Testing / QA
ReFuzzer: Feedback-Driven Approach to Enhance Validity of LLM-Generated Test Programs.
Iti Shree, Karine Even-Mendoza, Tomasz Radzik
ASE2025Testing / QA; AI / LLM for SE
RealisticCodeBench: Towards More Realistic Evaluation of Large Language Models for Code Generation.
Xiao Yu 0008, Haoxuan Chen, Lei Liu 0062, Xing Hu 0008, Jacky Wai Keung
ASE2025Other
Rechecking Recheck Requests in Continuous Integration: An Empirical Study of OpenStack.
Yelizaveta Brus, Rungroj Maipradit, Earl T. Barr, Shane McIntosh
ASE2025Human / Empirical / Socio-technical; DevOps / CI / Build / Release
Reflective Unit Test Generation for Precise Type Error Detection with Large Language Models.
Chen Yang, Ziqi Wang, Yanjie Jiang, Lin Yang 0030, Yuteng Zheng
ASE2025Testing / QA; Program Analysis / Verification / Formal Methods
Relia: Accelerating the Analysis of Cloud Access Control Policies.
Dan Wang, Peng Zhang 0011, Zhenrong Gu, Weibo Lin, Shibiao Jiang
ASE2025Cloud / Microservices / Distributed Systems
Repairing Leaks in Resource Wrappers.
Sanjay Malakar, Michael D. Ernst, Martin Kellogg, Manu Sridharan
ASE2025Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
RepoMasterEval: Evaluating Code Completion via Real-World Repositories.
Qinyun Wu, Chao Peng 0002, Pengfei Gao, Ruida Hu, Haoyu Gan
ASE2025Other
Requirements Development and Formalization for Reliable Code Generation: A Multi-Agent Vision.
Xu Lu 0003, Weisong Sun, Yiran Zhang, Ming Hu 0003, Cong Tian 0001
ASE2025Requirements / Modeling / Architecture
Risk Estimation in Differential Fuzzing via Extreme Value Theory.
Rafael Baez, Alejandro Olivas, Nathan K. Diamond, Marcelo F. Frias, Yannic Noller
ASE2025Testing / QA
Root Cause Analysis of RISC-V Build Failures via LLM and MCTS Reasoning.
Weipeng Shuai, Jie Liu 0008, Zhirou Ma, Liangyi Kang, Zehua Wang
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
RustAssure: Differential Symbolic Testing for LLM-Transpiled C-to-Rust Code.
Yubo Bai, Tapti Palit
ASE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
RustRepoTrans: Repository-level Context Code Translation Benchmark Targeting Rust.
Guangsheng Ou, Mingwei Liu 0002, Yuxuan Chen, Yanlin Wang 0001, Xin Peng 0001
ASE2025DevOps / CI / Build / Release
SATORI: Static Test Oracle Generation for REST APIs.
Juan C. Alonso, Alberto Martin-Lopez, Sergio Segura, Gabriele Bavota, Antonio Ruiz-Cortés
ASE2025Testing / QA
SCOPE: Evaluating and Enhancing Permission Explanation Transparency in Mobile Apps.
Liu Wang, Tianshu Zhou, Haoyu Wang, Xiyuan Liu, Yi Wang
ASE2025Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
SE-Jury: An LLM-as-Ensemble-Judge Metric for Narrowing the Gap with Human Evaluation in SE.
Xin Zhou 0014, Kisub Kim, Ting Zhang 0011, Martin Weyssow, Luís F. Gomes
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
SGCR: A Specification-Grounded Framework for Trustworthy LLM Code Review.
Kai Wang, Bingcheng Mao, Shuai Jia, Yujie Ding, Dongming Han
ASE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Maintenance / Evolution / Refactoring / Review
SMTgazer: Learning to Schedule SMT Algorithms via Bayesian Optimization.
Chuan Luo 0002, Shaoke Cui, Jianping Song, Xindi Zhang, Wei Wu 0011
ASE2025Performance / Energy / Reliability
SPICE: An Automated SWE-Bench Labeling Pipeline for Issue Clarity, Test Coverage, and Effort Estimation.
Gustavo Ansaldi Oliva, Gopi Krishnan Rajbahadur, Aaditya Bhatia, Haoxiang Zhang 0001, Yihao Chen
ASE2025Testing / QA; DevOps / CI / Build / Release
SSR: Safeguarding Staking Rewards by Defining and Detecting Logical Defects in DeFi Staking.
Zewei Lin, Jiachi Chen, Jingwen Zhang, Zexu Wang, Yuming Feng 0002
ASE2025Other
STaint: Detecting Second-Order Vulnerabilities in PHP Applications with LLM-Assisted Bi-Directional Static Taint Analysis.
Yuchen Ji, Hongchen Cao, Jingzhu He
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability
SateLight: A Satellite Application Update Framework for Satellite Computing.
Jinfeng Wen, Jianshu Zhao, Zixi Zhu, Xiaomin Zhang, Qi Liang
ASE2025Other
ScaleCirc: Scaling the Analysis over Circom Circuits.
Jinan Jiang, Haoran Qin, Xiapu Luo
ASE2025Other
Secure Transaction Semantics: Analysis, Vulnerability Detection, and Attack Modeling.
Yixuan Liu
ASE2025Security / Privacy / Vulnerability; Requirements / Modeling / Architecture
Securing Millions of Decentralized Identities in Alipay Super App with End-to-End Formal Verification.
Ziyu Mao, Xiaolin Ma, Lin Huang 0005, Huan Yang, Wu Zhang
ASE2025Program Analysis / Verification / Formal Methods; Mobile / Web / GUI / Android
Securing Self-Managed Third-Party Libraries.
Xin Zhou 0016, Jinwei Xu, He Zhang 0001, Yanjing Yang, Lanxin Yang
ASE2025Other
Security Debt in LLM Agent Applications: A Measurement Study of Vulnerabilities and Mitigation Trade-offs.
Zhuoxiang Shen, Jiarun Dai, Yuan Zhang 0009, Min Yang 0002
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
Seeing is Fixing: Cross-Modal Reasoning with Multimodal LLMs for Visual Software Issue Repair.
Kai Huang, Jian Zhang 0087, Xiaofei Xie, Chunyang Chen 0001
ASE2025Debugging / Fault Localization / Diagnosis / Repair
SemGuard: Real-Time Semantic Evaluator for Correcting LLM-Generated Code.
Qinglin Wang, Zhihong Sun, Ruyun Wang, Tao Huang, Zhi Jin 0001
ASE2025AI / LLM for SE
Should We Evaluate LLM Based Security Analysis Approaches on Open Source Systems?
Kohei Dozono, Jonas Engesser, Benjamin Hummel, Tobias Roehm, Alexander Pretschner
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
Shrunk, Yet Complete: Code Shrinking-Resilient Android Third-Party Library Detection.
Jingkun Zhang, Jingzheng Wu, Xiang Ling 0001, Tianyue Luo, Bolin Zhou
ASE2025Mobile / Web / GUI / Android
Sifting Truth from Coincidences: A Two-Stage Positive and Unlabeled Learning Model for Coincidental Correctness Detection.
Chunyan Liu, Huan Xie 0002, Yan Lei, Zhenyu Wu, Jinping Wang
ASE2025Other
Simulated Interactive Debugging.
Yannic Noller, Erick Chandra 0002, Srinidhi Chandrashekar, Kenny T. W. Choo, Cyrille Jégourel
ASE2025Debugging / Fault Localization / Diagnosis / Repair
SolContractEval: A Benchmark for Evaluating Contract-Level Solidity Code Generation.
Zhifan Ye, Jiachi Chen, Zhenzhe Shao, Lingfeng Bao, Xiaohu Yang 0001
ASE2025Other
Soleker: Uncovering Vulnerabilities in Solana Smart Contracts.
Kunsong Zhao, Yunpeng Tian, Zuchao Ma, Xiapu Luo
ASE2025Other
Spec2Code: Mapping Protocol Specification to Function-Level Code Implementation.
Yuekun Wang, Lili Quan, Xiaofei Xie, Junjie Wang, Jianjun Chen
ASE2025Program Analysis / Verification / Formal Methods
Speculative Automated Refactoring of Imperative Deep Learning Programs to Graph Execution.
Raffi Khatchadourian, Tatiana Castro Vélez, Mehdi Bagherzadeh 0001, Nan Jia, Anita Raja
ASE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Spinner: Detecting Locking Violations in the eBPF Runtime.
Priya Govindasamy, Joseph Bursey, Hsin-Wei Hung, Ardalan Amiri Sani
ASE2025Other
StackPlagger: A System for Identifying AI-Code Plagiarism on Stack Overflow.
Aman Swaraj, Harsh Goyal, Sumit Chadgal, Sandeep Kumar 0004
ASE2025AI / LLM for SE
State Field Coverage: A Metric for Oracle Quality.
Facundo Molina, Nazareno Aguirre, Alessandra Gorla
ASE2025Testing / QA
Streamlining Acceptance Test Generation for Mobile Applications Through Large Language Models: An Industrial Case Study.
Pedro Luís Fonseca, Bruno Lima, João Pascoal Faria
ASE2025Testing / QA; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android
Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems.
Dany Moshkovich, Sergey Zeltyn
ASE2025AI / LLM for SE
TensorGuard: Gradient-Based Model Fingerprinting for LLM Similarity Detection and Family Classification.
Zehao Wu, Yanjie Zhao 0001, Haoyu Wang 0001
ASE2025AI / LLM for SE
Tephra: Principled Discovery of Fuzzer Limitations.
Vasil Sarafov, David Markvica, Stefan Brunthaler 0001
ASE2025Testing / QA
Terminator: Enabling Efficient Fuzzing of Closed-Source GUI Programs by Automatic Coverage-Guided Termination.
Jonas Zabel, Philip Kolvenbach, Steven Arzt
ASE2025Testing / QA; Mobile / Web / GUI / Android
Testing Autonomous Driving Systems Through Blind-Spot Guided Fuzzing.
Sali Moussa
ASE2025Testing / QA
Tether: A Personalized Support Assistant for Software Engineers with ADHD.
Aarsh Shah, Cleyton V. C. de Magalhães, Kiev Gama, Ronnie de Souza Santos
ASE2025Other
The Cost of Downgrading Build Systems : A Case Study of Kubernetes.
Gareema Ranjan, Mahmoud Alfadel, Gengyi Sun, Shane McIntosh
ASE2025Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
The Fault in our Stats.
Alexi Turcotte, Neev Nirav Mehta
ASE2025Other
The Future of Software Transparency: Bridging Understanding, Measurement, and Practice.
Gregorio Dalia, Annibale Panichella, Andrea Di Sorbo, Gerardo Canfora, Corrado Aaron Visaggio
ASE2025Other
The Gold Digger in the Dark Forest: Industrial-Scale MEV Analysis in Ethereum.
Ningyu He, Tianyang Chi, Xiaohui Hu, Haoyu Wang
ASE2025Other
Thinking Longer, Not Larger: Enhancing Software Engineering Agents via Scaling Test-Time Compute.
Yingwei Ma, Yongbin Li, Yihong Dong, Xue Jiang, Yanhao Li
ASE2025Testing / QA
Token Sugar: Making Source Code Sweeter for LLMs through Token-Efficient Shorthand.
Zhensu Sun, Chengran Yang, Xiaoning Du 0001, Zhou Yang 0003, Li Li 0029
ASE2025Other
Towards Automated Governance: A DSL for Human-Agent Collaboration in Software Projects.
Adem Ait, Gwendal Jouneaux, Javier Luis Cánovas Izquierdo, Jordi Cabot
ASE2025Human / Empirical / Socio-technical
Towards Context-aware Mobile Privacy Notice: Implementation of A Deployable Contextual Privacy Policies Generator.
Haochen Gong, Zhen Tao, Shidong Pan, Zhenchang Xing, Xiaoyu Sun 0002
ASE2025Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Towards Generalizable Instruction Vulnerability Prediction via LLM-Enhanced Code Representation.
Bao Wen, Jingjing Gu, Jingxuan Zhang, Yang Liu 0390, Pengfei Yu 0002
ASE2025AI / LLM for SE
Towards More Accurate Static Analysis for Taint-Style Bug Detection in Linux Kernel.
Haonan Li 0009, Hang Zhang 0012, Kexin Pei, Zhiyun Qian
ASE2025Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability
Towards Reliable LLM-based Exam Generation Lessons Learned and Open Challenges in an Industrial Project.
Renzo Degiovanni, Jordi Cabot
ASE2025AI / LLM for SE
Training-Control-as-Code: Towards a declarative solution to control training.
Padmanabha Venkatagiri Seshadri, Harikrishnan Balagopal, Mehant Kammakomati, Ashok Pon Kumar, Dushyant Behl
ASE2025Other
TreeRanker: Fast and Model-Agnostic Ranking System for Code Suggestions in IDEs.
Daniele Cipollone, Egor Bogomolov, Arie van Deursen, Maliheh Izadi
ASE2025Other
Triangle: Empowering Incident Triage with Multi-Agent.
Zhaoyang Yu 0002, Aoyang Fang, Minghua Ma, Jaskaran Singh Walia, Chaoyun Zhang
ASE2025Other
TrioXpert: An Automated Incident Management Framework for Microservice System.
Yongqian Sun, Yu Luo, Xidao Wen, Yuan Yuan 0034, Xiaohui Nie
ASE2025Cloud / Microservices / Distributed Systems
Tron: Fuzzing Linux Network Stack via Protocol-System Call Payload Synthesis.
Qiang Zhang, Yifei Chu, Yuheng Shen, Jianzhong Liu, Heyuan Shi
ASE2025Testing / QA
TrustVis: A Multi-Dimensional Trustworthiness Evaluation Framework for Large Language Models.
Ruoyu Sun 0011, Da Song, Jiayang Song, Yuheng Huang 0004, Lei Ma 0003
ASE2025Other
Tuning LLM-based Code Optimization via Meta-Prompting: An Industrial Perspective.
Jingzhi Gong, Rafail Giavrimis, Paul Brookes, Vardan Voskanyan, Fan Wu 0009
ASE2025AI / LLM for SE; Performance / Energy / Reliability
Uncovering Discrimination Clusters: Quantifying and Explaining Systematic Fairness Violations.
Ranit Debnath Akash, Ashish Kumar, Verya Monjezi, Ashutosh Trivedi 0001, Gang Tan
ASE2025Other
Uncovering Prompt Elements: Cloning System Prompts from Behavioral Traces.
Yi Qian, Fei Peng, Hao Wu 0067, Ligeng Chen, Bing Mao 0001
ASE2025Other
Uncovering Systematic Failures of LLMs in Verifying Code Against Natural Language Specifications.
Haolin Jin, Huaming Chen
ASE2025Debugging / Fault Localization / Diagnosis / Repair
Understanding Feature Request Practice on GitHub via a Large-Scale Empirical Study.
Jiajun Li, Wenhua Yang, Minxue Pan, Yu Zhou
ASE2025Human / Empirical / Socio-technical
Understanding Resource Injection Vulnerabilities in Kubernetes Ecosystems.
Defang Bo, Jie Lu 0009, Feng Li 0045, Jingting Chen, Jinchen Wang
ASE2025Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
Understanding Software Engineering Agents: A Study of Thought-Action-Result Trajectories.
Islem Bouzenia, Michael Pradel
ASE2025Human / Empirical / Socio-technical
Understanding Uncertainty In LLMs.
Chandan Kumar Sah
ASE2025Other
Unit Test Update through LLM-Driven Context Collection and Error-Type-Aware Refinement.
Yuanhe Zhang, Zhiquan Yang, Shengyi Pan, Zhongxin Liu 0002
ASE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
United We Stand: Towards End-to-End Log-based Fault Diagnosis via Interactive Multi-Task Learning.
Minghua He, Chiming Duan, Pei Xiao 0007, Tong Jia, Siyu Yu
ASE2025Cloud / Microservices / Distributed Systems
Unlocking Reproducibility: Automating re-Build Process for Open-Source Software.
Behnaz Hassanshahi, Trong Nhan Mai, Benjamin Selwyn-Smith, Nicholas Allen
ASE2025DevOps / CI / Build / Release
Unseen Data Detection using Routing Entropy in Mixture-of-Experts for Autonomous Vehicles.
Sang In Lee, Donghwan Shin, Jihun Park
ASE2025Other
Using Active Learning to Train Predictive Mutation Testing with Minimal Data.
Miklos Borsi
ASE2025Testing / QA
Using Fourier Analysis and Mutant Clustering to Accelerate DNN Mutation Testing.
Ali Ghanbari 0001, Sasan Tavakkol
ASE2025Testing / QA
VERT: Polyglot Verified Equivalent Rust Transpilation with Large Language Models.
Aidan Z. H. Yang, Yoshiki Takashima, Brandon Paulsen, Josiah Dodds, Daniel Kroening
ASE2025Program Analysis / Verification / Formal Methods
VRExplorer: A Model-based Approach for Semi-Automated Testing of Virtual Reality Scenes.
Zhengyang Zhu, Hong-Ning Dai, Hanyang Guo, Zeqin Liao, Zibin Zheng
ASE2025Testing / QA
VRTestSniffer: Test Smell Detector for Virtual Reality (VR) Software Projects.
Faraz Gurramkonda, Avishak Chakroborty, Bruce Maxim, Mohamed Wiem Mkaouer, Foyzul Hassan
ASE2025Testing / QA
VUSC: An Extensible Research Platform for Java-Based Static Analysis.
Marc Miltenberger, Steven Arzt
ASE2025Program Analysis / Verification / Formal Methods
VeriExploit: Automatic Bug Reproduction in Smart Contracts via LLMs and Formal Methods.
Chenfeng Wei, Shiyu Cai, Yiannis Charalambous, Tong Wu 0028, Sangharatna Godboley
ASE2025Program Analysis / Verification / Formal Methods
Verification and Classification of Exploits for Node.js Vulnerabilities.
Sungmin Park
ASE2025Program Analysis / Verification / Formal Methods
Vessel: A Taxonomy of Reproducibility Issues for Container Images.
Kevin Pitstick, Alex Derr, Lihan Zhan, Sebastián Echeverría
ASE2025Cloud / Microservices / Distributed Systems
Vul-R2: A Reasoning LLM for Automated Vulnerability Repair.
Xin-Cheng Wen, Zirui Lin, Yijun Yang, Cuiyun Gao 0001, Deheng Ye
ASE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Vulnerability-Affected Versions Identification: How Far Are We?
Xingchu Chen, Chengwei Liu, Jialun Cao, Yang Xiao 0011, Xinyue Cai
ASE2025Other
WEST: Specification-Based Test Generation for WebAssembly.
Dongjun Youn, Wonho Shin, Sukyoung Ryu
ASE2025Testing / QA; Program Analysis / Verification / Formal Methods
WIBE: Watermarks for generated Images - Benchmarking & Evaluation.
Aleksey Yakushev, Aleksandr Akimenkov, Khaled Abud, Dmitry Obydenkov, Irina Serzhenko
ASE2025Other
Walk the Talk: Is Your Log-based Software Reliability Maintenance System Really Reliable?
Minghua He, Tong Jia, Chiming Duan, Pei Xiao 0007, Lingzhe Zhang
ASE2025Maintenance / Evolution / Refactoring / Review; Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
Watson: A Cognitive Observability Framework for the Reasoning of LLM-Powered Agents.
Benjamin Rombaut 0002, Sogol Masoumzadeh, Kirill Vasilevski, Dayi Lin, Ahmed E. Hassan
ASE2025AI / LLM for SE; Cloud / Microservices / Distributed Systems
What Types of Code Review Comments Do Developers Most Frequently Resolve?
Saul Goldman, Hong Yi Lin, Jirat Pasuksmit, Patanamon Thongtanunam, Chakkrit Kla Tantithamthavorn
ASE2025Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
What's DAT Smell? Untangling and Weaving the Disjoint Assertion Tangle Test Smell.
Monil Narang, Hang Du, James A. Jones
ASE2025Testing / QA
When Abstraction Breaks Physics: Rethinking Modular Design in Quantum Software.
Jianjun Zhao
ASE2025Requirements / Modeling / Architecture
When AllClose Fails: Round-Off Error Estimation for Deep Learning Programs.
Qi Zhan, Xing Hu 0008, Yuanyi Lin, Tongtong Xu, Xin Xia 0001
ASE2025AI / LLM for SE
When Autonomous Vehicle Meets V2X Cooperative Perception: How Far Are We?
An Guo 0002, Shuoxiao Zhang, Enyi Tang, Xinyu Gao, Haomin Pang
ASE2025Human / Empirical / Socio-technical
When Control Flows Deviate: Directed Grey-box Fuzzing with Probabilistic Reachability Analysis.
Peihong Lin, Pengfei Wang, Xu Zhou 0004, Wei Xie 0007, Xin Ren
ASE2025Testing / QA
When Does Wasm Malware Detection Fail? A Systematic Analysis of Their Robustness to Evasion.
Taeyoung Kim, Sanghak Oh, Kiho Lee, Weihang Wang 0001, Yonghwi Kwon 0001
ASE2025Security / Privacy / Vulnerability
When Faster Isn't Greener: The Hidden Costs of LLM-Based Code Optimization.
Tristan Coignion, Clément Quinton, Romain Rouvoy
ASE2025AI / LLM for SE; Performance / Energy / Reliability
Which Is Better For Reducing Outdated and Vulnerable Dependencies: Pinning or Floatingƒ.
Imranur Rahman, Jill Marley, William Enck, Laurie A. Williams
ASE2025Other
Who's to Blame? Rethinking the Brittleness of Automated Web GUI Testing from a Pragmatic Perspective.
Haonan Zhang 0006, Kundi Yao, Zishuo Ding, Lizhi Liao, Weiyi Shang
ASE2025Testing / QA; Mobile / Web / GUI / Android
Why AI Agents Still Need You: Findings from Developer-Agent Collaborations in the Wild.
Aayush Kumar, Yasharth Bajpai, Sumit Gulwani, Gustavo Soares, Emerson R. Murphy-Hill
ASE2025AI / LLM for SE; Human / Empirical / Socio-technical
Why Is My Transaction Risky? Understanding Smart Contract Semantics and Interactions in the NFT Ecosystem.
Yujing Chen, Xuanming Liu, Zhiyuan Wan, Zuobin Wang, David Lo 0001
ASE2025Security / Privacy / Vulnerability
WingMuzz: Blackbox Testing of IoT Protocols via Two-dimensional Fuzzing Schedule.
Xiaogang Zhu 0001, Enze Dai, Xiaotao Feng, Shaohua Wang 0002, Xin Xia 0001
ASE2025Testing / QA
Wired for Reuse: Automating Context-Aware Code Adaptation in IDEs via LLM-Based Agent.
Taiming Wang, Yanjie Jiang, Chunhao Dong, Yuxia Zhang, Hui Liu 0003
ASE2025AI / LLM for SE
XRintTest: An Automated Framework for User Interaction Testing in Extended Reality Applications.
Ruizhen Gu, José Miguel Rojas, Donghwan Shin 0001
ASE2025Testing / QA
Your Build Scripts Stink: The State of Code Smells in Build Scripts.
Mahzabin Tamanna, Yash Chandrani, Matthew Burrows, Brandon Wroblewski, Laurie A. Williams
ASE2025DevOps / CI / Build / Release
ZendDiff: Differential Testing of PHP Interpreter.
Yuancheng Jiang, Jianing Wang, Qiange Liu, Yeqi Fu, Jian Mao
ASE2025Testing / QA
evalSmarT: An LLM-Based Framework for Evaluating Smart Contract Generated Comments.
Fatou Ndiaye Mbodji, Mame Marieme C. Sougoufara, Wendkûuni C. Ouédraogo, Alioune Diallo, Kui Liu 0001
ASE2025AI / LLM for SE; Security / Privacy / Vulnerability
iCodeReviewer: Improving Secure Code Review with Mixture of Prompts.
Yun Peng, Kisub Kim, Linghan Meng, Kui Liu 0001
ASE2025Maintenance / Evolution / Refactoring / Review
iKnow: an Intent-Guided Chatbot for Cloud Operations with Retrieval-Augmented Generation.
Junjie Huang 0008, Yuedong Zhong, Guangba Yu, Zhihan Jiang, Minzhi Yan
ASE2025Cloud / Microservices / Distributed Systems
10 Years Later: Revisiting How Developers Search for Code.
Kathryn T. Stolee; Tobias Welp; Caitlin Sadowski; Sebastian G. Elbaum
FSE2025Human / Empirical / Socio-technical
A Causal Learning Framework for Enhancing Robustness of Source Code Models.
Junyao Ye; Zhen Li 0027; Xi Tang; Deqing Zou; Shouhuai Xu; Weizhong Qiang; Hai Jin 0001
FSE2025Other
A Comprehensive Study of Bug-Fix Patterns in Autonomous Driving Systems.
Yuntianyi Chen; Yuqi Huai; Yirui He; Shilong Li 0002; Changnam Hong; Qi Alfred Chen; Joshua Garcia
FSE2025Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical
A Knowledge Enhanced Large Language Model for Bug Localization.
Yue Li 0047; Bohan Liu 0003; Ting Zhang 0011; Zhiqi Wang; David Lo 0001; Lanxin Yang; Jun Lyu; He Zhang 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
A Mixed-Methods Study of Model-Based GUI Testing in Real-World Industrial Settings.
Shaoheng Cao; Renyi Chen; Wenhua Yang 0001; Minxue Pan; Xuandong Li
FSE2025Testing / QA; Human / Empirical / Socio-technical; Mobile / Web / GUI / Android
A New Approach to Evaluating Nullability Inference Tools.
Nima Karimipour; Erfan Arvan; Martin Kellogg; Manu Sridharan
FSE2025Other
Adaptive Random Testing with Q-grams: The Illusion Comes True.
Matteo Biagiola; Robert Feldt; Paolo Tonella
FSE2025Testing / QA
Alert Summarization for Online Service Systems by Validating Propagation Paths of Faults.
Jia Chen 0037; Yuang He; Peng Wang 0027; Xiaolei Chen 0001; Jie Shi 0010; Wei Wang 0009
FSE2025Other
AlphaTrans: A Neuro-Symbolic Compositional Approach for Repository-Level Code Translation and Validation.
Ali Reza Ibrahimzada; Kaiyao Ke; Mrigank Pawagi; Muhammad Salman Abid; Rangeet Pan; Saurabh Sinha 0003; Reyhaneh Jabbarvand
FSE2025Testing / QA; Program Analysis / Verification / Formal Methods; DevOps / CI / Build / Release
An Adaptive Language-Agnostic Pruning Method for Greener Language Models for Code.
Mootez Saad; José Antonio Hernández López; Boqi Chen; Dániel Varró; Tushar Sharma 0001
FSE2025Other
An Empirical Study of Bugs in Data Visualization Libraries.
Weiqi Lu; Yongqiang Tian 0001; Xiaohan Zhong; Haoyang Ma; Zhenyang Xu; Shing-Chi Cheung; Chengnian Sun
FSE2025Human / Empirical / Socio-technical
An Empirical Study of Code Clones from Commercial AI Code Generators.
Weibin Wu 0002; Haoxuan Hu; Zhaoji Fan; Yitong Qiao; Yizhan Huang; Yichen Li 0003; Zibin Zheng; Michael R. Lyu
FSE2025AI / LLM for SE; Human / Empirical / Socio-technical
An Empirical Study of Suppressed Static Analysis Warnings.
Huimin Hu; Yingying Wang; Julia Rubin; Michael Pradel
FSE2025Program Analysis / Verification / Formal Methods; Human / Empirical / Socio-technical
An Empirical Study on Release-Wise Refactoring Patterns.
Shayan Noei; Heng Li 0007; Ying Zou 0001
FSE2025Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Maintenance / Evolution / Refactoring / Review
Automated Extraction and Analysis of Developer's Rationale in Open Source Software.
Mouna Dhaouadi; Bentley Oakes; Michalis Famelis
FSE2025Human / Empirical / Socio-technical
Automated Recognition of Buggy Behaviors from Mobile Bug Reports.
Zhaoxu Zhang; Komei Ryu; Tingting Yu 0001; William G. J. Halfond
FSE2025Mobile / Web / GUI / Android
Automated Soap Opera Testing Directed by LLMs and Scenario Knowledge: Feasibility, Challenges, and Road Ahead.
Yanqi Su; Zhenchang Xing; Chong Wang 0013; Chunyang Chen 0001; Xiwei Xu 0001; Qinghua Lu 0001; Liming Zhu 0001
FSE2025Testing / QA
Automated Trustworthiness Oracle Generation for Machine Learning Text Classifiers.
Lam Nguyen Tung; Steven Cho; Xiaoning Du 0001; Neelofar; Valerio Terragni; Stefano Ruberto; Aldeida Aleti
FSE2025Testing / QA; AI / LLM for SE
Automated Unit Test Refactoring.
Yi Gao; Xing Hu 0008; Xiaohu Yang 0001; Xin Xia 0001
FSE2025Testing / QA; Maintenance / Evolution / Refactoring / Review
Automated and Accurate Token Transfer Identification and Its Applications in Cryptocurrency Security.
Shuwei Song; Ting Chen 0002; Ao Qiao; Xiapu Luo; Leqing Wang; Zheyuan He; Ting Wang 0006; Xiaodong Lin 0001; Peng He; Wensheng Zhang; Xiaosong Zhang 0001
FSE2025Security / Privacy / Vulnerability
Automatically Detecting Numerical Instability in Machine Learning Applications via Soft Assertions.
Shaila Sharmin; Anwar Hossain Zahid; Subhankar Bhattacharjee; Chiamaka Igwilo; Miryung Kim; Wei Le
FSE2025AI / LLM for SE
Automatically Fixing Dependency Breaking Changes.
Lukas Fruntke; Jens Krinke
FSE2025Maintenance / Evolution / Refactoring / Review
Beyond Functional Correctness: Investigating Coding Style Inconsistencies in Large Language Models.
Yanlin Wang 0001; Tianyue Jiang; Mingwei Liu 0002; Jiachi Chen; Mingzhi Mao; Xilin Liu 0001; Yuchi Ma; Zibin Zheng
FSE2025Other
Beyond PEFT: Layer-Wise Optimization for More Effective and Efficient Large Code Model Tuning.
Chaozheng Wang; Jia Feng; Shuzheng Gao; Cuiyun Gao 0001; Zongjie Li; Ting Peng; Hailiang Huang 0004; Yuetang Deng; Michael R. Lyu
FSE2025AI / LLM for SE; Performance / Energy / Reliability
Blended Analysis for Predictive Execution.
Yi Li 0048; Hridya Dhulipala; Aashish Yadavally; Xiaokai Rong; Shaohua Wang 0002; Tien N. Nguyen
FSE2025Other
Bridging Operator Semantic Inconsistencies: A Source-Level Cross-Framework Model Conversion Approach.
Xingpei Li; Yan Lei; Zhouyang Jia; Yuanliang Zhang; Haoran Liu; Liqian Chen; Wei Dong 0006; Shan-shan Li 0001
FSE2025Other
CAShift: Benchmarking Log-Based Cloud Attack Detection under Normality Shift.
Jiongchi Yu; Xiaofei Xie; Qiang Hu; Bowen Zhang; Ziming Zhao 0008; Yun Lin 0001; Lei Ma 0003; Ruitao Feng; Frank Liauw
FSE2025Security / Privacy / Vulnerability; Cloud / Microservices / Distributed Systems
CKTyper: Enhancing Type Inference for Java Code Snippets by Leveraging Crowdsourcing Knowledge in Stack Overflow.
Anji Li 0001; Neng Zhang 0001; Ying Zou 0001; Zhixiang Chen 0016; Jian Wang 0018; Zibin Zheng
FSE2025Program Analysis / Verification / Formal Methods
COFFE: A Code Efficiency Benchmark for Code Generation.
Yun Peng 0003; Jun Wan; Yichen Li 0003; Xiaoxue Ren
FSE2025Performance / Energy / Reliability
CRISPE: Semantic-Guided Execution Planning and Dynamic Reasoning for Enhancing Code Coverage Prediction.
Hridya Dhulipala; Aashish Yadavally; Smit Soneshbhai Patel; Tien N. Nguyen
FSE2025Testing / QA
CXXCrafter: An LLM-Based Agent for Automated C/C++ Open Source Software Building.
Zhengmin Yu; Yuan Zhang 0009; Ming Wen 0001; Yinan Nie; Wenhui Zhang; Min Yang 0002
FSE2025AI / LLM for SE; Human / Empirical / Socio-technical
Calibration of Large Language Models on Code Summarization.
Yuvraj Virk; Premkumar T. Devanbu; Toufique Ahmed
FSE2025Other
ChangeGuard: Validating Code Changes via Pairwise Learning-Guided Execution.
Lars Gröninger; Beatriz Souza; Michael Pradel
FSE2025Maintenance / Evolution / Refactoring / Review
ChatDBG: Augmenting Debugging with Large Language Models.
Kyla Levin; Nicolas van Kempen; Emery D. Berger; Stephen N. Freund
FSE2025Debugging / Fault Localization / Diagnosis / Repair
Clone Detection for Smart Contracts: How Far Are We?
Zuobin Wang; Zhiyuan Wan; Yujing Chen; Yun Zhang 0011; David Lo 0001; Difan Xie; Xiaohu Yang 0001
FSE2025Maintenance / Evolution / Refactoring / Review
Code Change Intention, Development Artifact, and History Vulnerability: Putting Them Together for Vulnerability Fix Detection by LLM.
Xu Yang; Wenhan Zhu; Michael Pacheco; Jiayuan Zhou; Shaowei Wang 0002; Xing Hu 0008; Kui Liu 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Maintenance / Evolution / Refactoring / Review
Code Red! On the Harmfulness of Applying Off-the-Shelf Large Language Models to Programming Tasks.
Ali Al-Kaswan; Sebastian Deatc; Begüm Koç; Arie van Deursen; Maliheh Izadi
FSE2025Other
Core Developer Turnover in the Rust Package Ecosystem: Prevalence, Impact, and Awareness.
Meng Fan; Yuxia Zhang; Klaas-Jan Stol; Hui Liu 0003
FSE2025Human / Empirical / Socio-technical
CoverUp: Effective High Coverage Test Generation for Python.
Juan Altmayer Pizzorno; Emery D. Berger
FSE2025Testing / QA
Cross-System Categorization of Abnormal Traces in Microservice-Based Systems via Meta-Learning.
Yuqing Wang 0002; Mika V. Mäntylä; Serge Demeyer; Mutlu Beyazit; Joanna Kisaakye; Jesse Nyyssölä
FSE2025Cloud / Microservices / Distributed Systems
De-duplicating Silent Compiler Bugs via Deep Semantic Representation.
Junjie Chen 0003; Xingyu Fan; Chen Yang; Shuang Liu 0007; Jun Sun 0001
FSE2025Other
DeclarUI: Bridging Design and Development with Automated Declarative UI Code Generation.
Ting Zhou; Yanjie Zhao 0001; Xinyi Hou; Xiaoyu Sun 0002; Kai Chen 0030; Haoyu Wang 0001
FSE2025Requirements / Modeling / Architecture; Mobile / Web / GUI / Android
Demystifying LLM-Based Software Engineering Agents.
Chunqiu Steven Xia; Yinlin Deng; Soren Dunn; Lingming Zhang 0001
FSE2025AI / LLM for SE
Demystifying Memorization in LLM-Based Program Repair via a General Hypothesis Testing Framework.
Jiaolong Kong; Xiaofei Xie; Shangqing Liu
FSE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Detecting Metadata-Related Bugs in Enterprise Applications.
Md Mahir Asef Kabir; Xiaoyin Wang; Na Meng 0001
FSE2025Other
Detecting Smart Contract State-Inconsistency Bugs via Flow Divergence and Multiplex Symbolic Execution.
Yinxi Liu; Wei Meng 0001; Yinqian Zhang
FSE2025Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability
Detecting and Handling WoT Violations by Learning Physical Interactions from Device Logs.
Bingkun Sun; Shiqi Sun; Jialin Ren; Mingming Hu; Kun Hu 0001; Liwei Shen; Xin Peng 0001
FSE2025Cloud / Microservices / Distributed Systems
Detecting and Reducing the Factual Hallucinations of Large Language Models with Metamorphic Testing.
Weibin Wu 0002; Yuhang Cao; Ning Yi; Rongyi Ou; Zibin Zheng
FSE2025Testing / QA
DiSCo: Towards Decompiling EVM Bytecode to Source Code using Large Language Models.
Xing Su; Hanzhong Liang; Hao Wu 0067; Ben Niu 0001; Fengyuan Xu; Sheng Zhong 0002
FSE2025Other
Directed Testing in MLIR: Unleashing Its Potential by Overcoming the Limitations of Random Fuzzing.
Weiyuan Tong; Zixu Wang; Zhanyong Tang; Jianbin Fang; Yuqun Zhang; Guixin Ye
FSE2025Testing / QA
Dissecting Real-World Cross-Language Bugs.
Haoran Yang 0002; Haipeng Cai
FSE2025Other
Divide-and-Conquer: Generating UI Code from Screenshots.
Yuxuan Wan; Chaozheng Wang; Yi Dong; Wenxuan Wang 0001; Shuqing Li 0001; Yintong Huo; Michael R. Lyu
FSE2025Mobile / Web / GUI / Android
Doc2OracLL: Investigating the Impact of Documentation on LLM-Based Test Oracle Generation.
Soneya Binta Hossain; Raygan Taylor; Matthew B. Dwyer
FSE2025Testing / QA; AI / LLM for SE
DuoReduce: Bug Isolation for Multi-layer Extensible Compilation.
Jiyuan Wang; Yuxin Qiu; Ben Limpanukorn; Hong Jin Kang; Qian Zhang 0020; Miryung Kim
FSE2025Other
DyLin: A Dynamic Linter for Python.
Aryaz Eghbali; Felix Burk; Michael Pradel
FSE2025Other
Dynamic Taint Tracking for Modern Java Virtual Machines.
Katherine Hough; Jonathan Bell 0001
FSE2025Security / Privacy / Vulnerability
Element-Based Automated DNN Repair with Fine-Tuned Masked Language Model.
Xu Wang 0007; Mingming Zhang; Xiangxin Meng; Jian Zhang 0087; Yang Liu 0003; Chunming Hu
FSE2025Debugging / Fault Localization / Diagnosis / Repair
Eliminating Backdoors in Neural Code Models for Secure Code Understanding.
Weisong Sun; Yuchen Chen; Chunrong Fang; Yebo Feng; Yuan Xiao 0003; An Guo 0002; Quanjun Zhang; Zhenyu Chen 0001; Baowen Xu; Yang Liu 0003
FSE2025AI / LLM for SE
Empirically Evaluating the Impact of Object-Centric Breakpoints on the Debugging of Object-Oriented Programs.
Valentin Bourcier; Pooja Rani 0001; Maximilian Ignacio Willembrinck Santander; Alberto Bacchelli; Steven Costiou
FSE2025Debugging / Fault Localization / Diagnosis / Repair
Enhancing Web Accessibility: Automated Detection of Issues with Generative AI.
Ziyao He; Syed Fatiul Huq; Sam Malek
FSE2025AI / LLM for SE; Mobile / Web / GUI / Android
Error Delayed Is Not Error Handled: Understanding and Fixing Propagated Error-Handling Bugs.
Haoran Liu; Shan-shan Li 0001; Zhouyang Jia; Yuanliang Zhang; Linxiao Bai; Si Zheng 0003; Xiaoguang Mao; Xiangke Liao
FSE2025Other
Expressing and Checking Statistical Assumptions.
Alexi Turcotte; Zheyuan Wu
FSE2025Other
Gleipner: A Benchmark for Gadget Chain Detection in Java Deserialization Vulnerabilities.
Bruno Kreyssig; Alexandre Bartel
FSE2025Other
Hallucination Detection in Large Language Models with Metamorphic Relations.
Borui Yang; Md Afif Al Mamun; Jie M. Zhang; Gias Uddin 0001
FSE2025Other
Has My Code Been Stolen for Model Training? A Naturalness Based Approach to Code Contamination Detection.
Haris Ali Khan; Yanjie Jiang; Qasim Umer; Yuxia Zhang; Waseem Akram 0007; Hui Liu 0003
FSE2025Other
HornBro: Homotopy-Like Method for Automated Quantum Program Repair.
Siwei Tan; Liqiang Lu; Debin Xiang; Tianyao Chu; Congliang Lang; Jintao Chen 0001; Xing Hu 0008; Jianwei Yin
FSE2025Debugging / Fault Localization / Diagnosis / Repair
How Do Programming Students Use Generative AI?
Christian Rahe; Walid Maalej
FSE2025AI / LLM for SE
IRepair: An Intent-Aware Approach to Repair Data-Driven Errors in Large Language Models.
Sayem Mohammad Imtiaz; Astha Singh; Fraol Batole; Hridesh Rajan
FSE2025Debugging / Fault Localization / Diagnosis / Repair
Impact of Request Formats on Effort Estimation: Are LLMs Different Than Humans?
Gül Çalikli; Mohammed Alhamed
FSE2025Other
Incorporating Verification Standards for Security Requirements Generation from Functional Specifications.
Xiaoli Lian; Shuaisong Wang; Hanyu Zou; Fang Liu 0032; Jiajun Wu 0024; Li Zhang 0029
FSE2025Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture
Integrating Large Language Models and Reinforcement Learning for Non-linear Reasoning.
Yoav Alon; Cristina David
FSE2025Other
It's Acting Odd! Exploring Equivocal Behaviors of Goodware.
Gregorio Dalia; Andrea Di Sorbo; Corrado Aaron Visaggio; Gerardo Canfora
FSE2025Other
LLM-Based Method Name Suggestion with Automatically Generated Context-Rich Prompts.
Waseem Akram 0007; Yanjie Jiang; Yuxia Zhang; Haris Ali Khan; Hui Liu 0003
FSE2025AI / LLM for SE
LLMDroid: Enhancing Automated Mobile App GUI Testing Coverage with Large Language Model Guidance.
Chenxu Wang 0011; Tianming Liu 0002; Yanjie Zhao 0001; Minghui Yang; Haoyu Wang 0001
FSE2025Testing / QA; AI / LLM for SE; Mobile / Web / GUI / Android
Large Language Models for In-File Vulnerability Localization Can Be "Lost in the End".
Francesco Sovrano; Adam Bauer; Alberto Bacchelli
FSE2025Other
Less Is More: On the Importance of Data Quality for Unit Test Generation.
Junwei Zhang; Xing Hu 0008; Shan Gao 0009; Xin Xia 0001; David Lo 0001; Shanping Li
FSE2025Testing / QA
Liberating Libraries through Automated Fuzz Driver Generation: Striking a Balance without Consumer Code.
Flavio Toffalini; Nicolas Badoux; Zurab Tsinadze; Mathias Payer
FSE2025Testing / QA
LlamaRestTest: Effective REST API Testing with Small Language Models.
Myeongsoo Kim; Saurabh Sinha 0003; Alessandro Orso
FSE2025Testing / QA
LookAhead: Preventing DeFi Attacks via Unveiling Adversarial Contracts.
Shoupeng Ren; Lipeng He; Tianyu Tu; Di Wu; Jian Liu 0012; Kui Ren 0001; Chun Chen 0001
FSE2025Other
Medusa: A Framework for Collaborative Development of Foundation Models with Automated Parameter Ownership Assignment.
Dezhi Ran; Yuan Cao; Yuzhe Guo; Yuetong Li; Mengzhou Wu; Simin Chen; Wei Yang 0013; Tao Xie 0001
FSE2025Other
MendelFuzz: The Return of the Deterministic Stage.
Han Zheng 0006; Flavio Toffalini; Marcel Böhme; Mathias Payer
FSE2025Other
MiSum: Multi-modality Heterogeneous Code Graph Learning for Multi-intent Binary Code Summarization.
Kangchen Zhu; Zhiliang Tian; Shangwen Wang; Weiguo Chen; Zixuan Dong; Mingyue Leng; Xiaoguang Mao
FSE2025Other
Mitigating Emergent Malware Label Noise in DNN-Based Android Malware Detection.
Haodong Li; Xiao Cheng 0002; Guohan Zhang; Guosheng Xu 0001; Guoai Xu; Haoyu Wang 0001
FSE2025Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Multi-modal Traffic Scenario Generation for Autonomous Driving System Testing.
Zhi Tu; Liangkun Niu; Wei Fan; Tianyi Zhang 0001
FSE2025Testing / QA
Mystique: Automated Vulnerability Patch Porting with Semantic and Syntactic-Enhanced LLM.
Susheng Wu; Ruisi Wang; Yiheng Cao; Bihuan Chen 0001; Zhuotong Zhou; Yiheng Huang; Junpeng Zhao; Xin Peng 0001
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
NLP Libraries, Energy Consumption and Runtime: An Empirical Study.
Rajrupa Chattaraj; Sridhar Chimalakonda
FSE2025Human / Empirical / Socio-technical; Performance / Energy / Reliability
No More Labelled Examples? An Unsupervised Log Parser with LLMs.
Junjie Huang 0008; Zhihan Jiang; Zhuangbin Chen; Michael R. Lyu
FSE2025Other
On the Characteristics and Impacts of Protestware Libraries.
Tanner Finken; Jesse Chen; Sazzadur Rahaman
FSE2025Other
On the Unnecessary Complexity of Names in X.509 and Their Impact on Implementations.
Yuteng Sun; Joyanta Debnath; Wenzheng Hong; Omar Chowdhury; Sze Yiu Chau
FSE2025Other
On-Demand Scenario Generation for Testing Automated Driving Systems.
Songyang Yan; Xiaodong Zhang 0014; Kunkun Hao; Haojie Xin; Yonggang Luo; Jucheng Yang 0001; Ming Fan 0002; Chao Yang 0025; Jun Sun 0001; Zijiang Yang 0006
FSE2025Testing / QA
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE).
Xu Yang; Shaowei Wang 0002; Jiayuan Zhou; Wenhan Zhu
FSE2025Other
PDCAT: Preference-Driven Compiler Auto-tuning.
Mingxuan Zhu; Zeyu Sun 0004; Dan Hao 0001
FSE2025Other
Pinning Is Futile: You Need More Than Local Dependency Versioning to Defend against Supply Chain Attacks.
Hao He 0012; Bogdan Vasilescu; Christian Kästner
FSE2025Other
Prompts Are Programs Too! Understanding How Developers Build Software Containing Prompts.
Jenny T. Liang; Melissa Lin; Nikitha Rao; Brad A. Myers
FSE2025Human / Empirical / Socio-technical; DevOps / CI / Build / Release
QSF: Multi-objective Optimization Based Efficient Solving for Floating-Point Constraints.
Xu Yang; Zhenbang Chen 0001; Wei Dong 0006; Ji Wang 0001
FSE2025Performance / Energy / Reliability
ROSCallBaX: Statically Detecting Inconsistencies in Callback Function Setup of Robotic Systems.
Sayali Kate; Yifei Gao; Shiwei Feng 0002; Xiangyu Zhang 0001
FSE2025Other
Ransomware Detection through Temporal Correlation between Encryption and I/O Behavior.
Lihua Guo; Yiwei Hou; Chijin Zhou; Quan Zhang 0003; Yu Jiang 0001
FSE2025Other
RePurr: Automated Repair of Block-Based Learners' Programs.
Sebastian Schweikl; Gordon Fraser 0001
FSE2025Debugging / Fault Localization / Diagnosis / Repair
Recasting Type Hints from WebAssembly Contracts.
Kunsong Zhao; Zihao Li 0001; Weimin Chen; Xiapu Luo; Ting Chen 0002; Guozhu Meng; Yajin Zhou
FSE2025Program Analysis / Verification / Formal Methods
RegTrieve: Reducing System-Level Regression Errors for Machine Learning Systems via Retrieval-Enhanced Ensemble.
Junming Cao; Xuwen Xiang; Mingfei Cheng; Bihuan Chen 0001; Xinyan Wang; You Lu 0005; Chaofeng Sha; Xiaofei Xie; Xin Peng 0001
FSE2025Testing / QA; AI / LLM for SE
ReproCopilot: LLM-Driven Failure Reproduction with Dynamic Refinement.
Tanakorn Leesatapornwongsa; Fazle Elahi Faisal; Suman Nath
FSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Revisiting Optimization-Resilience Claims in Binary Diffing Tools: Insights from LLVM Peephole Optimization Analysis.
Xiaolei Ren 0001; Mengfei Ren 0001; Yu Lei 0001; Jiang Ming 0002
FSE2025Performance / Energy / Reliability
Revolutionizing Newcomers' Onboarding Process in OSS Communities: The Future AI Mentor.
Xin Tan 0003; Xiao Long; Yinghao Zhu; Lin Shi 0006; Xiaoli Lian; Li Zhang 0029
FSE2025AI / LLM for SE
Scene Flow Specifications: Encoding and Monitoring Rich Temporal Safety Properties of Autonomous Systems.
Trey Woodlief; Felipe Toledo; Matthew B. Dwyer; Sebastian G. Elbaum
FSE2025Other
Scientific Open-Source Software Is Less Likely to Become Abandoned Than One Might Think! Lessons from Curating a Catalog of Maintained Scientific Software.
Addi Malviya-Thakur; Reed Milewicz; Mahmoud Jahanshahi; Lavínia Paganini; Bogdan Vasilescu; Audris Mockus
FSE2025Other
SemBIC: Semantic-Aware Identification of Bug-Inducing Commits.
Xiao Chen 0026; Hengcheng Zhu 0001; Jialun Cao; Ming Wen 0001; Shing-Chi Cheung
FSE2025Other
Smaller but Better: Self-Paced Knowledge Distillation for Lightweight yet Effective LCMs.
Yujia Chen 0004; Yang Ye; Zhongqi Li; Yuchi Ma; Cuiyun Gao 0001
FSE2025Other
Smart Contract Fuzzing Towards Profitable Vulnerabilities.
Ziqiao Kong; Cen Zhang; Maoyi Xie; Ming Hu 0003; Yue Xue; Ye Liu 0012; Haijun Wang 0002; Yang Liu 0003
FSE2025Testing / QA; Security / Privacy / Vulnerability
SmartNote: An LLM-Powered, Personalised Release Note Generator That Just Works.
Farbod Daneshyan; Runzhi He; Jianyu Wu; Minghui Zhou 0001
FSE2025AI / LLM for SE; DevOps / CI / Build / Release
SmartShot: Hunt Hidden Vulnerabilities in Smart Contracts using Mutable Snapshots.
Ruichao Liang; Jing Chen 0003; Ruochen Cao; Kun He 0008; Ruiying Du; Shuhua Li; Zheng Lin 0001; Cong Wu 0003
FSE2025Other
Software Fairness Dilemma: Is Bias Mitigation a Zero-Sum Game?
Zhenpeng Chen 0001; Xinyue Li; Jie M. Zhang; Weisong Sun; Ying Xiao; Tianlin Li; Yiling Lou; Yang Liu 0003
FSE2025Other
Standing on the Shoulders of Giants: Bug-Aware Automated GUI Testing via Retrieval Augmentation.
Mengzhuo Chen; Zhe Liu 0025; Chunyang Chen 0001; Junjie Wang 0001; Boyu Wu; Jun Hu 0015; Qing Wang 0001
FSE2025Testing / QA; Mobile / Web / GUI / Android
Statement-Level Adversarial Attack on Vulnerability Detection Models via Out-of-Distribution Features.
Xiaohu Du; Ming Wen 0001; Haoyu Wang; Zichao Wei; Hai Jin 0001
FSE2025Security / Privacy / Vulnerability
Teaching AI the 'Why' and 'How' of Software Vulnerability Fixes.
Amiao Gao; Zenong Zhang; Simin Wang; Liguo Huang; Shiyi Wei; Vincent Ng 0001
FSE2025AI / LLM for SE
The Landscape of Toxicity: An Empirical Investigation of Toxicity on GitHub.
Jaydeb Sarker; Asif Kamal Turzo; Amiangshu Bosu
FSE2025Human / Empirical / Socio-technical
The Struggles of LLMs in Cross-Lingual Code Clone Detection.
Micheline Bénédicte Moumoula; Abdoul Kader Kaboré; Jacques Klein; Tegawendé F. Bissyandé
FSE2025Maintenance / Evolution / Refactoring / Review
Today's Cat Is Tomorrow's Dog: Accounting for Time-Based Changes in the Labels of ML Vulnerability Detection Approaches.
Ranindya Paramitha; Yuan Feng; Fabio Massacci
FSE2025Maintenance / Evolution / Refactoring / Review
Towards Diverse Program Transformations for Program Simplification.
Haibo Wang; Zezhong Xing; Chengnian Sun; Zheng Wang 0001; Shin Hwei Tan
FSE2025Other
Towards Understanding Docker Build Faults in Practice: Symptoms, Root Causes, and Fix Patterns.
Yiwen Wu 0001; Yang Zhang 0026; Tao Wang 0006; Bo Ding 0007; Huaimin Wang 0001
FSE2025Debugging / Fault Localization / Diagnosis / Repair; DevOps / CI / Build / Release
Towards Understanding Fine-Grained Programming Mistakes and Fixing Patterns in Data Science.
Wei-Hao Chen; Jia Lin Cheoh; Manthan Keim; Sabine Brunswicker; Tianyi Zhang 0001
FSE2025Other
Towards Understanding Performance Bugs in Popular Data Science Libraries.
Haowen Yang; Zhengda Li; Zhiqing Zhong; Xiaoying Tang 0002; Pinjia He
FSE2025Performance / Energy / Reliability
TracePicker: Optimization-Based Trace Sampling for Microservice-Based Systems.
Shuaiyu Xie; Jian Wang 0018; Maodong Li 0006; Peiran Chen; Jifeng Xuan; Bing Li 0010
FSE2025Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
Understanding Debugging as Episodes: A Case Study on Performance Bugs in Configurable Software Systems.
Max Weber; Alina Mailach; Sven Apel; Janet Siegmund; Raimund Dachselt; Norbert Siegmund
FSE2025Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical; Performance / Energy / Reliability
Understanding Industry Perspectives of Static Application Security Testing (SAST) Evaluation.
Yuan Li; Peisen Yao; Kan Yu; Chengpeng Wang 0001; Yaoyang Ye; Song Li 0006; Meng Luo 0002; Yepang Liu 0001; Kui Ren 0001
FSE2025Testing / QA; Security / Privacy / Vulnerability
Understanding and Characterizing Mock Assertions in Unit Tests.
Hengcheng Zhu 0001; Valerio Terragni; Lili Wei 0001; Shing-Chi Cheung; Jiarong Wu; Yepang Liu 0001
FSE2025Testing / QA
UnitCon: Synthesizing Targeted Unit Tests for Java Runtime Exceptions.
Sujin Jang; Yeonhee Ryou; Heewon Lee; Kihong Heo
FSE2025Testing / QA
Unlocking Optimal ORM Database Designs: Accelerated Tradeoff Analysis with Transformers.
Md Rashedul Hasan; Mohammad Rashedul Hasan; Hamid Bagheri
FSE2025Other
VLATest: Testing and Evaluating Vision-Language-Action Models for Robotic Manipulation.
Zhijie Wang 0014; Zhehua Zhou; Jiayang Song; Yuheng Huang 0004; Zhan Shu 0001; Lei Ma 0003
FSE2025Testing / QA
VulPA: Detecting Semantically Recurring Vulnerabilities with Multi-object Typestate Analysis.
Liqing Cao; Haofeng Li; Chenghang Shi; Jie Lu 0009; Haining Meng; Lian Li 0002; Jingling Xue
FSE2025Other
Who Will Stop Contributing to OSS Projects? Predicting Company Turnover Based on Initial Behavior.
Mian Qin; Yuxia Zhang; Klaas-Jan Stol; Hui Liu 0003
FSE2025Other
Why the Proof Fails in Different Versions of Theorem Provers: An Empirical Study of Compatibility Issues in Isabelle.
Xiaokun Luan; David Sanán; Zhe Hou; Qiyuan Xu; Chengwei Liu; Yufan Cai 0001; Yang Liu 0003; Meng Sun 0002
FSE2025Human / Empirical / Socio-technical
Zero-Shot Cross-Domain Code Search without Fine-Tuning.
Keyu Liang; Zhongxin Liu 0002; Chao Liu 0014; Zhiyuan Wan; David Lo 0001; Xiaohu Yang 0001
FSE2025Other
"Get Me in the Groove": a Mixed Methods Study on Supporting Adhd Professional Programmers.
Kaia Newman, Sarah Snay, Madeline Endres, Manasvi Parikh, Andrew Begel
ICSE2025Human / Empirical / Socio-technical
$ZTD_{\text{JAVA}}$: Mitigating Software Supply Chain Vulnerabilities via Zero-Trust Dependencies.
Paschal C. Amusuo, Kyle A. Robinson, Tanmay Singla, Huiyun Peng, Aravind Machiry
ICSE2025Other
$\mu \text{PRL}$: A Mutation Testing Pipeline for Deep Reinforcement Learning Based on Real Faults.
Deepak-George Thomas, Matteo Biagiola, Nargiz Humbatova, Mohammad Wardat, Gunel Jahangirova
ICSE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release
3DGen: AI-Assisted Generation of Provably Correct Binary Format Parsers.
Sarah Fakhoury, Markus Kuppe 0001, Shuvendu K. Lahiri, Tahina Ramananandro, Nikhil Swamy
ICSE2025AI / LLM for SE
A Catalog of Micro Frontends Anti-Patterns.
Nabson Paiva Souza da Silva, Eriky Rodrigues, Tayana Conte
ICSE2025Other
A Differential Testing Framework to Identify Critical AV Failures Leveraging Arbitrary Inputs.
Trey Woodlief, Carl Hildebrandt, Sebastian G. Elbaum
ICSE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
A First Look at Conventional Commits Classification.
Qunhong Zeng, Yuxia Zhang, Zhiqing Qiu, Hui Liu
ICSE2025Other
A Large-Scale Study of Model Integration in ML-Enabled Software Systems.
Yorick Sens, Henriette Knopp, Sven Peldszus, Thorsten Berger
ICSE2025Human / Empirical / Socio-technical
A Little Goes a Long Way: Tuning Configuration Selection for Continuous Kernel Fuzzing.
Sanan Hasanov, Stefan Nagy, Paul Gazzillo
ICSE2025Testing / QA; DevOps / CI / Build / Release
A Multi-Agent Approach for REST API Testing with Semantic Graphs and LLM-Driven Inputs.
Myeongsoo Kim, Tyler Stennett, Saurabh Sinha 0003, Alessandro Orso
ICSE2025Testing / QA; AI / LLM for SE
A Multiple Representation Transformer with Optimized Abstract Syntax Tree for Efficient Code Clone Detection.
Tianchen Yu, Li Yuan, Liannan Lin, Hongkui He
ICSE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
A Study of Undefined Behavior Across Foreign Function Boundaries in Rust Libraries.
Ian McCormack, Joshua Sunshine, Jonathan Aldrich
ICSE2025Human / Empirical / Socio-technical
A Tale of Two DL Cities: When Library Tests Meet Compiler.
Qingchao Shen, Yongqiang Tian 0001, Haoyang Ma, Junjie Chen 0003, Lili Huang
ICSE2025Testing / QA
A Test Oracle for Reinforcement Learning Software Based on Lyapunov Stability Control Theory.
Shiyu Zhang, Haoyang Song, Qixin Wang 0001, Henghua Shen, Yu Pei 0001
ICSE2025Testing / QA
ADAMAS: Adaptive Domain-Aware Performance Anomaly Detection in Cloud Service Systems.
Wenwei Gu, Jiazhen Gu, Jinyang Liu 0002, Zhuangbin Chen, Jianping Zhang 0002
ICSE2025Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
Accessibility Issues in Ad-Driven Web Applications.
Abdul Haddi Amjad, Muhammad Danish, Bless Jah, Muhammad Ali Gulzar
ICSE2025Mobile / Web / GUI / Android
Accounting for Missing Events in Statistical Information Leakage Analysis.
Seongmin Lee 0001, Shreyas Minocha, Marcel Böhme
ICSE2025Other
Aligning the Objective of LLM-Based Program Repair.
Junjielong Xu, Ying Fu, Shin Hwei Tan, Pinjia He
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
An Empirical Study of Proxy Contracts at the Ethereum Ecosystem Scale.
Mengya Zhang, Preksha Shukla, Wuqi Zhang, Zhuo Zhang 0002, Pranav Agrawal 0002
ICSE2025Human / Empirical / Socio-technical
An Empirical Study on Automatically Detecting AI-Generated Source Code: How Far are We?
Hyunjae Suh, Mahan Tafreshipour, Jiawei Li 0013, Adithya Bhattiprolu, Iftekhar Ahmed 0001
ICSE2025AI / LLM for SE; Human / Empirical / Socio-technical
An Empirical Study on Commit Message Generation Using LLMs via In-Context Learning.
Yifan Wu 0002, Yunpeng Wang, Ying Li 0012, Wei Tao, Siyu Yu
ICSE2025Human / Empirical / Socio-technical; DevOps / CI / Build / Release
An Empirical Study on Package-Level Deprecation in Python Ecosystem.
Zhiqing Zhong, Shilin He, Haoxuan Wang, Boxi Yu, Haowen Yang
ICSE2025Human / Empirical / Socio-technical
An Empirical Study on Reproducible Packaging in Open-Source Ecosystems.
Giacomo Benedetti, Oreofe Solarin, Courtney Miller, Greg Tystahl, William Enck
ICSE2025Human / Empirical / Socio-technical
An Exploratory Study of ML Sketches and Visual Code Assistants.
Luís F. Gomes, Vincent J. Hellendoorn, Jonathan Aldrich, Rui Abreu 0001
ICSE2025Human / Empirical / Socio-technical
An Exploratory Study on the Engineering of Security Features.
Kevin Hermann, Sven Peldszus, Jan-Philipp Steghöfer, Thorsten Berger
ICSE2025Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
An Extensive Empirical Study of Nondeterministic Behavior in Static Analysis Tools.
Miao Miao 0001, Austin Mordahl, Dakota Soles, Alice Beideck, Shiyi Wei
ICSE2025Program Analysis / Verification / Formal Methods; Human / Empirical / Socio-technical
An LLM-Based Agent-Oriented Approach for Automated Code Design Issue Localization.
Fraol Batole, David O'Brien, Tien N. Nguyen, Robert Dyer 0001, Hridesh Rajan
ICSE2025AI / LLM for SE; Requirements / Modeling / Architecture
Analyzing the Feasibility of Adopting Google's Nonce-Based CSP Solutions on Websites.
Mengxia Ren, Anhao Xiang, Chuan Yue
ICSE2025Other
Answering User Questions About Machine Learning Models Through Standardized Model Cards.
Tajkia Rahman Toma, Balreet Grewal, Cor-Paul Bezemer
ICSE2025AI / LLM for SE
Are LLMs Correctly Integrated into Software Systems?
Yuchen Shao, Yuheng Huang 0004, Jiawei Shen, Lei Ma 0003, Ting Su 0001
ICSE2025Other
Are We Learning the Right Features? A Framework for Evaluating DL-Based Software Vulnerability Detection Solutions.
Satyaki Das, Syeda Tasnim Fabiha, Saad Shafiq, Nenad Medvidovic
ICSE2025Other
AssetHarvester: A Static Analysis Tool for Detecting Secret-Asset Pairs in Software Artifacts.
Setu Kumar Basak, K. Virgil English, Ken Ogura, Vitesh Kambara, Bradley Reaves
ICSE2025Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability
Automated Accessibility Analysis of Dynamic Content Changes on Mobile Apps.
Forough Mehralian, Ziyao He, Sam Malek
ICSE2025Maintenance / Evolution / Refactoring / Review; Mobile / Web / GUI / Android
Automated Generation of Accessibility Test Reports from Recorded User Transcripts.
Syed Fatiul Huq, Mahan Tafreshipour, Kate Kalcevich, Sam Malek
ICSE2025Testing / QA; Mobile / Web / GUI / Android
Automated Test Generation For Smart Contracts via On-Chain Test Case Augmentation and Migration.
Jiashuo Zhang 0001, Jiachi Chen, John Grundy 0001, Jianbo Gao 0003, Yanlin Wang 0001
ICSE2025Testing / QA; Maintenance / Evolution / Refactoring / Review
Automated, Unsupervised, and Auto-Parameterized Inference of Data Patterns and Anomaly Detection.
Qiaolin Qin, Heng Li 0007, Ettore Merlo, Maxime Lamothe
ICSE2025Other
Automating a Complete Software Test Process Using LLMs: An Automotive Case Study.
Shuai Wang, Yinan Yu, Robert Feldt, Dhasarathy Parthasarathy
ICSE2025Testing / QA; Human / Empirical / Socio-technical
BDefects4NN: A Backdoor Defect Database for Controlled Localization Studies in Neural Networks.
Yisong Xiao, Aishan Liu, Xinwei Zhang 0010, Tianyuan Zhang 0004, Tianlin Li
ICSE2025AI / LLM for SE; Security / Privacy / Vulnerability
BSan: A Powerful Identifier-Based Hardware-Independent Memory Error Detector for COTS Binaries.
Wen Zhang, Botang Xiao, Qingchen Kong, Le Guan, Wenwen Wang 0001
ICSE2025Other
Between Lines of Code: Unraveling the Distinct Patterns of Machine and Human Programmers.
Yuling Shi, Hongyu Zhang 0002, Chengcheng Wan 0001, Xiaodong Gu 0002
ICSE2025Human / Empirical / Socio-technical
Boosting Code-line-level Defect Prediction with Spectrum Information and Causality Analysis.
Shiyu Sun, Yanhui Li, Lin Chen, Yuming Zhou, Jianhua Zhao
ICSE2025Other
Boosting Path-Sensitive Value Flow Analysis Via Removal of Redundant Summaries.
Yongchao Wang, Yuandao Cai, Charles Zhang 0001
ICSE2025Other
Boosting Static Resource Leak Detection via LLM-based Resource-Oriented Intention Inference.
Chong Wang, Jianan Liu, Xin Peng, Yang Liu, Yiling Lou
ICSE2025AI / LLM for SE; Performance / Energy / Reliability
COCA: Generative Root Cause Analysis for Distributed Systems with Code Knowledge.
Yichen Li 0003, Yulun Wu, Jinyang Liu 0002, Zhihan Jiang, Zhuangbin Chen
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
Calibration and Correctness of Language Models for Code.
Claudio Spiess, David Gros 0001, Kunal Suresh Pai, Michael Pradel, Md. Rafiqul Islam Rabin
ICSE2025Other
Can an LLM Find Its Way Around a Spreadsheet?
Cho-Ting Lee, Andrew Neeser, Shengzhe Xu, Jay Katyan, Patrick Cross
ICSE2025AI / LLM for SE
Chatgpt Inaccuracy Mitigation During Technical Report Understanding: Are we There Yet?
Salma Begum Tamanna, Gias Uddin 0001, Song Wang 0009, Lan Xia, Longyu Zhang
ICSE2025AI / LLM for SE
Chatgpt-Based Test Generation for Refactoring Engines Enhanced by Feature Analysis on Examples.
Chunhao Dong, Yanjie Jiang, Yuxia Zhang, Yang Zhang, Hui Liu
ICSE2025Testing / QA; AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
Chord: Towards a Unified Detection of Blockchain Transaction Parallelism Bugs.
Yuanhang Zhou, Zhen Yan, Yuanliang Chen, Fuchen Ma, Ting Chen 0002
ICSE2025Security / Privacy / Vulnerability
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE.
Benjamin Steenhoek, Kalpathy Sivaraman, Renata Saldivar Gonzalez, Yevhen Mohylevskyy, Roshanak Zilouchian Moghaddam
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair; Human / Empirical / Socio-technical
Clozemaster: Fuzzing Rust Compiler by Harnessing Llms for Infilling Masked Real Programs.
Hongyan Gao, Yibiao Yang, Maolin Sun, Jiangchang Wu, Yuming Zhou
ICSE2025Testing / QA
Code Cloning in Solidity Smart Contracts: Prevalence, Evolution, and Impact on Development.
Ran Mo, Haopeng Song, Wei Ding, Chaochao Wu
ICSE2025Maintenance / Evolution / Refactoring / Review
Code Comment Inconsistency Detection and Rectification Using a Large Language Model.
Guoping Rong, Yongda Yu, Song Liu, Xin Tan, Tianyi Zhang
ICSE2025AI / LLM for SE
Code Today, Deadline Tomorrow: Procrastination Among Software Developers.
Zeinabsadat Saghi, Thomas Zimmermann 0001, Souti Chattopadhyay
ICSE2025Human / Empirical / Socio-technical
CodeImprove: Program Adaptation for Deep Code Models.
Ravishka Rathnasuriya, Zijie Zhao, Wei Yang 0013
ICSE2025Other
Combining Fine-Tuning and LLM-Based Agents for Intuitive Smart Contract Auditing with Justifications.
Wei Ma 0014, Daoyuan Wu, Yuqiang Sun 0001, Tianwen Wang, Shangqing Liu
ICSE2025AI / LLM for SE; Security / Privacy / Vulnerability
Coni: Detecting Database Connector Bugs via State-Aware Test Case Generation.
Wenqian Deng, Jie Liang 0006, Zhiyong Wu 0010, Jingzhou Fu, Mingzhe Wang
ICSE2025Testing / QA
ConsCS: Effective and Efficient Verification of Circom Circuits.
Jinan Jiang, Xinghao Peng, Jinzhao Chu, Xiapu Luo
ICSE2025Program Analysis / Verification / Formal Methods
Constrained LTL Specification Learning from Examples.
Changjian Zhang, Parv Kapoor, Ian Dardik, Leyi Cui, Rômulo Meira-Góes
ICSE2025Program Analysis / Verification / Formal Methods
Context Conquers Parameters: Outperforming Proprietary Llm in Commit Message Generation.
Aaron Imani, Iftekhar Ahmed 0001, Mohammad Moshirpour
ICSE2025AI / LLM for SE; DevOps / CI / Build / Release
Cooperative Software Verification via Dynamic Program Splitting.
Cedric Richter, Marek Chalupa, Marie-Christine Jakobs, Heike Wehrheim
ICSE2025Program Analysis / Verification / Formal Methods
Critical Variable State-Aware Directed Greybox Fuzzing.
Xu Chen, Ningning Cui, Zhe Pan, Liwei Chen, Gang Shi
ICSE2025Testing / QA
DPFuzzer: Discovering Safety Critical Vulnerabilities for Drone Path Planners.
Yue Wang 0063, Chao Yang 0016, Xiaodong Zhang 0014, Yuwanqi Deng, Jianfeng Ma 0001
ICSE2025Other
Datalog-Based Language-Agnostic Change Impact Analysis for Microservices.
Qingkai Shi, Xiaoheng Xie, Xianjin Fu, Peng Di, Huawei Li
ICSE2025Maintenance / Evolution / Refactoring / Review
Decictor: Towards Evaluating the Robustness of Decision-Making in Autonomous Driving Systems.
Mingfei Cheng, Xiaofei Xie, Yuan Zhou 0005, Junjie Wang 0007, Guozhu Meng
ICSE2025Other
Decoding Secret Memorization in Code LLMs Through Token-Level Characterization.
Yuqing Nie, Chong Wang 0013, Kailong Wang 0001, Guoai Xu, Guosheng Xu 0001
ICSE2025Security / Privacy / Vulnerability
Decoding the Issue Resolution Process in Practice via Issue Report Analysis: a Case Study of Firefox.
Antu Saha, Oscar Chaparro
ICSE2025Human / Empirical / Socio-technical
Deep Learning-based Code Reviews: A Paradigm Shift or a Double-Edged Sword?
Rosalia Tufano, Alberto Martin-Lopez, Ahmad Tayeb, Ozren Dabic, Sonia Haiduc
ICSE2025AI / LLM for SE
Definition and Detection of Centralization Defects in Smart Contracts.
Zewei Lin, Jiachi Chen, Jiajing Wu, Weizhe Zhang, Zibin Zheng
ICSE2025Other
Demystifying and Detecting Cryptographic Defects in Ethereum Smart Contracts.
Jiashuo Zhang 0001, Yiming Shen, Jiachi Chen, Jianzhong Su, Yanlin Wang 0001
ICSE2025Security / Privacy / Vulnerability
DesignRepair: Dual-Stream Design Guideline-Aware Frontend Repair with Large Language Models.
Mingyue Yuan, Jieshan Chen, Zhenchang Xing, Aaron Quigley, Yuyu Luo
ICSE2025Debugging / Fault Localization / Diagnosis / Repair; Requirements / Modeling / Architecture
Dissecting Global Search: A Simple Yet Effective Method to Boost Individual Discrimination Testing and Repair.
Lili Quan, Tianlin Li, Xiaofei Xie, Zhenpeng Chen, Sen Chen 0001
ICSE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
Distilled Lifelong Self-Adaptation for Configurable Systems.
Yulong Ye, Tao Chen 0001, Miqing Li
ICSE2025Other
Diversity Drives Fairness: Ensemble of Higher Order Mutants for Intersectional Fairness of Machine Learning Software.
Zhenpeng Chen, Xinyue Li, Jie M. Zhang, Federica Sarro, Yang Liu 0003
ICSE2025AI / LLM for SE
Dockerfile Flakiness: Characterization and Repair.
Taha Shabani, Noor Nashid, Parsa Alian, Ali Mesbah 0001
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Does GenAI Make Usability Testing Obsolete?
Ali Ebrahimi Pourasad, Walid Maalej
ICSE2025Testing / QA
EP-Detector: Automatic Detection of Error-Prone Operation Anomalies in Android Applications.
Chenkai Guo, Qianlu Wang, Naipeng Dong, Lingling Fan 0003, Tianhong Wang 0010
ICSE2025Mobile / Web / GUI / Android
Early Detection of Performance Regressions by Bridging Local Performance Data and Architectural Models.
Lizhi Liao, Simon Eismann, Heng Li 0007, Cor-Paul Bezemer, Diego Elias Costa
ICSE2025Requirements / Modeling / Architecture; Performance / Energy / Reliability
EffBT: An Efficient Behavior Tree Reactive Synthesis and Execution Framework.
Ziji Wu, Yu Huang, Peishan Huang, Shanghua Wen, Minglong Li
ICSE2025Other
Efficient Domain Augmentation for Autonomous Driving Testing Using Diffusion Models.
Luciano Baresi, Davide Yi Xian Hu, Andrea Stocco 0001, Paolo Tonella
ICSE2025Testing / QA
Enhancing Code Generation via Bidirectional Comment-Level Mutual Grounding.
Yifeng Di, Tianyi Zhang 0001
ICSE2025Other
Enhancing Fault Localization in Industrial Software Systems via Contrastive Learning.
Chun Li, Hui Li, Zhong Li, Minxue Pan, Xuandong Li
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Enhancing the Open Network: Definition and Automated Detection of Smart Contract Defects.
Hao Song, Teng Li, Jiachi Chen, Ting Chen 0002, Beibei Li 0002
ICSE2025Security / Privacy / Vulnerability
Evaluating Garbage Collection Performance Across Managed Language Runtimes.
Yicheng Wang, Wensheng Dou, Yu Liang, Yi Wang 0069, Wei Wang 0049
ICSE2025Performance / Energy / Reliability
Execution Trace Reconstruction Using Diffusion-Based Generative Models.
Madeline Janecek, Naser Ezzati-Jivan, Abdelwahab Hamou-Lhadj
ICSE2025AI / LLM for SE
Exploring the Robustness of the Effect of EVO on Intention Valuation Through Replication.
Yesugen Baatartogtokh, Kaitlyn Cook, Alicia M. Grubb
ICSE2025Other
Exposing the Hidden Layer: Software Repositories in the Service of Seo Manipulation.
Mengying Wu, Geng Hong, Wuyuao Mai, Xinyi Wu, Lei Zhang 0096
ICSE2025Other
FIXDRIVE: Automatically Repairing Autonomous Vehicle Driving Behaviour for $0.08 per Violation.
Yang Sun 0008, Christopher M. Poskitt, Kun Wang 0023, Jun Sun 0001
ICSE2025Other
FairChecker: Detecting Fund-Stealing Bugs in DeFi Protocols via Fairness Validation.
Yi Sun 0004, Zhuo Zhang 0002, Xiangyu Zhang 0001
ICSE2025Testing / QA
FairSense: Long-Term Fairness Analysis of ML-Enabled Systems.
Yining She, Sumon Biswas, Christian Kästner, Eunsuk Kang
ICSE2025Other
Fairness Testing Through Extreme Value Theory.
Verya Monjezi, Ashutosh Trivedi 0001, Vladik Kreinovich, Saeid Tizpaz-Niari
ICSE2025Testing / QA
Fairquant: Certifying and Quantifying Fairness of Deep Neural Networks.
Brian Hyeongseok Kim, Jingbo Wang 0006, Chao Wang 0001
ICSE2025AI / LLM for SE
Famos: Fault Diagnosis for Microservice Systems Through Effective Multi-Modal Data Fusion.
Chiming Duan, Yong Yang 0011, Tong Jia, Guiyang Liu, Jinbu Liu
ICSE2025Cloud / Microservices / Distributed Systems
Faster Configuration Performance Bug Testing with Neural Dual-Level Prioritization.
Youpeng Ma, Tao Chen 0001, Ke Li 0001
ICSE2025Testing / QA; AI / LLM for SE; DevOps / CI / Build / Release; Performance / Energy / Reliability
Feature-Driven End-to-End Test Generation.
Parsa Alian, Noor Nashid, Mobina Shahbandeh, Taha Shabani, Ali Mesbah 0001
ICSE2025Testing / QA
Fidelity of Cloud Emulators: The Imitation Game of Testing Cloud-Based Software.
Anna Mazhar, Saad Sher Alam, William X. Zheng, Yinfang Chen, Suman Nath
ICSE2025Testing / QA; Cloud / Microservices / Distributed Systems
Fixing Large Language Models' Specification Misunderstanding for Better Code Generation.
Zhao Tian, Junjie Chen 0003, Xiangyu Zhang 0001
ICSE2025Program Analysis / Verification / Formal Methods
Fork State-Aware Differential Fuzzing for Blockchain Consensus Implementations.
Wonhoi Kim, Hocheol Nam 0001, Muoi Tran, Amin Jalilov, Zhenkai Liang
ICSE2025Testing / QA; Security / Privacy / Vulnerability
Formally Verified Binary-Level Pointer Analysis.
Freek Verbeek, Ali Shokri 0003, Daniel Engel, Binoy Ravindran
ICSE2025Program Analysis / Verification / Formal Methods
Formally Verified Cloud-Scale Authorization.
Aleks Chakarov, Jaco Geldenhuys, Matthew Heck, Michael Hicks 0001, Sam Huang
ICSE2025Program Analysis / Verification / Formal Methods; Cloud / Microservices / Distributed Systems
From Bugs to Benefits: Improving User Stories by Leveraging Crowd Knowledge with CrUISE-AC.
Stefan Schwedt, Thomas Ströder
ICSE2025Human / Empirical / Socio-technical
Fuzzing MLIR Compilers with Custom Mutation Synthesis.
Ben Limpanukorn, Jiyuan Wang, Hong Jin Kang, Eric Zitong Zhou, Miryung Kim
ICSE2025Testing / QA
GARL: Genetic Algorithm-Augmented Reinforcement Learning to Detect Violations in Marker-Based Autonomous Landing Systems.
Linfeng Liang, Yao Deng, Kye Morton, Valtteri Kallinen, Alice James
ICSE2025Other
GVI: Guided Vulnerability Imagination for Boosting Deep Vulnerability Detectors.
Heng Yong, Zhong Li, Minxue Pan, Tian Zhang 0001, Jianhua Zhao
ICSE2025Other
GenC2Rust: Towards Generating Generic Rust Code from C.
Xiafa Wu, Brian Demsky
ICSE2025Other
Gpass: A Goal-Adaptive Neural Theorem Prover Based on Coq for Automated Formal Verification.
Yizhou Chen, Zeyu Sun 0004, Guoqing Wang 0004, Dan Hao 0001
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
HIFI: Explaining and Mitigating Algorithmic Bias Through the Lens of Game-Theoretic Interactions.
Lingfeng Zhang, Zhaohui Wang, Yueling Zhang, Min Zhang 0007, Jiangtao Wang 0009
ICSE2025Other
Hedgecode: A Multi-Task Hedging Contrastive Learning Framework for Code Search.
Gong Chen 0007, Xiaoyuan Xie, Daniel Tang, Qi Xin, Wenjie Liu
ICSE2025Other
Hetrify: Efficient Verification of Heterogeneous Programs on RISC-V.
Yiwei Li 0006, Liangze Yin, Wei Dong 0006, Jiaxin Liu, Yanfeng Hu
ICSE2025Program Analysis / Verification / Formal Methods
Hints Help Finding and Fixing Bugs Differently in Python and Text-Based Program Representations.
Ruchit Rawal, Victor-Alexandru Padurean, Sven Apel, Adish Singla, Mariya Toneva
ICSE2025Other
How Scientists Use Jupyter Notebooks: Goals, Quality Attributes, and Opportunities.
Ruanqianqian (Lisa) Huang, Savitha Ravi, Michael He, Boyu Tian, Sorin Lerner
ICSE2025Other
HumanEvo: An Evolution-Aware Benchmark for More Realistic Evaluation of Repository-Level Code Generation.
Dewu Zheng, Yanlin Wang 0001, Ensheng Shi, Ruikai Zhang, Yuchi Ma
ICSE2025DevOps / CI / Build / Release; Maintenance / Evolution / Refactoring / Review
Hyperion: Unveiling DApp Inconsistencies Using LLM and Dataflow-Guided Symbolic Execution.
Shuo Yang 0012, Xingwei Lin, Jiachi Chen, Qingyuan Zhong, Lei Xiao 0015
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
INTERTRANS: Leveraging Transitive Intermediate Translations to Enhance LLM-Based Code Translation.
Marcos Macedo, Yuan Tian 0008, Pengyu Nie 0001, Filipe Roseiro Côgo, Bram Adams
ICSE2025AI / LLM for SE
IRFuzzer: Specialized Fuzzing for LLVM Backend Code Generation.
Yuyang Rong, Zhanghan Yu, Zhenkai Weng, Stephen Neuendorffer, Hao Chen
ICSE2025Testing / QA
Improved Detection and Diagnosis of Faults in Deep Neural Networks Using Hierarchical and Explainable Classification.
Sigma Jahan, Mehil B. Shah, Parvez Mahbub, Mohammad Masudur Rahman 0001
ICSE2025AI / LLM for SE
Increasing the Effectiveness of Automatically Generated Tests by Improving Class Observability.
Geraldine Galindo-Gutierrez, Juan Pablo Sandoval Alcocer, Nicolas Jimenez-Fuentes, Alexandre Bergel, Gordon Fraser 0001
ICSE2025Testing / QA; Cloud / Microservices / Distributed Systems
Instruct or Interact? Exploring and Eliciting LLMs' Capability in Code Snippet Adaptation Through Prompt Engineering.
Tanghaoran Zhang, Yue Yu 0001, Xinjun Mao, Shangwen Wang, Kang Yang 0001
ICSE2025Other
Instrumentation-Driven Evolution-Aware Runtime Verification.
Kevin Guan, Owolabi Legunsen
ICSE2025Program Analysis / Verification / Formal Methods; Maintenance / Evolution / Refactoring / Review
Insvdf: Interface-State-Aware Virtual Device Fuzzing.
Zexiang Zhang, Gaoning Pan, Ruipeng Wang, Yiming Tao, Zulie Pan
ICSE2025Testing / QA
Intention is All you Need: Refining your Code from your Intention.
Qi Guo, Xiaofei Xie, Shangqing Liu, Ming Hu 0003, Xiaohong Li 0001
ICSE2025Other
Interactive Cross-Language Pointer Analysis for Resolving Native Code in Java Programs.
Chenxi Zhang, Yufei Liang, Tian Tan 0001, Chang Xu 0001, Shuangxiang Kan
ICSE2025Program Analysis / Verification / Formal Methods
Investigating the Impact of Interpersonal Challenges on Feeling Welcome in OSS.
Bianca Trinkenreich, Zixuan Feng, Rudrajit Choudhuri, Marco Aurélio Gerosa, Anita Sarma
ICSE2025Other
Invivo Fuzzing by Amplifying Actual Executions.
Octavio Galland, Marcel Böhme
ICSE2025Testing / QA
Iterative Generation of Adversarial Example for Deep Code Models.
Li Huang 0006, Weifeng Sun 0004, Meng Yan 0001
ICSE2025Other
Janus: Detecting Rendering Bugs in Web Browsers via Visual Delta Consistency.
Chijin Zhou, Quan Zhang 0003, Bingzhou Qian, Yu Jiang 0001
ICSE2025Mobile / Web / GUI / Android
Knowledge-Enhanced Program Repair for Data Science Code.
Shuyin Ouyang, Jie M. Zhang, Zeyu Sun 0004, Albert Meroño-Peñuela
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
LLM Assistance for Memory Safety.
J. Nausheen Mohammed, Akash Lal, Aseem Rastogi, Rahul Sharma 0001, Subhajit Roy 0001
ICSE2025AI / LLM for SE
LLM Based Input Space Partitioning Testing for Library APIs.
Jiageng Li, Zhen Dong, Chong Wang, Haozhen You, Cen Zhang
ICSE2025Testing / QA; AI / LLM for SE
LLM-Agents Driven Automated Simulation Testing and Analysis of small Uncrewed Aerial Systems.
Venkata Sai Aswath Duvvuru, Bohan Zhang, Michael Vierhauser, Ankit Agrawal 0002
ICSE2025Testing / QA; AI / LLM for SE
LLM-Aided Automatic Modeling for Security Protocol Verification.
Ziyu Mao, Jingyi Wang 0004, Jun Sun 0001, Shengchao Qin, Jiawen Xiong
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability; Requirements / Modeling / Architecture
LLMs Meet Library Evolution: Evaluating Deprecated API Usage in LLM-Based Code Completion.
Chong Wang 0013, Kaifeng Huang 0001, Jian Zhang 0087, Yebo Feng, Lyuye Zhang
ICSE2025AI / LLM for SE; Maintenance / Evolution / Refactoring / Review
LWDIFF: an LLM-Assisted Differential Testing Framework for Webassembly Runtimes.
Shiyao Zhou, Jincheng Wang, He Ye, Hao Zhou 0043, Claire Le Goues
ICSE2025Testing / QA; AI / LLM for SE
Large Language Models as Configuration Validators.
Xinyu Lian, Yinfang Chen, Runxiang Cheng, Jie Huang 0009, Parth Thakkar
ICSE2025DevOps / CI / Build / Release
Large Language Models for Safe Minimization.
Aashish Yadavally, Xiaokai Rong, Phat Nguyen, Tien N. Nguyen
ICSE2025Other
Leveraging Large Language Models for Enhancing the Understandability of Generated Unit Tests.
Amirhossein Deljouyi, Roham Koohestani, Maliheh Izadi, Andy Zaidman
ICSE2025Testing / QA
Leveraging Large Language Models to Detect NPM Malicious Packages.
Nusrat Zahan, Philipp Burckhardt, Mikola Lysenko, Feross Aboukhadijeh, Laurie A. Williams
ICSE2025Other
Leveraging Propagated Infection to Crossfire Mutants.
Hang Du, Vijay Krishna Palepu, James A. Jones
ICSE2025Other
LiSSA: Toward Generic Traceability Link Recovery Through Retrieval- Augmented Generation.
Dominik Fuchß, Tobias Hey 0001, Jan Keim, Haoyu Liu, Niklas Ewald
ICSE2025Requirements / Modeling / Architecture
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models.
Zeyang Ma, Dong Jae Kim, Tse-Hsun Peter Chen
ICSE2025Other
Licoeval: Evaluating LLMs on License Compliance in Code Generation.
Weiwei Xu 0001, Kai Gao 0008, Hao He 0012, Minghui Zhou 0001
ICSE2025Other
Lightweight Concolic Testing via Path-Condition Synthesis for Deep Learning Libraries.
Sehoon Kim, Yonghyeon Kim, Dahyeon Park, Yuseok Jeon, Jooyong Yi
ICSE2025Testing / QA; AI / LLM for SE; Program Analysis / Verification / Formal Methods
MAGIKA: AI-Powered Content-Type Detection.
Yanick Fratantonio, Luca Invernizzi, Loua Farah, Kurt Thomas, Marina Zhang
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
MARQ: Engineering Mission-Critical AI-Based Software with Automated Result Quality Adaptation.
Uwe Gropengießer, Elias Dietz, Florian Brandherm, Achref Doula, Osama Abboud
ICSE2025AI / LLM for SE
Measuring the Runtime Performance of C++ Code Written by Humans Using Github Copilot.
Daniel Erhabor, Sreeharsha Udayashankar, Meiyappan Nagappan, Samer Al-Kiswany
ICSE2025Human / Empirical / Socio-technical; Performance / Energy / Reliability
Metamorphic-Based Many-Objective Distillation of LLMs for Code-Related Tasks.
Annibale Panichella
ICSE2025Other
Mobile Application Coverage: The 30% Curse and Ways Forward.
Faridah Akinotcho, Lili Wei, Julia Rubin
ICSE2025Testing / QA; Mobile / Web / GUI / Android
Mock Deep Testing: Toward Separate Development of Data and Models for Deep Learning.
Ruchira Manke, Mohammad Wardat, Foutse Khomh, Hridesh Rajan
ICSE2025Testing / QA; AI / LLM for SE
Model Editing for LLMs4Code: How Far are we?
Xiaopeng Li 0006, Shangwen Wang, Shasha Li 0001, Jun Ma 0015, Jie Yu 0008
ICSE2025Other
Module-Aware Context Sensitive Pointer Analysis.
Haofeng Li, Chenghang Shi, Jie Lu 0009, Lian Li 0002, Zixuan Zhao
ICSE2025Program Analysis / Verification / Formal Methods
Moye: A Wallbreaker for Monolithic Firmware.
Jintao Huang, Kai Yang, Gaosheng Wang, Zhiqiang Shi, Zhiwen Pan
ICSE2025Other
NIODebugger: A Novel Approach to Repair Non-Idempotent-Outcome Tests with LLM-Based Agent.
Kaiyao Ke
ICSE2025Testing / QA; AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Navigating the Testing of Evolving Deep Learning Systems: An Exploratory Interview Study.
Hanmo You, Zan Wang, Bin Lin 0008, Junjie Chen 0003
ICSE2025Testing / QA; AI / LLM for SE; Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review
Neurosymbolic Modular Refinement Type Inference.
Georgios Sakkas, Pratyush Sahu, Kyeling Ong, Ranjit Jhala
ICSE2025Program Analysis / Verification / Formal Methods
No Harness, No Problem: Oracle-guided Harnessing for Auto-generating C API Fuzzing Harnesses.
Gabriel Sherman, Stefan Nagy
ICSE2025Testing / QA
On Prescription or Off Prescription? An Empirical Study of Community-Prescribed Security Configurations for Kubernetes.
Shazibul Islam Shamim, Hanyang Hu, Akond Rahman
ICSE2025Security / Privacy / Vulnerability; Human / Empirical / Socio-technical; DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems
On the Mistaken Assumption of Interchangeable Deep Reinforcement Learning Implementations.
Rajdeep Singh Hundal, Yan Xiao 0002, Xiaochun Cao, Jin Song Dong 0001, Manuel Rigger
ICSE2025Other
PUPPY: Finding Performance Degradation Bugs in DBMSs via Limited-Optimization Plan Construction.
Zhiyong Wu 0010, Jie Liang 0006, Jingzhou Fu, Mingzhe Wang, Yu Jiang 0001
ICSE2025Performance / Energy / Reliability
PacDroid: A Pointer-Analysis-Centric Framework for Security Vulnerabilities in Android Apps.
Menglong Chen, Tian Tan 0001, Minxue Pan, Yue Li 0006
ICSE2025Program Analysis / Verification / Formal Methods; Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
PairSmell: A Novel Perspective Inspecting Software Modular Structure.
Chenxing Zhong, Daniel Feitosa, Paris Avgeriou, Huang Huang, Yue Li 0047
ICSE2025Other
Parametric Falsification of Many Probabilistic Requirements Under Flakiness.
Matteo Camilli, Raffaela Mirandola
ICSE2025Requirements / Modeling / Architecture
Patch Synthesis for Property Repair of Deep Neural Networks.
Zhiming Chi, Jianan Ma, Pengfei Yang 0002, Cheng-Chao Huang, Renjue Li
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Pattern-Based Generation and Adaptation of Quantum Workflows.
Martin Beisel, Johanna Barzen, Frank Leymann, Lavinia Stiliadou, Daniel Vietz
ICSE2025Other
Planning a Large Language Model for Static Detection of Runtime Errors in Code Snippets.
Smit Patel, Aashish Yadavally, Hridya Dhulipala, Tien N. Nguyen
ICSE2025AI / LLM for SE
Practical Object-Level Sanitizer with Aggregated Memory Access and Custom Allocator.
Xiaolei Wang, Ruilin Li 0002, Bin Zhang, Chao Feng 0002, Chaojing Tang
ICSE2025Other
Preserving Privacy in Software Composition Analysis: A Study of Technical Solutions and Enhancements.
Huaijin Wang 0001, Zhibo Liu, Yanbo Dai, Shuai Wang 0011, Qiyi Tang 0003
ICSE2025Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
Prompt-to-SQL Injections in LLM-Integrated Web Applications: Risks and Defenses.
Rodrigo Pedro, Miguel E. Coimbra, Daniel Castro 0004, Paulo Carreira 0001, Nuno Santos 0001
ICSE2025AI / LLM for SE; Mobile / Web / GUI / Android
QEDCartographer: Automating Formal Verification Using Reward-Free Reinforcement Learning.
Alex Sanchez-Stern, Abhishek Varghese, Zhanna Kaufman, Shizhuo Dylan Zhang, Talia Ringer
ICSE2025Program Analysis / Verification / Formal Methods
RLCoder: Reinforcement Learning for Repository-Level Code Completion.
Yanlin Wang 0001, Yanli Wang 0001, Daya Guo, Jiachi Chen, Ruikai Zhang
ICSE2025DevOps / CI / Build / Release
ROCODE: Integrating Backtracking Mechanism and Program Analysis in Large Language Models for Code Generation.
Xue Jiang, Yihong Dong, Yongding Tao, Huanyu Liu 0001, Zhi Jin 0001
ICSE2025Program Analysis / Verification / Formal Methods
ROSA: Finding Backdoors with Fuzzing.
Dimitri Kokkonis, Michaël Marcozzi, Emilien Decoux, Stefano Zacchiroli
ICSE2025Testing / QA
Rango: Adaptive Retrieval-Augmented Proving for Automated Software Verification.
Kyle Thompson, Nuno Saavedra, Pedro Carrott, Kevin Fisher, Alex Sanchez-Stern
ICSE2025Program Analysis / Verification / Formal Methods
Ranking Relevant Tests for Order-Dependent Flaky Tests.
Shanto Rahman, Bala Naren Chanumolu, Suzzana Rafi, August Shi, Wing Lam
ICSE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
Reasoning Runtime Behavior of a Program with LLM: How Far are We?
Junkai Chen, Zhiyuan Pan, Xing Hu 0008, Zhenhao Li 0002, Ge Li 0001
ICSE2025AI / LLM for SE
RediI: Test Infrastructure to Enable Deterministic Reproduction of Failures for Distributed Systems.
Yang Feng 0003, Zheyuan Lin, Dongchen Zhao, Mengbo Zhou, Jia Liu
ICSE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
Reduce Dependence for Sound Concurrency Bug Prediction.
Shihao Zhu, Yuqi Guo 0002, Yan Cai 0001, Bin Liang 0002, Long Zhang
ICSE2025Other
Relationship Status: "It's Complicated" Developer-Security Expert Dynamics in Scrum.
Houda Naji, Marco Gutfleisch, Alena Naiakshina
ICSE2025Security / Privacy / Vulnerability; Human / Empirical / Socio-technical
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair.
Islem Bouzenia, Premkumar T. Devanbu, Michael Pradel
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Repository-Level Graph Representation Learning for Enhanced Security Patch Detection.
Xin-Cheng Wen, Zirui Lin, Cuiyun Gao 0001, Hongyu Zhang 0002, Yong Wang
ICSE2025Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability; DevOps / CI / Build / Release
Revisiting Unnaturalness for Automated Program Repair in the Era of Large Language Models.
Aidan Z. H. Yang, Sophia Kolak, Vincent J. Hellendoorn, Ruben Martins, Claire Le Goues
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Rug: Turbo Llm for Rust Unit Test Generation.
Xiang Cheng, Fan Sang, Yizhuo Zhai, Xiaokuan Zhang, Taesoo Kim
ICSE2025Testing / QA; AI / LLM for SE
RustAssistant: Using LLMs to Fix Compilation Errors in Rust Code.
Pantazis Deligiannis, Akash Lal, Nikita Mehrotra, Rishi Poddar, Aseem Rastogi
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
SECRET: Towards Scalable and Efficient Code Retrieval via Segmented Deep Hashing.
Wenchao Gu, Ensheng Shi, Yanlin Wang 0001, Lun Du, Shi Han
ICSE2025Security / Privacy / Vulnerability
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents.
Feng Lin, Dong Jae Kim, Tse-Hsun Chen
ICSE2025AI / LLM for SE
Sand: Decoupling Sanitization from Fuzzing for Low Overhead.
Ziqiao Kong, Shaohua Li 0002, Heqing Huang 0002, Zhendong Su 0001
ICSE2025Testing / QA
Scenario-Driven and Context-Aware Automated Accessibility Testing for Android Apps.
Yuxin Zhang, Sen Chen 0001, Xiaofei Xie, Zibo Liu, Lingling Fan 0003
ICSE2025Testing / QA; Mobile / Web / GUI / Android
Search-Based LLMs for Code Optimization.
Shuzheng Gao, Cuiyun Gao 0001, Wenchao Gu, Michael R. Lyu
ICSE2025Performance / Energy / Reliability
SeeAction: Towards Reverse Engineering How-What-Where of HCI Actions from Screencasts for UI Automation.
Dehai Zhao, Zhenchang Xing, Qinghua Lu 0001, Xiwei Xu 0001, Liming Zhu 0001
ICSE2025Mobile / Web / GUI / Android
Selecting Initial Seeds for Better JVM Fuzzing.
Tianchang Gao, Junjie Chen 0003, Dong Wang 0044, Yile Guo, Yingquan Zhao
ICSE2025Testing / QA
Show Me Your Code! Kill Code Poisoning: A Lightweight Method Based on Code Naturalness.
Weisong Sun, Yuchen Chen, Mengzhe Yuan, Chunrong Fang, Zhenpeng Chen
ICSE2025Other
Similar but Patched Code Considered Harmful: The Impact of Similar but Patched Code on Recurring Vulnerability Detection and How to Remove Them.
Zixuan Tan, Jiayuan Zhou, Xing Hu 0008, Shengyi Pan, Kui Liu 0001
ICSE2025Other
Smartreco: Detecting Read-Only Reentrancy via Fine-Grained Cross-DApp Analysis.
Jingwen Zhang, Zibin Zheng, Yuhong Nan, Mingxi Ye, Kaiwen Ning
ICSE2025Other
Software Model Evolution with Large Language Models: Experiments on Simulated, Public, and Industrial Datasets.
Christof Tinnes, Alisa Welter, Sven Apel
ICSE2025Maintenance / Evolution / Refactoring / Review
Source Code Summarization in the Era of Large Language Models.
Weisong Sun, Yun Miao, Yuekang Li, Hongyu Zhang 0002, Chunrong Fang
ICSE2025Other
SpecGen: Automated Generation of Formal Program Specifications via Large Language Models.
Lezhi Ma, Shangqing Liu, Yi Li 0008, Xiaofei Xie, Lei Bu
ICSE2025Program Analysis / Verification / Formal Methods
SpecRover: Code Intent Extraction via LLMs.
Haifeng Ruan, Yuntong Zhang 0002, Abhik Roychoudhury
ICSE2025Other
Static Analysis of Remote Procedure Call in Java Programs.
Baoquan Cui, Rong Qu, Zhen Tang, Jian Zhang
ICSE2025Program Analysis / Verification / Formal Methods
Studying Programmers Without Programming: Investigating Expertise Using Resting State fMRI.
Zachary Karas, Benjamin Gold, Violet Zhou, Noah Reardon, Thad Polk
ICSE2025Other
Synthesizing Document Database Queries Using Collection Abstractions.
Qikang Liu, Yang He, Yanwen Cai, Byeongguk Kwak, Yuepeng Wang 0001
ICSE2025Other
TIGER: A Generating-Then-Ranking Framework for Practical Python Type Inference.
Chong Wang 0013, Jian Zhang 0087, Yiling Lou, Mingwei Liu 0002, Weisong Sun
ICSE2025Program Analysis / Verification / Formal Methods
TOGLL: Correct and Strong Test Oracle Generation with LLMS.
Soneya Binta Hossain, Matthew B. Dwyer
ICSE2025Testing / QA
TacDroid: Detection of Illicit Apps Through Hybrid Analysis of UI-Based Transition Graphs.
Yanchen Lu, Hongyu Lin, Zehua He, Haitao Xu, Zhao Li
ICSE2025Mobile / Web / GUI / Android
Template-Guided Program Repair in the Era of Large Language Models.
Kai Huang, Jian Zhang 0087, Xiangxin Meng, Yang Liu 0003
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Test Intention Guided LLM-Based Unit Test Generation.
Zifan Nan, Zhaoqiang Guo, Kui Liu 0001, Xin Xia 0001
ICSE2025Testing / QA; AI / LLM for SE
Testing and Understanding Deviation Behaviors in FHE-Hardened Machine Learning Models.
Yiteng Peng, Daoyuan Wu, Zhibo Liu, Dongwei Xiao, Zhenlan Ji
ICSE2025Testing / QA; AI / LLM for SE
Thanos: DBMS Bug Detection via Storage Engine Rotation Based Differential Testing.
Ying Fu, Zhiyong Wu 0010, Yuanliang Zhang, Jie Liang 0006, Jingzhou Fu
ICSE2025Testing / QA
The Design Smells Breaking the Boundary between Android Variants and AOSP.
Wuxia Jin, Jiaowei Shang, Jianguo Zheng, Mengjie Sun, Zhenyu Huang
ICSE2025Requirements / Modeling / Architecture; Mobile / Web / GUI / Android
The Fact Selection Problem in LLM-Based Program Repair.
Nikhil Parasaram, Huijie Yan, Boyu Yang, Zineb Flahy, Abriele Qudsi
ICSE2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
The Power of Types: Exploring the Impact of Type Checking on Neural Bug Detection in Dynamically Typed Languages.
Boqi Chen, José Antonio Hernández López, Gunter Mussbacher, Dániel Varró
ICSE2025AI / LLM for SE; Program Analysis / Verification / Formal Methods
The Product Beyond the Model - An Empirical Study of Repositories of Open-Source ML Products.
Nadia Nahar, Haoran Zhang, Grace A. Lewis, Shurui Zhou, Christian Kästner
ICSE2025Human / Empirical / Socio-technical
The Same Only Different: On Information Modality for Configuration Performance Analysis.
Hongyuan Liang, Yue Huang, Tao Chen
ICSE2025DevOps / CI / Build / Release; Performance / Energy / Reliability
The Seeds of the Future Sprout from History: Fuzzing for Unveiling Vulnerabilities in Prospective Deep-Learning Libraries.
Zhiyuan Li, Jingzheng Wu, Xiang Ling 0001, Tianyue Luo, Zhiqing Rui
ICSE2025Testing / QA
Tiver: Identifying Adaptive Versions of C/C++ Third-Party Open-Source Components Using a Code Clustering Technique.
Youngjae Choi, Seunghoon Woo
ICSE2025Other
Topseed: Learning Seed Selection Strategies for Symbolic Execution from Scratch.
Jaehyeok Lee, Sooyoung Cha
ICSE2025Program Analysis / Verification / Formal Methods
Toward a Better Understanding of Probabilistic Delta Debugging.
Mengxiao Zhang, Zhenyang Xu, Yongqiang Tian 0001, Xinru Cheng, Chengnian Sun
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Towards Better Answers: Automated Stack Overflow Post Updating.
Yubo Mai, Zhipeng Gao 0002, Haoye Wang, Tingting Bi, Xing Hu 0008
ICSE2025Other
Towards High-Strength Combinatorial Interaction Testing for Highly Configurable Software Systems.
Chuan Luo 0002, Shuangyu Lyu, Wei Wu 0011, Hongyu Zhang 0002, Dianhui Chu
ICSE2025Testing / QA
Towards More Trustworthy Deep Code Models by Enabling Out-of-Distribution Detection.
Yanfu Yan, Viet Duong, Huajie Shao, Denys Poshyvanyk
ICSE2025Other
Towards Neural Synthesis for SMT-Assisted Proof-Oriented Programming.
Saikat Chakraborty 0001, Gabriel Ebner, Siddharth Bhat, Sarah Fakhoury, Sakina Fatima
ICSE2025AI / LLM for SE
Towards Understanding the Characteristics of Code Generation Errors Made by Large Language Models.
Zhijie Wang 0014, Zijie Zhou, Da Song, Yuheng Huang 0004, Shengmai Chen
ICSE2025Other
TraceFL: Interpretability-Driven Debugging in Federated Learning via Neuron Provenance.
Waris Gill, Ali Anwar 0001, Muhammad Ali Gulzar
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
TransferFuzz: Fuzzing with Historical Trace for Verifying Propagated Vulnerability Code.
Siyuan Li 0014, Yuekang Li, Zuxin Chen, Chaopeng Dong, Yongpan Wang
ICSE2025Testing / QA
Treefix: Enabling Execution with a Tree of Prefixes.
Beatriz Souza, Michael Pradel
ICSE2025Other
Trust Dynamics in AI-Assisted Development: Definitions, Factors, and Implications.
Sadra Sabouri, Philipp Eibl, Xinyi Zhou, Morteza Ziyadi, Nenad Medvidovic
ICSE2025AI / LLM for SE
Tumbling Down the Rabbit Hole: How do Assisting Exploration Strategies Facilitate Grey-Box Fuzzing?
Mingyuan Wu, Jiahong Xiang, Kunqiu Chen, Peng Di, Shin Hwei Tan
ICSE2025Testing / QA
UML is Back. Or is it? Investigating the Past, Present, and Future of UML in Open Source Software.
Joseph Romeo, Marco Raglianti, Csaba Nagy 0001, Michele Lanza 0001
ICSE2025Human / Empirical / Socio-technical; Requirements / Modeling / Architecture
Unavoidable Boundary Conditions: a Control Perspective on Goal Conflicts.
Francisco Cirelli, Dalal Alrajeh, Sebastián Uchitel
ICSE2025Other
Understanding Architectural Complexity, Maintenance Burden, and Developer Sentiment -A Large-Scale Study.
Yuanfang Cai, Lanting He, Jun Qian, Yony Kochinski, Nan Zhang
ICSE2025Human / Empirical / Socio-technical; Maintenance / Evolution / Refactoring / Review; Requirements / Modeling / Architecture
Understanding Compiler Bugs in Real Development.
Hao Zhong 0001
ICSE2025Other
Understanding and Detecting Peer Dependency Resolving Loop in npm Ecosystem.
Xingyu Wang, Mingsen Wang, Wenbo Shen, Rui Chang
ICSE2025Other
Understanding the Effectiveness of Coverage Criteria for Large Language Models: A Special Angle from Jailbreak Attacks.
Shide Zhou, Tianlin Li, Kailong Wang 0001, Yihao Huang 0001, Ling Shi 0002
ICSE2025Testing / QA
Understanding the Response to Open-Source Dependency Abandonment in the npm Ecosystem.
Courtney Miller, Mahmoud Jahanshahi, Audris Mockus, Bogdan Vasilescu, Christian Kästner
ICSE2025Other
Unleashing the True Potential of Semantic-Based Log Parsing with Pre-Trained Language Models.
Van-Hoang Le, Yi Xiao, Hongyu Zhang
ICSE2025Other
Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar.
Yuanliang Zhang, Yifan Xie, Shanshan Li 0001, Ke Liu, Chong Wang
ICSE2025AI / LLM for SE
Unveiling the Energy Vampires: A Methodology for Debugging Software Energy Consumption.
Enrique Barba Roque, Luis Cruz 0002, Thomas Durieux
ICSE2025Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
User Personas Improve Social Sustainability by Encouraging Software Developers to Deprioritize Antisocial Features.
Bimpe Ayoola, Miikka Kuutila, Rina R. Wehbe, Paul Ralph
ICSE2025Human / Empirical / Socio-technical
Vulnerability Detection with Code Language Models: How Far are We?
Yangruibo Ding, Yanjun Fu, Omniyyah Ibrahim, Chawin Sitawarin, Xinyun Chen
ICSE2025Other
WDD: Weighted Delta Debugging.
Xintong Zhou, Zhenyang Xu, Mengxiao Zhang, Yongqiang Tian 0001, Chengnian Sun
ICSE2025Debugging / Fault Localization / Diagnosis / Repair
Weakly-Supervised Log-Based Anomaly Detection with Inexact Labels via Multi-Instance Learning.
Minghua He, Tong Jia, Chiming Duan, Huaqian Cai, Ying Li 0012
ICSE2025Cloud / Microservices / Distributed Systems
What Guides Our Choices? Modeling Developers' Trust and Behavioral Intentions Towards Genai.
Rudrajit Choudhuri, Bianca Trinkenreich, Rahul Pandita, Eirini Kalliamvakou, Igor Steinmacher
ICSE2025Human / Empirical / Socio-technical; Requirements / Modeling / Architecture
What You See is What You Get: Attention-Based Self-Guided Automatic Unit Test Generation.
Xin Yin, Chao Ni 0001, Xiaodan Xu, Xiaohu Yang 0001
ICSE2025Testing / QA
When Quantum Meets Classical: Characterizing Hybrid Quantum-Classical Issues Discussed in Developer Forums.
Jake Zappin, Trevor Stalnaker, Oscar Chaparro, Denys Poshyvanyk
ICSE2025Human / Empirical / Socio-technical
Who's Pushing the Code? An Exploration of GitHub Impersonation.
Yueke Zhang, Anda Liang, Xiaohan Wang, Pamela J. Wisniewski, Fengwei Zhang
ICSE2025Human / Empirical / Socio-technical
Your Fix Is My Exploit: Enabling Comprehensive DL Library API Fuzzing with Large Language Models.
Kunpeng Zhang, Shuai Wang, Jitao Han, Xiaogang Zhu 0001, Xian Li
ICSE2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair; Security / Privacy / Vulnerability
exLong: Generating Exceptional Behavior Tests with Large Language Models.
Jiyang Zhang 0003, Yu Liu 0079, Pengyu Nie 0001, Junyi Jessy Li, Milos Gligoric 0001
ICSE2025Testing / QA
A Large-Scale Empirical Study on Fine-Tuning Large Language Models for Unit Testing.
Ye Shang; Quanjun Zhang; Chunrong Fang; Siqi Gu; Jianyi Zhou; Zhenyu Chen 0001
ISSTA2025Testing / QA; Human / Empirical / Socio-technical
A Low-Cost Feature Interaction Fault Localization Approach for Software Product Lines.
Haining Wang 0006; Yi Xiang 0002; Han Huang 0002; Jie Cao; Kaichen Chen; Xiaowei Yang 0003
ISSTA2025Debugging / Fault Localization / Diagnosis / Repair; Performance / Energy / Reliability
ALMOND: Learning an Assembly Language Model for 0-Shot Code Obfuscation Detection.
Xuezixiang Li; Sheng Yu; Heng Yin 0001
ISSTA2025Other
Adding Spatial Memory Safety to EDK II through Checked C (Experience Paper).
Sourag Cherupattamoolayil; Arunkumar Bhattar; Connor Glosner; Aravind Machiry
ISSTA2025Other
AdverIntent-Agent: Adversarial Reasoning for Repair Based on Inferred Program Intent.
He Ye; Aidan Z. H. Yang; Chang Hu; Yanlin Wang 0001; Tao Zhang 0001; Claire Le Goues
ISSTA2025Debugging / Fault Localization / Diagnosis / Repair
An Investigation on Numerical Bugs in GPU Programs Towards Automated Bug Detection.
Ravishka Rathnasuriya; Nidhi Majoju; Zihe Song; Wei Yang 0013
ISSTA2025Other
Are Autonomous Web Agents Good Testers?
Antoine Chevrot; Alexandre Vernotte; Jean-Rémy Falleri; Xavier Blanc 0001; Bruno Legeard; Aymeric Cretin
ISSTA2025Mobile / Web / GUI / Android
Assessing Scene Generation Techniques for Testing COLREGS-Compliance of Autonomous Surface Vehicles.
Dominik Frey; Ulf Kargén; Dániel Varró
ISSTA2025Testing / QA
AudioTest: Prioritizing Audio Test Cases.
Yinghua Li; Xueqi Dang; Wendkûuni C. Ouédraogo; Jacques Klein; Tegawendé F. Bissyandé
ISSTA2025Testing / QA
Automated Attack Synthesis for Constant Product Market Makers.
Sujin Han; Jinseo Kim; Sung-Ju Lee; Insu Yun
ISSTA2025Security / Privacy / Vulnerability
Automated Test Transfer across Android Apps using Large Language Models.
Benyamin Beyzaei; Saghar Talebipour; Ghazal Rafiei; Nenad Medvidovic; Sam Malek
ISSTA2025Testing / QA; Mobile / Web / GUI / Android
Beyond Static Pattern Matching? Rethinking Automatic Cryptographic API Misuse Detection in the Era of LLMs.
Yifan Xia; Zichen Xie; Peiyu Liu 0003; Kangjie Lu; Yan Liu 0069; Wenhai Wang; Shouling Ji
ISSTA2025Security / Privacy / Vulnerability
BinDSA: Efficient, Precise Binary-Level Pointer Analysis with Context-Sensitive Heap Reconstruction.
Lian Gao; Heng Yin 0001
ISSTA2025Program Analysis / Verification / Formal Methods
BinQuery: A Novel Framework for Natural Language-Based Binary Code Retrieval.
Bolun Zhang; Zeyu Gao; Hao Wang 0226; Yuxin Cui; Siliang Qin; Chao Zhang 0008; Kai Chen 0012; Beibei Zhao
ISSTA2025Other
Bridge the Islands: Pointer Analysis for Microservice Systems.
Teng Zhang; Yufei Liang; Ganlin Li; Tian Tan 0001; Chang Xu 0001; Yue Li 0006
ISSTA2025Program Analysis / Verification / Formal Methods; Cloud / Microservices / Distributed Systems
Bridging the Gaps between Graph Neural Networks and Data-Flow Analysis: The Closer, the Better.
Qingchen Yu; Xin Liu 0050; Qingguo Zhou; Chunming Wu 0001
ISSTA2025AI / LLM for SE
Can LLMs Replace Human Evaluators? An Empirical Study of LLM-as-a-Judge in Software Engineering.
Ruiqi Wang; Jiyu Guo; Cuiyun Gao 0001; Guodong Fan; Chun Yong Chong; Xin Xia 0001
ISSTA2025AI / LLM for SE; Human / Empirical / Socio-technical
Causality-Aided Evaluation and Explanation of Large Language Model-Based Code Generation.
Zhenlan Ji; Pingchuan Ma 0004; Zongjie Li; Zhaoyu Wang 0006; Shuai Wang 0011
ISSTA2025AI / LLM for SE
ClassEval-T: Evaluating Large Language Models in Class-Level Code Translation.
Pengyu Xue; Linhao Wu; Zhen Yang 0022; Chengyi Wang; Xiang Li 0202; Yuxiang Zhang; Jia Li 0011; Ruikai Jin; Yifei Pei; Zhaoyan Shen; Xiran Lyu; Jacky Wai Keung
ISSTA2025Other
Clause2Inv: A Generate-Combine-Check Framework for Loop Invariant Inference.
Weining Cao; Guangyuan Wu; Tangzhi Xu; Yuan Yao 0001; Hengfeng Wei; Taolue Chen 0001; Xiaoxing Ma
ISSTA2025Program Analysis / Verification / Formal Methods
ConTested: Consistency-Aided Tested Code Generation with LLM.
Jinhao Dong; Jun Sun 0001; Wenjie Zhang 0007; Jin Song Dong 0001; Dan Hao 0001
ISSTA2025AI / LLM for SE
Copy-and-Paste? Identifying EVM-Inequivalent Code Smells in Multi-chain Reuse Contracts.
Zexu Wang; Jiachi Chen; Tao Zhang 0001; Yu Zhang 0036; Weizhe Zhang; Yuming Feng 0002; Zibin Zheng
ISSTA2025Other
CrossProbe: LLM-Empowered Cross-Project Bug Detection for Deep Learning Frameworks.
Hao Guan 0001; Guangdong Bai; Yepang Liu 0001
ISSTA2025AI / LLM for SE
DataHook: An Efficient and Lightweight System Call Hooking Technique without Instruction Modification.
Quan Hong; Jiaqi Li 0014; Wen Zhang; Lidong Zhai
ISSTA2025Other
DeCoMa: Detecting and Purifying Code Dataset Watermarks through Dual Channel Code Abstraction.
Yuan Xiao 0003; Yuchen Chen; Shiqing Ma; Haocheng Huang; Chunrong Fang; Yanwei Chen; Weisong Sun; Yunfeng Zhu; Xiaofang Zhang; Zhenyu Chen 0001
ISSTA2025Other
DecLLM: LLM-Augmented Recompilable Decompilation for Enabling Programmatic Use of Decompiled Code.
Wai Kin Wong; Daoyuan Wu; Huaijin Wang 0001; Zongjie Li; Zhibo Liu 0001; Shuai Wang 0011; Qiyi Tang 0003; Sen Nie; Shi Wu
ISSTA2025AI / LLM for SE
DepState: Detecting Synchronization Failure Bugs in Distributed Database Management Systems.
Cundi Fang; Jie Liang 0006; Zhiyong Wu 0010; Jingzhou Fu; Zhouyang Jia; Chun Huang 0006; Yu Jiang 0001; Shanshan Li 0001
ISSTA2025Debugging / Fault Localization / Diagnosis / Repair; Cloud / Microservices / Distributed Systems
Detecting Isolation Anomalies in Relational DBMSs.
Rui Yang 0039; Ziyu Cui; Wensheng Dou; Yu Gao 0002; Jiansen Song; Xudong Xie; Jun Wei 0001
ISSTA2025Other
Doctor: Optimizing Container Rebuild Efficiency by Instruction Re-orchestration.
Zhiling Zhu; Tieming Chen; Chengwei Liu; Han Liu 0012; Qijie Song; Zhengzi Xu; Yang Liu 0003
ISSTA2025Cloud / Microservices / Distributed Systems; Performance / Energy / Reliability
Dynamically Fusing Python HPC Kernels.
Nader Al Awar; Muhammad Hannan Naeem; James Almgren-Bell; George Biros; Milos Gligoric 0001
ISSTA2025Other
Effective REST APIs Testing with Error Message Analysis.
Lixin Xu; Huayao Wu; Zhenyu Pan; Tongtong Xu; Shaohua Wang 0002; Xintao Niu; Changhai Nie
ISSTA2025Testing / QA
Enhanced Prompting Framework for Code Summarization with Large Language Models.
Minying Fang; Xing Yuan; Yuying Li 0005; Haojie Li; Chunrong Fang; Junwei Du
ISSTA2025Other
Enhancing Smart Contract Security Analysis with Execution Property Graphs.
Kaihua Qin; Zhe Ye 0002; Zhun Wang; Weilin Li; Liyi Zhou; Chao Zhang 0008; Dawn Song; Arthur Gervais
ISSTA2025Security / Privacy / Vulnerability
Enhancing Vulnerability Detection via Inter-procedural Semantic Completion.
Bozhi Wu; Chengjie Liu; Zhiming Li; Yushi Cao; Jun Sun 0001; Shangwei Lin 0001
ISSTA2025Other
Extended Reality Cybersickness Assessment via User Review Analysis.
Shuqing Li 0001; Qisheng Zheng; Cuiyun Gao 0001; Jia Feng; Michael R. Lyu
ISSTA2025Other
FANDANGO: Evolving Language-Based Testing.
José Antonio Zamudio Amaya; Marius Smytzek; Andreas Zeller
ISSTA2025Testing / QA; Maintenance / Evolution / Refactoring / Review
Fairness Mediator: Neutralize Stereotype Associations to Mitigate Bias in Large Language Models.
Yisong Xiao; Aishan Liu; Siyuan Liang 0004; Xianglong Liu 0001; Dacheng Tao
ISSTA2025Other
Finding 709 Defects in 258 Projects: An Experience Report on Applying CodeQL to Open-Source Embedded Software (Experience Paper).
Mingjie Shen; Akul Abhilash Pillai; Brian A. Yuan; James C. Davis 0001; Aravind Machiry
ISSTA2025Other
Fixing Outside the Box: Uncovering Tactics for Open-Source Security Issue Management.
Lyuye Zhang; Jiahui Wu; Chengwei Liu; Kaixuan Li 0002; Xiaoyu Sun 0002; Lida Zhao; Chong Wang 0013; Yang Liu 0003
ISSTA2025Security / Privacy / Vulnerability
FreeWavm: Enhanced WebAssembly Runtime Fuzzing Guided by Parse Tree Mutation and Snapshot.
Peng Qian; Xinlei Ying; Jiashui Wang; Long Liu; Lun Zhang; Jianhai Chen; Qinming He
ISSTA2025Testing / QA
Freesia: Verifying Correctness of TEE Communication with Concurrent Separation Logic.
Fanlang Zeng; Rui Chang; Hongjian Liu
ISSTA2025Other
GUIPilot: A Consistency-Based Mobile GUI Testing Approach for Detecting Application-Specific Bugs.
Ruofan Liu; Xiwen Teoh; Yun Lin 0001; Guanjie Chen; Ruofei Ren; Denys Poshyvanyk; Jin Song Dong 0001
ISSTA2025Testing / QA; Mobile / Web / GUI / Android
Gamifying Testing in IntelliJ: A Replicability Study.
Philipp Straubinger; Tommaso Fulcini; Giacomo Garaccione; Luca Ardito; Gordon Fraser 0001
ISSTA2025Testing / QA; Human / Empirical / Socio-technical
GoPV: Detecting Blocking Concurrency Bugs Related to Shared-Memory Synchronization in Go.
Wei Song 0003; Xiaofan Xu; Jeff Huang 0001
ISSTA2025Other
Hulk: Exploring Data-Sensitive Performance Anomalies in DBMSs via Data-Driven Analysis.
Zhiyong Wu 0010; Jie Liang 0006; Jingzhou Fu; Mingzhe Wang; Yu Jiang 0001
ISSTA2025Performance / Energy / Reliability
ICEPRE: ICS Protocol Reverse Engineering via Data-Driven Concolic Execution.
Yibo Qu; Dongliang Fang; Zhen Wang 0043; Jiaxing Cheng; Shuaizong Si; Yongle Chen; Limin Sun 0001
ISSTA2025Program Analysis / Verification / Formal Methods
Identifying Multi-parameter Constraint Errors in Python Data Science Library API Documentation.
Xiufeng Xu; Fuman Xie; Chenguang Zhu 0002; Guangdong Bai; Sarfraz Khurshid; Yi Li 0008
ISSTA2025Other
Improving Deep Learning Framework Testing with Model-Level Metamorphic Testing.
Yanzhou Mu; Juan Zhai; Chunrong Fang; Xiang Chen 0005; Zhixiang Cao; Peiran Yang; Kexin Zhao; An Guo 0002; Zhenyu Chen 0001
ISSTA2025Testing / QA; AI / LLM for SE
Improving Graph Learning-Based Fault Localization with Tailored Semi-supervised Learning.
Chun Li; Hui Li 0104; Zhong Li; Minxue Pan; Xuandong Li
ISSTA2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Incremental Verification of Concurrent Programs through Refinement Constraint Adaptation.
Liangze Yin; Yiwei Li 0006; Kun Chen 0015; Wei Dong 0006; Ji Wang 0001
ISSTA2025Program Analysis / Verification / Formal Methods
Intention-Based GUI Test Migration for Mobile Apps using Large Language Models.
Shaoheng Cao; Minxue Pan; Yuanhong Lan; Xuandong Li
ISSTA2025Testing / QA; Maintenance / Evolution / Refactoring / Review; Mobile / Web / GUI / Android
KEENHash: Hashing Programs into Function-Aware Embeddings for Large-Scale Binary Code Similarity Analysis.
Zhijie Liu; Qiyi Tang 0003; Sen Nie; Shi Wu; Liang Feng Zhang; Yutian Tang
ISSTA2025Other
KRAKEN: Program-Adaptive Parallel Fuzzing.
Anshunkang Zhou; Heqing Huang 0002; Charles Zhang 0001
ISSTA2025Testing / QA
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation.
Ziyao Zhang 0004; Chong Wang 0013; Yanlin Wang 0001; Ensheng Shi; Yuchi Ma; Wanjun Zhong; Jiachi Chen; Mingzhi Mao; Zibin Zheng
ISSTA2025AI / LLM for SE
LLM4SZZ: Enhancing SZZ Algorithm with Context-Enhanced Assessment on Large Language Models.
Lingxiao Tang; Jiakun Liu; Zhongxin Liu 0002; Xiaohu Yang 0001; Lingfeng Bao
ISSTA2025Other
LogBase: A Large-Scale Benchmark for Semantic Log Parsing.
Chenbo Zhang; Wenying Xu; Jinbu Liu; Lu Zhang 0060; Guiyang Liu; Jihong Guan; Qi Zhou 0001; Shuigeng Zhou
ISSTA2025Other
MLLM-Based UI2Code Automation Guided by UI Layout Information.
Fan Wu; Cuiyun Gao 0001; Shuqing Li 0001; Xin-Cheng Wen; Qing Liao 0001
ISSTA2025Mobile / Web / GUI / Android
MoDitector: Module-Directed Testing for Autonomous Driving Systems.
Renzhi Wang; Mingfei Cheng; Xiaofei Xie; Yuan Zhou 0005; Lei Ma 0003
ISSTA2025Testing / QA
Model Checking Guided Incremental Testing for Distributed Systems.
Yu Gao 0002; Dong Wang 0048; Wensheng Dou; Wenhan Feng; Yu Liang; Yuan Feng; Jun Wei 0001
ISSTA2025Testing / QA; Program Analysis / Verification / Formal Methods; Cloud / Microservices / Distributed Systems
More Effective JavaScript Breaking Change Detection via Dynamic Object Relation Graph.
Dezhen Kong; Jiakun Liu; Chao Ni 0001; David Lo 0001; Lingfeng Bao
ISSTA2025Maintenance / Evolution / Refactoring / Review
NADA: Neural Acceptance-Driven Approximate Specification Mining.
Weilin Luo; Tingchen Han; Junming Qiu; Hai Wan; Jianfeng Du; Bo Peng 0041; Guohui Xiao 0001; Yanan Liu
ISSTA2025AI / LLM for SE; Program Analysis / Verification / Formal Methods; Requirements / Modeling / Architecture
No Bias Left Behind: Fairness Testing for Deep Recommender Systems Targeting General Disadvantaged Groups.
Zhuo Wu; Zan Wang; Chuan Luo 0002; Xiaoning Du 0001; Junjie Chen 0003
ISSTA2025Testing / QA
OmniGIRL: A Multilingual and Multimodal Benchmark for GitHub Issue Resolution.
Lianghong Guo; Wei Tao 0003; Runhan Jiang; Yanlin Wang 0001; Jiachi Chen; Xilin Liu 0001; Yuchi Ma; Mingzhi Mao; Hongyu Zhang 0002; Zibin Zheng
ISSTA2025Human / Empirical / Socio-technical
OpDiffer: LLM-Assisted Opcode-Level Differential Testing of Ethereum Virtual Machine.
Jie Ma; Ningyu He; Jinwen Xi; Mingzhe Xing; Haoyu Wang 0001; Ying Gao 0006; Yinliang Yue
ISSTA2025Testing / QA; AI / LLM for SE
PatchScope: LLM-Enhanced Fine-Grained Stable Patch Classification for Linux Kernel.
Rongkai Liu; Heyuan Shi; Shuning Liu; Chao Hu; Sisheng Li; Yuheng Shen; Runzhe Wang; Xiaohai Shi; Yu Jiang 0001
ISSTA2025AI / LLM for SE; Debugging / Fault Localization / Diagnosis / Repair
Pepper: Preference-Aware Active Trapping for Ransomware.
Huan Zhang; Zhengkai Qin; Lixin Zhao; Aimin Yu; Lijun Cai; Dan Meng 0002
ISSTA2025Other
Porting Software Libraries to OpenHarmony: Transitioning from TypeScript or JavaScript to ArkTS.
Bo Zhou; Jiaqi Shi; Ying Wang 0038; Li Li 0029; Tsz On Li; Hai Yu 0001; Zhiliang Zhu 0001
ISSTA2025Other
Preventing Disruption of System Backup against Ransomware Attacks.
Yiwei Hou; Lihua Guo; Chijin Zhou; Quan Zhang 0003; Wenhuan Liu; Chengnian Sun; Yu Jiang 0001
ISSTA2025Other
Productively Deploying Emerging Models on Emerging Platforms: A Top-Down Approach for Testing and Debugging.
Siyuan Feng 0007; Jiawei Liu 0004; Ruihang Lai; Charlie Ruan; Yong Yu 0001; Lingming Zhang 0001; Tianqi Chen 0001
ISSTA2025Testing / QA; Debugging / Fault Localization / Diagnosis / Repair
Program Analysis Combining Generalized Bit-Level and Word-Level Abstractions.
Guangsheng Fan; Liqian Chen; Banghu Yin; Wenyu Zhang; Peisen Yao; Ji Wang 0001
ISSTA2025Program Analysis / Verification / Formal Methods
Program Feature-Based Benchmarking for Fuzz Testing.
Miao Miao 0001; Sriteja Kummita; Eric Bodden; Shiyi Wei
ISSTA2025Testing / QA
Protecting Privacy in Software Logs: What Should Be Anonymized?
Roozbeh Aghili; Heng Li 0007; Foutse Khomh
ISSTA2025Security / Privacy / Vulnerability; Cloud / Microservices / Distributed Systems
QTRAN: Extending Metamorphic-Oracle Based Logical Bug Detection Techniques for Multiple-DBMS Dialect Support.
Li Lin; Qinglin Zhu; Hongqiao Chen; Zhuangda Wang; Rongxin Wu; Xiaoheng Xie
ISSTA2025Testing / QA
Quantum Concolic Testing.
Shangzhou Xia; Jianjun Zhao 0001; Fuyuan Zhang; Xiaoyu Guo 0007
ISSTA2025Testing / QA; Program Analysis / Verification / Formal Methods
REACCEPT: Automated Co-evolution of Production and Test Code Based on Dynamic Validation and Large Language Models.
Jianlei Chi; Xiaotian Wang; Yuhan Huang; Lechen Yu; Di Cui; Jianguo Sun; Jun Sun 0001
ISSTA2025Testing / QA; Maintenance / Evolution / Refactoring / Review
Recurring Vulnerability Detection: How Far Are We?
Yiheng Cao; Susheng Wu; Ruisi Wang; Bihuan Chen 0001; Yiheng Huang; Chenhao Lu; Zhuotong Zhou; Xin Peng 0001
ISSTA2025Other
Reinforcement Learning-Based Fuzz Testing for the Gazebo Robotic Simulator.
Zhilei Ren; Yitao Li; Xiaochen Li; Guanxiao Qi; Jifeng Xuan; He Jiang 0001
ISSTA2025Testing / QA; AI / LLM for SE
Rethinking Performance Analysis for Configurable Software Systems: A Case Study from a Fitness Landscape Perspective.
Mingyu Huang; Peili Mao; Ke Li 0001
ISSTA2025Human / Empirical / Socio-technical; Performance / Energy / Reliability
Robust Vulnerability Detection across Compilations: LLVM-IR vs. Assembly with Transformer Model.
Rony Shir; Priyanka Prakash Surve; Yuval Elovici; Asaf Shabtai
ISSTA2025AI / LLM for SE; Performance / Energy / Reliability
RouthSearch: Inferring PID Parameter Specification for Flight Control Program by Coordinate Search.
Siao Wang; Zhen Dong; Hui Li; Liwei Shen; Xin Peng 0001; Dongdong She
ISSTA2025Program Analysis / Verification / Formal Methods
S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models.
Xiaohan Yuan; Jinfeng Li; Dongxia Wang 0002; Yuefeng Chen; Xiaofeng Mao; Longtao Huang; Jialuo Chen; Hui Xue 0001; Xiaoxia Liu; Wenhai Wang; Kui Ren 0001; Jingyi Wang 0004
ISSTA2025Other
STRUT: Structured Seed Case Guided Unit Test Generation for C Programs using LLMs.
Jinwei Liu; Chao Li 0078; Rui Chen 0042; Shaofeng Li; Bin Gu 0006; Mengfei Yang
ISSTA2025Testing / QA
SWE-GPT: A Process-Centric Language Model for Automated Software Improvement.
Yingwei Ma; Rongyu Cao; Yongchang Cao; Yue Zhang 0004; Jue Chen; Yibo Liu; Yuchen Liu; Binhua Li; Fei Huang 0002; Yongbin Li 0001
ISSTA2025AI / LLM for SE
Safe4U: Identifying Unsound Safe Encapsulations of Unsafe Calls in Rust using LLMs.
Huan Li; Bei Wang 0010; Xing Hu 0008; Xin Xia 0001
ISSTA2025Other
Smart-LLaMA-DPO: Reinforced Large Language Model for Explainable Smart Contract Vulnerability Detection.
Lei Yu; Zhirong Huang; Hang Yuan; Shiqi Cheng; Li Yang 0015; Fengjun Zhang; Chenjie Shen; Jiajia Ma; Jingyuan Zhang; Junyi Lu; Chun Zuo
ISSTA2025AI / LLM for SE; Security / Privacy / Vulnerability
SoK: A Taxonomic Analysis of DeFi Rug Pulls: Types, Dataset, and Tool Assessment.
Dianxiang Sun; Wei Ma 0014; Liming Nie; Yang Liu 0003
ISSTA2025Other
Static Program Reduction via Type-Directed Slicing.
Loi Ngo Duc Nguyen; Tahiatul Islam; Theron Wang; Sam Lenz; Martin Kellogg
ISSTA2025Program Analysis / Verification / Formal Methods
Structure-Aware, Diagnosis-Guided ECU Firmware Fuzzing.
Qicai Chen; Kun Hu 0001; Sichen Gong; Bihuan Chen 0001; Zikui Kong; Haowen Jiang; Bingkun Sun; You Lu 0005; Xin Peng 0001
ISSTA2025Testing / QA
TerzoN: Human-in-the-Loop Software Testing with a Composite Oracle.
Matthew C. Davis; Amy Wei; Brad A. Myers; Joshua Sunshine
ISSTA2025Testing / QA; Human / Empirical / Socio-technical
Testing the Fault-Tolerance of Multi-sensor Fusion Perception in Autonomous Driving Systems.
Haoxiang Tian 0001; Wenqiang Ding; Xingshuo Han; Guoquan Wu; An Guo 0002; Junqi Zhang; Wei Chen 0018; Jun Wei 0001; Tianwei Zhang 0004
ISSTA2025Testing / QA; Human / Empirical / Socio-technical
The First Prompt Counts the Most! An Evaluation of Large Language Models on Iterative Example-Based Code Generation.
Yingjie Fu; Bozhou Li; Linyi Li 0001; Wentao Zhang 0001; Tao Xie 0001
ISSTA2025Other
The Incredible Shrinking Context... in a Decompiler Near You.
Sifis Lagouvardos; Yannis Bollanos; Neville Grech; Yannis Smaragdakis
ISSTA2025Other
Top Score on the Wrong Exam: On Benchmarking in Machine Learning for Vulnerability Detection.
Niklas Risse; Jing Liu; Marcel Böhme
ISSTA2025AI / LLM for SE
Tracezip: Efficient Distributed Tracing via Trace Compression.
Zhuangbin Chen; Junsong Pu; Zibin Zheng
ISSTA2025Cloud / Microservices / Distributed Systems
Tratto: A Neuro-Symbolic Approach to Deriving Axiomatic Test Oracles.
Davide Molinelli; Alberto Martin-Lopez; Elliott Zackrone; Beyza Eken; Michael D. Ernst; Mauro Pezzè
ISSTA2025Testing / QA; Program Analysis / Verification / Formal Methods
Type-Alias Analysis: Enabling LLVM IR with Accurate Types.
Jinmeng Zhou; Ziyue Pan; Wenbo Shen; Xingkai Wang; Kangjie Lu; Zhiyun Qian
ISSTA2025Program Analysis / Verification / Formal Methods
Uncovering API-Scope Misalignment in the App-in-App Ecosystem.
Jiarui Che; Chenkai Guo; Naipeng Dong; Jiaqi Pei; Lingling Fan 0003; Xun Mi; Xueshuo Xie; Xiangyang Luo 0001; Zheli Liu; Renhong Cheng
ISSTA2025Mobile / Web / GUI / Android
Understanding Model Weaknesses: A Path to Strengthening DNN-Based Android Malware Detection.
Haodong Li; Xiao Cheng 0002; Yanjie Zhao 0001; Guosheng Xu 0001; Guoai Xu; Haoyu Wang 0001
ISSTA2025Security / Privacy / Vulnerability; Mobile / Web / GUI / Android
Understanding Practitioners' Expectations on Clear Code Review Comments.
Junkai Chen; Zhenhao Li 0002; Qiheng Mao; Xing Hu 0008; Kui Liu 0001; Xin Xia 0001
ISSTA2025Maintenance / Evolution / Refactoring / Review
Unlocking Low Frequency Syscalls in Kernel Fuzzing with Dependency-Based RAG.
Zhiyu Zhang 0017; Longxing Li; Ruigang Liang; Kai Chen 0012
ISSTA2025Testing / QA
Validating Network Protocol Parsers with Traceable RFC Document Interpretation.
Mingwei Zheng; Danning Xie; Qingkai Shi; Chengpeng Wang 0001; Xiangyu Zhang 0001
ISSTA2025Other
VerLog: Enhancing Release Note Generation for Android Apps using Large Language Models.
Jiawei Guo; Haoran Yang 0002; Haipeng Cai
ISSTA2025DevOps / CI / Build / Release; Mobile / Web / GUI / Android
Walls Have Ears: Demystifying Notification Listener Usage in Android Apps.
Jiapeng Deng; Tianming Liu 0002; Yanjie Zhao 0001; Chao Wang 0097; Lin Zhang 0062; Haoyu Wang 0001
ISSTA2025Mobile / Web / GUI / Android
Wemby's Web: Hunting for Memory Corruption in WebAssembly.
Oussama Draissi; Tobias Cloosters; David Klein 0001; Michael Rodler; Marius Musch; Martin Johns; Lucas Davi
ISSTA2025Mobile / Web / GUI / Android
What Happened in This Pipeline? Diffing Build Logs with CiDiff.
Nicolas Hubner; Jean-Rémy Falleri; Raluca Uricaru; Thomas Degueule; Thomas Durieux
ISSTA2025DevOps / CI / Build / Release; Cloud / Microservices / Distributed Systems
Why Does My Transaction Fail? A First Look at Failed Transactions on the Solana Blockchain.
Xiaoye Zheng; Zhiyuan Wan; David Lo 0001; Difan Xie; Xiaohu Yang 0001
ISSTA2025Security / Privacy / Vulnerability
WildSync: Automated Fuzzing Harness Synthesis via Wild API Usage Recovery.
Wei-Cheng Wu; Stefan Nagy; Christophe Hauser
ISSTA2025Testing / QA; Maintenance / Evolution / Refactoring / Review
You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects.
Islem Bouzenia; Michael Pradel
ISSTA2025Testing / QA; AI / LLM for SE
ZTaint-Havoc: From Havoc Mode to Zero-Execution Fuzzing-Driven Taint Inference.
Yuchong Xie; Wenhui Zhang; Dongdong She
ISSTA2025Testing / QA; Security / Privacy / Vulnerability
xFUZZ: A Flexible Framework for Fine-Grained, Runtime-Adaptive Fuzzing Strategy Composition.
Dongsong Yu; Yiyi Wang; Chao Zhang 0008; Yang Lan; Zhiyuan Jiang; Shuitao Gan; Zheyu Ma; Wende Tan
ISSTA2025Testing / QA