论文

精选论文

我们在软件工程与人工智能领域的近期及代表性研究。

2026

ICML 2026

SWE-ABS: Adversarial Benchmark Strengthening Exposes Inflated Success Rates on Test-based Benchmark

Boxi Yu+, Yang Cao+, Yuzhong Zhang, Liting Lin, Junjielong Xu, Zhiqing Zhong, Qinghua Xu, Guancheng Wang, Jialun Cao, Shing-Chi Cheung, Pinjia He, Lionel Briand.

ICML 2026

Semantic Router: On the Feasibility of Hijacking MLLMs via a Single Adversarial Perturbation

Changyue Li, Jiaying Li, Youliang Yuan, Jiaming He, Zhicong Huang, Pinjia He.

EMNLP 2026Findings

Scalable Supervision for Software Agents via Patch Reasoning

Junjielong Xu, Boyin Tan, Xiaoyuan Liu, Chao Peng, Pengfei Gao, Pinjia He.

EMNLP 2026

PaSBench-Video: A Streaming Video Benchmark for Proactive Safety Warning

Yusong Zhao+, Yuejin Xie+, Youliang Yuan, Junjie Hu, Jitian Guo, Yujiu Yang, Pinjia He.

ASE 2026

OrthCoder: Balancing Security and Utility in Secure Code Generation via Orthogonal Adaptation

Menghan Tian, Youliang Yuan, Zhiqing Zhong, Pinjia He.

ASE 2026

PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks

Manyi Wang, Junjielong Xu, Pinjia He.

FSE 2026

BackportBench: A Multilingual Benchmark for Automated Patch Backporting

Zhiqing Zhong+, Jiaming Huang+, Pinjia He.

FSE 2026

Rethinking the Evaluation of Microservice RCA with a Fault Propagation-Aware Benchmark

Aoyang Fang, Songhan Zhang, Yifan Yang, Haotong Wu, Junjielong Xu, Xuyang Wang, Rui Wang, Manyi Wang, Qisheng Lu, Pinjia He.

ACL 2026

Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards

Youliang Yuan, Qiuyang Mang, Jingbang Chen, Hong Wan, Xiaoyuan Liu, Junjielong Xu, Jen-tse Huang, Wenxuan Wang, Wenxiang Jiao, Pinjia He.

2025

ICLR 2025

OpenRCA: Can Large Language Models Locate the Root Cause of Software Failures?

Junjielong Xu, Qinan Zhang, Zhiqing Zhong, Shilin He, Chaoyun Zhang, Qingwei Lin, Dan Pei, Pinjia He, Dongmei Zhang, Qi Zhang.

已被Anthropic和微软使用
ICSE 2025

An Empirical Study on Package-Level Deprecation in Python Ecosystem

Zhiqing Zhong, Shilin He, Haoxuan Wang, Boxi Yu, Haowen Yang, Pinjia He.

ICSE 2025

Aligning the Objective of LLM-Based Program Repair

Junjielong Xu, Ying Fu, Shin Hwei Tan, Pinjia He.

ACL 2025

UTBoost: Rigorous Evaluation of Coding Agents on SWE-Bench

Boxi Yu, Yuxuan Zhu, Pinjia He, Daniel Kang.

ACL 2025

Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training

Youliang Yuan, Wenxiang Jiao, Wenxuan Wang, Jen-tse Huang, Jiahao Xu, Tian Liang, Pinjia He, Zhaopeng Tu.

ACL 2025

Insight Over Sight: Exploring the Vision-Knowledge Conflicts in Multimodal LLMs

Xiaoyuan Liu, Wenxuan Wang, Youliang Yuan, Jen-tse Huang, Qiuzhi Liu, Pinjia He, Zhaopeng Tu.

SIGMOD 2025

Finding Logic Bugs in Graph-processing Systems via Graph-cutting

Qiuyang Mang, Jinsheng Ba, Pinjia He, Manuel Rigger.

FSE 2025

Towards Understanding Performance Bugs in Popular Data Science Libraries

Haowen Yang, Zhengda Li, Zhiqing Zhong, Xiaoying Tang, Pinjia He.

EMNLP 2025

ToolSafety: A Comprehensive Dataset for Enhancing Safety in LLM-Based Agent Tool Invocations

Yuejin Xie, Youliang Yuan, Wenxuan Wang, Fan Mo, Jianmin Guo, Pinjia He.

NeurIPS 2025

Trust, But Verify: A Self-Verification Approach to Reinforcement Learning with Verifiable Rewards

Xiaoyuan Liu, Tian Liang, Zhiwei He, Jiahao Xu, Wenxuan Wang, Pinjia He, Zhaopeng Tu, Haitao Mi, Dong Yu.

NeurIPS 2025D & B Track

Towards Evaluating Proactive Risk Awareness of Multimodal Language Models

Youliang Yuan, Wenxiang Jiao, Yuejin Xie, Chihao Shen, Menghan Tian, Wenxuan Wang, Jen-Tse Huang, Pinjia He.

2024

ICLR 2024

GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher

Youliang Yuan, Wenxiang Jiao, Wenxuan Wang, Jen-tse Huang, Pinjia He, Shuming Shi, Zhaopeng Tu.

ICSE 2024

Testing Graph Database Systems via Equivalent Query Rewriting

Qiuyang Mang+, Aoyang Fang+, Boxi Yu, Hanfei Chen, Pinjia He.

ICSE 2024

UniLog: Automatic Logging via LLM and In-Context Learning

Junjielong Xu, Ziang Cui, Yuan Zhao, Xu Zhang, Shilin He, Pinjia He, Liqun Li, Yu Kang, Qingwei Lin, Yingnong Dang, Saravan Rajmohan, Dongmei Zhang.

ICSE 2024

Deep Learning or Classical Machine Learning? An Empirical Study on Log-Based Anomaly Detection

Boxi Yu, Jiayi Yao, Qiuai Fu, Zhiqing Zhong, Haotian Xie, Yaoliang Wu, Yuchi Ma, Pinjia He.

ICSE 2024

DivLog: Log Parsing with Prompt Enhanced In-Context Learning

Junjielong Xu, Ruichun Yang, Yintong Huo, Chengyu Zhang, Pinjia He.

EMNLP 2024Findings

Difficult Task Yes but Simple Task No: Unveiling the Laziness in Multimodal LLMs

Sihang Zhao, Youliang Yuan, Xiaoying Tang, Pinjia He.

ASE 2024

Unlocking the Power of Numbers: Log Compression via Numeric Token Parsing

Siyu Yu, Yifan Wu, Ying Li, Pinjia He.

ASE 2024

MRCA: Metric-level Root Cause Analysis for Microservices via Multi-Modal Data

Yidan Wang, Zhouruixing Zhu, Qiuai Fu, Yuchi Ma, Pinjia He.

2023

ISSRE 2023

Loghub: A Large Collection of System Log Datasets for AI-driven Log Analytics

Jieming Zhu, Shilin He, Pinjia He, Jinyang Liu, Michael R. Lyu.

ISSTA 2023

ROME: Testing Image Captioning Systems via Recursive Object Melting

Boxi Yu, Zhiqing Zhong, Jiaqi Li, Yixing Yang, Shilin He, Pinjia He.

FSE 2023

Hue: A User-Adaptive Parser for Hybrid Logs

Junjielong Xu, Qiuai Fu, Zhouruixing Zhu, Yutong Cheng, Zhijing Li, Yuchi Ma, Pinjia He.

FSE 2023

Automated Testing and Improvement of Named Entity Recognition Systems

Boxi Yu, Yiyan Hu, Qiuyang Mang, Wenhan Hu, Pinjia He.

2022

CSUR 2022

A Survey on Automated Log Analysis for Reliability Engineering

Shilin He, Pinjia He, Zhuangbin Chen, Tianyi Yang, Yuxin Su, Michael R. Lyu.

ISSTA 2022

Automated testing of image captioning systems

Boxi Yu, Zhiqing Zhong, Xinran Qin, Jiayi Yao, Yuancheng Wang, Pinjia He.

2021

ICSE 2021

Testing Machine Translation via Referential Transparency

Pinjia He, Clara Meister, Zhendong Su.

2020

ICSE 2020

Structure-invariant testing for machine translation

Pinjia He, Clara Meister, Zhendong Su.

FSE 2020

Machine translation testing via pathological invariance

Shashij Gupta, Pinjia He, Clara Meister, Zhendong Su.

2019

ICSE 2019SEIP

Tools and Benchmarks for Automated Log Parsing

Jieming Zhu, Shilin He, Jinyang Liu, Pinjia He, Qi Xie, Zibin Zheng, Michael R. Lyu.

2017

ICWS 2017

Drain: An Online Log Parsing Approach with Fixed Depth Tree

Pinjia He, Jieming Zhu, Zibin Zheng, Michael R. Lyu.

2016

ISSRE 2016

Experience Report: System Log Analysis for Anomaly Detection

Shilin He, Jieming Zhu, Pinjia He, Michael R. Lyu.

最有影响力论文奖时间检验奖