2026
Can We Trust LLM Security Research? A Reproducibility Study of Large Language Model Security Papers in Tier-1 Security Conferences
Zeyuan Chen, Ye Leng, Chi Cui, Mengfei Liang, Bo Shao, Xinyu Zhang, Yun Shen, Michael Backes, Xinyue Shen, Yang Zhang; IEEE S&P 20272026
$\texttt{PeerCheck}$: Enhancing LLM-Generated Academic Reviews Towards Human-Level Quality
Zeyuan Chen, Ziqing Yang, Yihan Ma, Michael Backes, Yang Zhang; ACL Findings 2026pdf arxiv code dataset
Behavior Carries Over: An AI Sandbagging Detection Method Inspired by Honest Inertia
Junjie Chu, Mingjie Li, Zeyuan Chen, Ye Leng, Yisen Wang, Michael Backes, Yang Zhang; EMNLP Findings 2026pdf
Real Money, Fake Models: Deceptive Model Claims in Shadow APIs
Yage Zhang, Yukun Jiang, Zeyuan Chen, Michael Backes, Xinyue Shen, Yang Zhang; CCS 2026arxiv
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
Zeyuan Chen, Yihan Ma, Xinyue Shen, Michael Backes, Yang Zhang; Arxivarxiv
2024
MGTBench: Benchmarking Machine-Generated Text Detection
Xinlei He, Xinyue Shen, Zeyuan Chen, Michael Backes, Yang Zhang; CCS 2024pdf arxiv code
“Do Anything Now”: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models
Xinyue Shen, Zeyuan Chen, Michael Backes, Yun Shen, Yang Zhang; CCS 2024pdf arxiv code
2023
Medusa Attack: Exploring Security Hazards of In-App QR Code Scanning
Xing Han, Yuheng Zhang, Xue Zhang, Zeyuan Chen, Mingzhe Wang, Yiwei Zhang, Siqi Ma, Yu Yu, Elisa Bertino, Juanru Li; USENIX Security 2023pdf
Comprehensive Assessment of Toxicity in ChatGPT
Boyang Zhang, Xinyue Shen, Wai Man Si, Zeyang Sha, Zeyuan Chen, Ahmed Salem, Yun Shen, Michael Backes, Yang Zhang; Arxivpdf arxiv
In Chatgpt We Trust? Measuring and Characterizing the Reliability of Chatgpt
Xinyue Shen, Zeyuan Chen, Michael Backes, Yang Zhang; Arxivpdf arxiv
2022
SIMulation: Demystifying (Insecure) Cellular Network based One-Tap Authentication Services
Ziyi Zhou, Xing Han, Zeyuan Chen, Yuhong Nan, Juanru Li, Dawu Gu; DSN 2022pdf