2026

Can We Trust LLM Security Research? A Reproducibility Study of Large Language Model Security Papers in Tier-1 Security Conferences

Zeyuan Chen, Ye Leng, Chi Cui, Mengfei Liang, Bo Shao, Xinyu Zhang, Yun Shen, Michael Backes, Xinyue Shen, Yang Zhang; IEEE S&P 2027

2026

$\texttt{PeerCheck}$: Enhancing LLM-Generated Academic Reviews Towards Human-Level Quality

Zeyuan Chen, Ziqing Yang, Yihan Ma, Michael Backes, Yang Zhang; ACL Findings 2026

pdf arxiv code dataset

Behavior Carries Over: An AI Sandbagging Detection Method Inspired by Honest Inertia

Junjie Chu, Mingjie Li, Zeyuan Chen, Ye Leng, Yisen Wang, Michael Backes, Yang Zhang; EMNLP Findings 2026

pdf

Real Money, Fake Models: Deceptive Model Claims in Shadow APIs

Yage Zhang, Yukun Jiang, Zeyuan Chen, Michael Backes, Xinyue Shen, Yang Zhang; CCS 2026

arxiv

Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models

Zeyuan Chen, Yihan Ma, Xinyue Shen, Michael Backes, Yang Zhang; Arxiv

arxiv

2024

MGTBench: Benchmarking Machine-Generated Text Detection

Xinlei He, Xinyue Shen, Zeyuan Chen, Michael Backes, Yang Zhang; CCS 2024

pdf arxiv code

“Do Anything Now”: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models

Xinyue Shen, Zeyuan Chen, Michael Backes, Yun Shen, Yang Zhang; CCS 2024

pdf arxiv code

2023

Medusa Attack: Exploring Security Hazards of In-App QR Code Scanning

Xing Han, Yuheng Zhang, Xue Zhang, Zeyuan Chen, Mingzhe Wang, Yiwei Zhang, Siqi Ma, Yu Yu, Elisa Bertino, Juanru Li; USENIX Security 2023

pdf

Comprehensive Assessment of Toxicity in ChatGPT

Boyang Zhang, Xinyue Shen, Wai Man Si, Zeyang Sha, Zeyuan Chen, Ahmed Salem, Yun Shen, Michael Backes, Yang Zhang; Arxiv

pdf arxiv

In Chatgpt We Trust? Measuring and Characterizing the Reliability of Chatgpt

Xinyue Shen, Zeyuan Chen, Michael Backes, Yang Zhang; Arxiv

pdf arxiv

2022

SIMulation: Demystifying (Insecure) Cellular Network based One-Tap Authentication Services

Ziyi Zhou, Xing Han, Zeyuan Chen, Yuhong Nan, Juanru Li, Dawu Gu; DSN 2022

pdf