A one-sentence research thesis
I build and evaluate AI agents for cybersecurity.
Hwiwon Lee
PhD Student in Computer Science at the University of Illinois Urbana-Champaign · advised by Lingming Zhang.

01Research
Systems that can reason, act, and be measured.
- Agentic Security
Building and evaluating autonomous agents for realistic, long-horizon security engineering workflows.
- Software Systems
Designing reproducible systems that connect models, program analysis, and dynamic execution evidence.
- Applied Vulnerability Research
Discovering and validating vulnerabilities in production software, from services to operating-system kernels.
02Selected work
Recent publications.
-
SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?
PDF: SEC-bench Pro -
Agentic Vulnerability Reasoning on COTS Binaries
PDF: Agentic Vulnerability Reasoning on COTS Binaries -
SEC-bench: Automated Benchmarking of LLM Agents on Real-World Software Security Tasks
PDF: SEC-bench -
BENZENE: A Practical Root Cause Analysis System with an Under-Constrained State Mutation
PDF: BENZENE
03News
What’s new.
SEC-bench Pro, our benchmark for long-horizon software security tasks, is now available on arXiv.
Agentic Vulnerability Reasoning on COTS Binaries is now available on arXiv.
Recognized as a Microsoft Most Valuable Security Researcher for 2026 Q1.