CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild Paper • 2608.23181 • Published 3 days ago • 30
Second Thought: Reasoning in Parallel as LLM Agents Act and Observe Paper • 2608.13667 • Published 14 days ago • 16
Finding Memory Leaks in C/C++ Programs via Neuro-Symbolic Augmented Static Analysis Paper • 2603.27224 • Published May 31 • 1
SecureAgentBench: Benchmarking Secure Code Generation under Realistic Vulnerability Scenarios Paper • 2509.22097 • Published Sep 26, 2025 • 3
Gotcha! This Model Uses My Code! Evaluating Membership Leakage Risks in Code Models Paper • 2310.01166 • Published Oct 15, 2024
What Do Users Ask in Open-Source AI Repositories? An Empirical Study of GitHub Issues Paper • 2303.09795 • Published Mar 17, 2023
PenForge: On-the-Fly Expert Agent Construction for Automated Penetration Testing Paper • 2601.06910 • Published Jan 11
Beyond Function-Level Analysis: Context-Aware Reasoning for Inter-Procedural Vulnerability Detection Paper • 2602.06751 • Published Feb 6
ESG Reporting Lifecycle Management with Large Language Models and AI Agents Paper • 2603.10646 • Published Mar 11
Finding Memory Leaks in C/C++ Programs via Neuro-Symbolic Augmented Static Analysis Paper • 2603.27224 • Published May 31 • 1
AgentSZZ: Teaching the LLM Agent to Play Detective with Bug-Inducing Commits Paper • 2604.02665 • Published Apr 3
Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation Paper • 2604.08083 • Published Apr 9
Automated Repair of TEE Partitioning Issues via DSL-Guided and LLM-Assisted Patching Paper • 2605.22087 • Published May 21
Finding Missing Input Validation in TEEs via LLM-Assisted Symbolic Execution Paper • 2605.22058 • Published May 21