publications
Selected representative publications, grouped by research theme.
For the complete and up-to-date list, please see my Google Scholar profile.
Reinforcement Learning, Reward Modeling & Policy Optimization
- ICMLOn GRPO Collapse in Search-R1: The Lazy Likelihood-Displacement Death SpiralInternational Conference on Machine Learning, 2026
- ICLRToken Hidden Reward: Steering Exploration-Exploitation in Group Relative Deep Reinforcement LearningInternational Conference on Learning Representations, 2026
- ICML-WDirectional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language ModelsICML Workshop on Aligning Reinforcement Learning Experimentalists and Theorists (AIWILD), 2026
- NeurIPSOn the Effect of Negative Gradient in Group Relative Deep Reinforcement OptimizationAdvances in Neural Information Processing Systems, 2025
- NeurIPSA Reinforcement Learning-based Bidding Strategy for Data Consumers in Auction-based Federated LearningAdvances in Neural Information Processing Systems, 2025
Agentic Systems, Planning & Optimization
- AgentWhen Single-Agent with Skills Replace Multi-Agent Systems and When They FailAgentic Skills Workshop, 2026
- ICMLTextResNet: Decoupling and Routing Optimization Signals in Compound AI Systems via Deep Residual TuningInternational Conference on Machine Learning, 2026
- ICLRTextual Equilibrium Propagation for Deep Compound AI SystemsInternational Conference on Learning Representations, 2026
Data-Centric AI: Valuation, Curation & Synthetic Data
- ACLEfficient Forward-Only Data Valuation for Pretrained LLMs and VLMsAnnual Meeting of the Association for Computational Linguistics, 2026
- ICML-WEnhancing Clinical Multiple-Choice Questions Benchmarks with Knowledge Graph Guided Distractor GenerationICML Workshop on Reliable and Responsible Foundation Models (RRFM), 2025
- JAIRDifferentially Private Neural Tangent Kernels (DP-NTK) for Privacy-Preserving Data GenerationJournal of Artificial Intelligence Research, 2024
Evaluation, Robustness & Verification for Deployment
- ICMLWhen RAG Hurts: Diagnosing and Mitigating Attention Distraction in Retrieval-Augmented LVLMsInternational Conference on Machine Learning, 2026
- MICCAIDUCX: Decomposing Unfairness in Tool-Using Chest X-ray AgentsInternational Conference on Medical Image Computing and Computer-Assisted Intervention, 2026
Optimization & Distributed (Large-Scale) Learning
- AAAIFederated Causally Invariant Feature LearningProceedings of the AAAI Conference on Artificial Intelligence, 2025
- NeurIPSClass-wise Balancing Data Replay for Federated Class-Incremental LearningAdvances in Neural Information Processing Systems, 2025
Vision and Multimodal Perception
- ACM MMA Simple and Provable Approach for Learning on Noisy Labeled Multi-modal Medical ImagesACM International Conference on Multimedia, 2024
- MICCAIDebiased Noise Editing on Foundation Models for Fair Medical Image ClassificationInternational Conference on Medical Image Computing and Computer-Assisted Intervention, 2024