Publications

Also on Google Scholar. Author lists as indexed by Scholar.

2026

  1. SRJudge: Empowering Large Language Models with Selective Reasoning for Fine-Grained Knowledge

    Z. Yang, J. Yang, H. Lin, X. Chen, Q. Guan

    IJCAI, 2026

  2. Why Attend to Everything? Focus is the Key

    H. Yao, X. Chen, A. Murtadha, J. Li, Y. A. Yadkori, S. Shao, C. Liu, G. Wang, et al.

    arXiv:2604.03260, 2026

  3. A Tighter Bound for Reward Learning in Reinforcement Learning from Human Feedback

    G. Chen, X. Chen, B. An, Y. Zhang

    Transactions on Machine Learning Research, 2026

  4. Thin Keys, Full Values: Reducing KV Cache via Low-Dimensional Attention Selection

    H. Yao, X. Chen, A. Murtadha, G. Wang

    arXiv:2603.04427, 2026

  5. An Evolutionary Algorithm with Probabilistic Annealing for Large-scale Sparse Multi-objective Optimization

    S. Shao, Y. Sun, X. Chen, Y. Tian, G. Wang, J. Li

    arXiv:2603.11874, 2026

  6. Signal-Adaptive Trust Regions for Gradient-Free Optimization of Recurrent Spiking Neural Networks

    J. Li, Y. Sun, Z. Ma, H. He, X. Zhang, X. Chen, J. Li, S. Song

    arXiv:2601.21572, 2026

2025

  1. Universal Stabilization for Maximum Entropy Optimization in Reinforcement Learning

    X. Chen, Y. Li, X. Cao, H. Chen, H. Yao, B. An, Y. Chang

    IEEE Transactions on Neural Networks and Learning Systems, 2025

  2. State Transition Difference Prediction for Deep Reinforcement Learning

    H. Chi, Z. Liu, X. Chen, B. Qu, J. Hu, Y. Jiang, H. Chen, Y. Chang

    Pattern Recognition, 2025

  3. Compact Exploration for Continuous Action Reinforcement Learning

    X. Chen, H. Chen, Y. Chang

    Pattern Recognition, 2025

  4. Hierarchical Reasoning Model

    G. Wang, J. Li, Y. Sun, X. Chen, C. Liu, Y. Wu, M. Lu, S. Song, Y. A. Yadkori

    arXiv:2506.21734, 2025

  5. HiPPO: Enhancing Proximal Policy Optimization with Highlight Replay

    S. Zhang, X. Chen, Z. Liu, H. Chen, Y. Chang

    Pattern Recognition, 2025

  6. Value Shaping: Bias Reduction in Bellman Error for Deep Reinforcement Learning

    X. Chen, X. Cao, H. Chen, B. An, Y. Chang

2023

  1. The Sufficiency of Off-Policyness and Soft Clipping: PPO Is Still Insufficient According to an Off-Policy Measure

    X. Chen, D. Diao, H. Chen, H. Yao, H. Piao, Z. Sun, Z. Yang, R. Goebel, et al.

    AAAI Conference on Artificial Intelligence, 2023

  2. Careful at Estimation and Bold at Exploration

    X. Chen, Y. Liu, Z. Liu, H. Chen, H. Yao, Y. Chang

    arXiv:2308.11348, 2023

  3. Enhancing Ontology Translation Through Cross-Lingual Agreement

    M. Tian, F. Giunchiglia, R. Song, X. Chen, H. Xu

    ICASSP, 2023

2021

  1. Multi-Agent Hierarchical Policy Gradient for Air Combat Tactics Emergence via Self-Play

    Z. Sun, H. Piao, Z. Yang, Y. Zhao, G. Zhan, D. Zhou, G. Meng, H. Chen, et al.

    Engineering Applications of Artificial Intelligence, 2021