Publications
Also on Google Scholar. Author lists as indexed by Scholar.
2026
-
SRJudge: Empowering Large Language Models with Selective Reasoning for Fine-Grained Knowledge
IJCAI, 2026
-
Why Attend to Everything? Focus is the Key
arXiv:2604.03260, 2026
-
A Tighter Bound for Reward Learning in Reinforcement Learning from Human Feedback
Transactions on Machine Learning Research, 2026
-
Thin Keys, Full Values: Reducing KV Cache via Low-Dimensional Attention Selection
arXiv:2603.04427, 2026
-
An Evolutionary Algorithm with Probabilistic Annealing for Large-scale Sparse Multi-objective Optimization
arXiv:2603.11874, 2026
-
Signal-Adaptive Trust Regions for Gradient-Free Optimization of Recurrent Spiking Neural Networks
arXiv:2601.21572, 2026
2025
-
Universal Stabilization for Maximum Entropy Optimization in Reinforcement Learning
IEEE Transactions on Neural Networks and Learning Systems, 2025
-
State Transition Difference Prediction for Deep Reinforcement Learning
Pattern Recognition, 2025
-
Compact Exploration for Continuous Action Reinforcement Learning
Pattern Recognition, 2025
-
Hierarchical Reasoning Model
arXiv:2506.21734, 2025
-
HiPPO: Enhancing Proximal Policy Optimization with Highlight Replay
Pattern Recognition, 2025
-
Value Shaping: Bias Reduction in Bellman Error for Deep Reinforcement Learning
2023
-
The Sufficiency of Off-Policyness and Soft Clipping: PPO Is Still Insufficient According to an Off-Policy Measure
AAAI Conference on Artificial Intelligence, 2023
-
Careful at Estimation and Bold at Exploration
arXiv:2308.11348, 2023
-
Enhancing Ontology Translation Through Cross-Lingual Agreement
ICASSP, 2023
2021
-
Multi-Agent Hierarchical Policy Gradient for Air Combat Tactics Emergence via Self-Play
Engineering Applications of Artificial Intelligence, 2021