AgoraResearch hub
ExploreLibraryProfile
Account
Sign In
Xiaohan Wang
Scholar

Xiaohan Wang

Google Scholar ID: H0kocJUAAAAJ
Meituan
Deep reinforcement learningOptimizationCausal inferenceScheduling
Google Scholar↗
Citations & Impact
All-time
Citations
613
 
H-index
13
 
i10-index
16
 
Publications
20
 
Co-authors
6
list available
Contact
No contact links provided.
Publications
21 items
One Step, One Lead: Mitigating Higher-Order Interference in Multi-Domain Reinforcement Learning via Cross-Step Control
2026
Cited
0
When Not to Imitate: Boundary-Aware Skill Memory for Reliable Tool-Use LLM Agents
2026
Cited
0
HiDiffTIR: Hierarchical Difficulty-Aware Policy Optimization for Multi-Turn Tool-Integrated Reasoning
2026
Cited
0
Toward Plasticity-Preserving KL Regularization for Capability Retention in LLM Reinforcement Learning
2026
Cited
0
UniMem: Complementary Episodic-to-Parametric Memory for Boundary-Agnostic Task Streams
2026
Cited
0
TAPO: Tool-Aware Policy Optimization via Credit Transfer for Multimodal Search Agents
2026
Cited
0
VistaHop: Benchmarking Multi-hop Visual Reasoning for Visual DeepSearch
2026
Cited
0
Are Full Rollouts Necessary for On-Policy Distillation?
2026
Cited
0
Resume (English only)
Co-authors
6 total
Lin Zhang
Lin Zhang
Professor Ph.D., Director, Cloud Manufacturing Research Center, Beihang Universiy
Yuanjun Laili
Yuanjun Laili
Beihang University
Lihui Wang
Lihui Wang
Chair Professor of Sustainable Manufacturing, KTH
Xi Vincent Wang
Xi Vincent Wang
KTH Royal Institute of Technology
Co-author 5
Co-author 5
Co-author 6
Co-author 6