Scholar
Jiajun Chai
Google Scholar ID: yDdfap0AAAAJ
Meituan Inc.
Reinforcement Learning
LLMs
Agentic Learning
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
209
H-index
6
i10-index
5
Publications
20
Co-authors
5
list available
Contact
No contact links provided.
Publications
36 items
Tool Retrievers Are Underestimated: Annotation Expansion Reveals True Capability
2026
Cited
0
One Step, One Lead: Mitigating Higher-Order Interference in Multi-Domain Reinforcement Learning via Cross-Step Control
2026
Cited
0
ATLAS: Dual-Horizon Diagnostic Evaluation for Industrial Tool-Use Agents
2026
Cited
0
When Not to Imitate: Boundary-Aware Skill Memory for Reliable Tool-Use LLM Agents
2026
Cited
0
HiDiffTIR: Hierarchical Difficulty-Aware Policy Optimization for Multi-Turn Tool-Integrated Reasoning
2026
Cited
0
Toward Plasticity-Preserving KL Regularization for Capability Retention in LLM Reinforcement Learning
2026
Cited
0
UniMem: Complementary Episodic-to-Parametric Memory for Boundary-Agnostic Task Streams
2026
Cited
0
TAPO: Tool-Aware Policy Optimization via Credit Transfer for Multimodal Search Agents
2026
Cited
0
Load more
Resume (English only)
Co-authors
5 total
Yuanheng Zhu
Institute of Automation, Chinese Academy of Sciences
Dongbin Zhao
Institute of Automation, Chinese Academy of Sciences
Yuqian Fu
Institute of Automation,Chinese Academy of Sciences
Guojun Yin
Meituan, University of Science and Technology of China
Mingrui Yu (于铭瑞)
PhD student, Department of Automation, Tsinghua University