arxiv:2609.32444
Kaixiang Zhao
kzhao5
AI & ML interests
None yet
Recent Activity
authored a paper 2 days ago
Rethinking Training-Inference Mismatch in LLM Reinforcement Learning: Where It Arises and How to Correct ItOrganizations
None yet