arxiv:2605.12236
Jesse Zhang PRO
jesbu1
AI & ML interests
Reinforcement Learning, Robot Learning
Recent Activity
authored a paper 1 day ago
TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning authored a paper 1 day ago
OGPO: Sample Efficient Full-Finetuning of Generative Control Policies new activity 3 days ago
robometer/rewardeval_ui:Demo broken