Real-robot self-improvement on OpenMANIPULATOR-X Fine-tuning π0.5 on its own rollouts with a low-cost arm (in progress) SlitheRL A tensorized multiplayer Snake environment for deep Q-learning (with Kaiying Hou, 2021)