Online goal-reaching RL with diffusion planning: a 2D point-mass prototype plus a Maze2D Diffuser workflow driven by an autonomous agentic experiment controller.
reinforcement-learning pytorch planning model-based-rl diffusion-models d4rl online-rl ml-research agentic-research maze2d
-
Updated
Feb 28, 2026 - Python