Last released Oct 1, 2026
Re:Max and Re:Dr verified replay for reinforcement learning with verifiable rewards
Execution-bound correctness and solution mode diversity benchmark