Quantifying luck vs. skill in 8x8 Block Blast: an EVPI value-of-hindsight decomposition + a trained value-guided policy (+25% over beam search). Zero-dependency Python, live browser demo.
python reinforcement-learning monte-carlo operations-research game-ai value-of-information block-puzzle decision-under-uncertainty
-
Updated
Jul 19, 2026 - Python