Top-down 2D 5v5 bomb-defuse multi-agent RL simulator with live match viewer. Recurrent MAPPO + TarMAC emergent communication, no scripted strategies.
react reinforcement-learning simulation websocket pytorch multi-agent pixijs self-play tarmac marl fastapi mappo pettingzoo tactical-ai
-
Updated
Jun 21, 2026 - Python