Hide and Seek: How Simple Competition Taught AI Agents to Use Tools#reinforcement-learning#multi-agent#self-play#autocurricula#emergent-behaviour#openai#tool-useAkmal Alif8 October 2026