AgentX benchmark replays real coding-agent sessions, revealing Nvidia's B200 outperforms AMD's MI355X by up to 5x on cost per token in multi-turn conversational workloads. The cost gap stems from cache management, tokenization optimization, and session routing—software layers where Nvidia's TensorRT-LLM and SGLang stack outpace AMD's ATOM engine.