Agentic AI has created demand for premium inference: fast, responsive serving for large models. How providers deliver it with prefill on GPUs and decode on RDUs.