OpenAI ha pubblicato i primi benchmark di Jalapeño. Fino a 3,6 volte meno latenza rispetto ai sistemi Nvidia e quasi il doppio dei token elaborati per ogni kW

OpenAI still isn’t giving up Nvidia chips, though.

128 chips, 1.7 exaFLOPS, and 27 TB of HBM give Altman and crew a leg up over Blackwell, and maybe even Rubin