“Cluster”, que fornecerá inferência para modelos de IA de código aberto em larga escala na IBM Cloud, vai usar sistemas da Nvidia, disseram as empresas 0.5x 1x 1.25x 1.5x 2x 00:00 00:00 A IBM e a startup Together AI assinaram um acordo plurianual de US$ 240 milhões para construir um “cluster” [infraestrutura de hardware] de inteligência artificial em larga escala na IBM Cloud usando sistemas da Nvidia, disseram as empresas nesta terça-feira (11). O cluster fornecerá inferência para modelos de IA de código aberto, que ganharam força à medida que as empresas buscam reduzir os custos de IA e avaliar as preocupações com incidentes de segurança cibernética envolvendo modelos da Anthropic, OpenAI e Meta. A inferência, o processo de executar modelos de IA treinados para gerar respostas, tornou-se um dos maiores impulsionadores da demanda por capacidade computacional, levando provedores de nuvem e fabricantes de chips a gastar bilhões de dólares na expansão da infraestrutura de IA. O “cluster” na IBM Cloud utilizará os sistemas HGX B300 da Nvidia, que interligam os processadores Blackwell mais recentes da fabricante de chips e seus equipamentos de rede Ethernet Spectrum-X. A Nvidia afirmou que os chips Blackwell são otimizados para inferência de IA. O cluster inicial contará com cerca de 2 mil chips Nvidia Blackwell 300 e estará localizado nos Estados Unidos, disse Kai Mak, diretor de receita da Together AI, em entrevista à Reuters. “Acreditamos que o ‘cluster’ se esgotará com pelo menos dois ou três meses de antecedência”, acrescentou Mak. “Teremos demanda total bem antes de o serviço estar disponível.” A plataforma da Together AI, com sede em San Francisco, permite que empresas treinem e executem cargas de trabalho de IA em modelos abertos, como DeepSeek, MiniMax e Kimi, a custos mais baixos do que sistemas fechados. Sua última avaliação foi de US$ 8,3 bilhões em julho. — Foto: Bloomberg