Terça-feira, 8 de Setembro de 2026

Chip da OpenAI desafia Nvidia com até 1,9x mais eficiência

A OpenAI divulgou os primeiros resultados de desempenho do Jalapeño, processador desenvolvido com a Broadcom especificamente para inferência de IA. Nos testes apresentados, o chip entregou entre 1,5 e 1,9 vez mais trabalho de IA por watt no pico de processamento, dependendo do modelo utilizado.

Os testes utilizaram o InferenceX, benchmark público desenvolvido pela SemiAnalysis para medir o processamento de requisições de IA de ponta a ponta. Foram avaliados GPT-OSS 120B, DeepSeek R1 670B e Kimi K2.5 1T.

No DeepSeek R1, a OpenAI registrou desempenho máximo por quilowatt cerca de 1,7 vez superior ao sistema baseado no GB300, da Nvidia, além de latência de ponta a ponta 3,6 vezes menor. No Kimi K2.5, o resultado apresentado foi de aproximadamente 1,5 vez mais desempenho por watt e latência 3,4 vezes menor.

O Jalapeño tem potência de projeto de 700 W, ante 1.400 W do GB300 utilizado na comparação. A OpenAI afirma que o consumo sustentado de seu processador permaneceu em até 550 W durante os testes. Para calcular a eficiência, a empresa normalizou os resultados utilizando as especificações publicadas de potência dos processadores.

Benchmark não inclui geração Vera Rubin
Os resultados não abrangem todo o portfólio de aceleradores da Nvidia. O Jalapeño foi desenvolvido especificamente para inferência, e os testes divulgados não incluíram a geração Vera Rubin.

A SemiAnalysis, responsável pelo InferenceX, informou que acompanhou presencialmente testes realizados no laboratório da OpenAI. A organização ressalvou, porém, que não executou toda a suíte InferenceX nem verificou os resultados do AgentX apresentados pela companhia.

A análise da SemiAnalysis também aponta que, pelas características tecnológicas, a comparação mais próxima do Jalapeño seria com a plataforma Vera Rubin. Ambos utilizam memória HBM4.

A arquitetura do processador da OpenAI foi projetada para as duas etapas principais da inferência de modelos de linguagem. O prefill concentra maior demanda computacional, enquanto o decode depende mais da largura de banda da memória.

O Jalapeño mantém estados do modelo e dados de cache localmente dentro de um sistema conectado. A configuração tem como objetivo reduzir a movimentação de informações entre processadores durante a inferência.

OpenAI e Broadcom planejam até 10 GW em aceleradores
O Jalapeño é o primeiro processador de uma plataforma de múltiplas gerações desenvolvida pela OpenAI com a Broadcom. A Celestica participa da industrialização, incluindo placas, integração dos sistemas em racks e produção.

O projeto integra um programa anunciado pelas duas empresas para implantação de até 10 GW em aceleradores de IA projetados pela OpenAI. Os sistemas utilizarão tecnologias Ethernet da Broadcom nas interconexões de processamento.

O cronograma divulgado por OpenAI e Broadcom prevê o início da implantação dos racks no segundo semestre de 2026 e conclusão até o fim de 2029. A SemiAnalysis informa, por sua vez, que atualmente existem amostras de engenharia e projeta aumento gradual da produção durante 2027, com volumes maiores no fim daquele ano.

A OpenAI pretende implantar o Jalapeño em sua própria infraestrutura. A empresa também afirma que continuará comprando processadores da Nvidia e de outros fornecedores para atender à demanda por capacidade computacional.

IA participou do desenvolvimento do Jalapeño
Modelos de IA da OpenAI foram utilizados no desenvolvimento do processador. De acordo com as informações divulgadas pela companhia e pela Broadcom, o ciclo entre o conceito e o tape-out, etapa de finalização do projeto para fabricação, levou nove meses.

A empresa também utilizou o Codex na adaptação de modelos de pesos abertos ao hardware. Três modelos adicionais foram trabalhados em dois meses e, segundo a OpenAI, códigos gerados por IA para componentes selecionados alcançaram desempenho até 1,8 vez superior ao de versões escritas por engenheiros.

O Jalapeño é o primeiro componente de uma estratégia de várias gerações de processadores desenvolvidos pela OpenAI com a Broadcom. A companhia informa que os sucessores do chip já estão em desenvolvimento.

Compartilhe: