Apuramos.

Lemos todas as fontes. Você decide.

Sobre
Tecnologia

Chip Jalapeño da OpenAI supera Nvidia Blackwell em eficiência

Primeiro processador próprio da empresa entregou até 1,9 vez mais trabalho de IA por watt e latência até 3,6 vezes menor que o GB300 nos testes divulgados. Especialistas apontam ressalvas na comparação.

Redação Apuramos

Publicado em

He Junhui/Unsplash — imagem ilustrativa
He Junhui/Unsplash — imagem ilustrativa

A OpenAI divulgou os primeiros resultados de desempenho do Jalapeño, seu primeiro processador próprio, e afirma que o chip superou o hardware mais avançado da Nvidia em eficiência energética e em velocidade de resposta. Os números foram apresentados na terça-feira (25), durante o evento Hot Chips.

Segundo o portal Tele.Síntese, o Jalapeño entregou entre 1,5 e 1,9 vez mais trabalho de IA por watt no pico de processamento, dependendo do modelo usado. A latência de ponta a ponta ficou de 1,7 a 3,6 vezes menor que a do sistema baseado no GB300, da Nvidia.

Os testes usaram o InferenceX, benchmark público criado pela SemiAnalysis para medir o processamento de requisições de IA de ponta a ponta. Foram avaliados três modelos de pesos abertos: o GPT-OSS 120B, da própria OpenAI, o DeepSeek R1 670B e o Kimi K2.5 1T, da chinesa Moonshot AI.

No DeepSeek R1, a empresa registrou desempenho máximo por quilowatt cerca de 1,7 vez superior ao do sistema com GB300, além de latência de ponta a ponta 3,6 vezes menor. No Kimi K2.5, o resultado apresentado foi de aproximadamente 1,5 vez mais desempenho por watt e latência 3,4 vezes menor.

O Jalapeño tem potência de projeto de 700 W, contra 1.400 W do GB300 usado na comparação. A OpenAI afirma que o consumo sustentado do seu chip ficou em até 550 W durante os testes e que normalizou os resultados usando as especificações publicadas de potência dos processadores.

Esse método é justamente uma das ressalvas apontadas na análise do site Brain_ing: a margem seria menor se a conta usasse a potência efetivamente consumida, e não o TDP, e também se a medição considerasse a geração de vários tokens simultâneos em vez de token único.

Há outra limitação relevante. Os testes não incluíram a geração Vera Rubin, sucessora da arquitetura Blackwell. A SemiAnalysis, responsável pelo benchmark, informou que acompanhou presencialmente os testes no laboratório da OpenAI, mas ressalvou que não executou toda a suíte InferenceX nem verificou os resultados do AgentX apresentados pela companhia.

Desenvolvido em parceria com a Broadcom, o Jalapeño é voltado exclusivamente à inferência — a etapa em que um modelo já treinado responde às solicitações dos usuários. Ele não serve para treinar novos modelos, o que mantém a OpenAI dependente de fornecedores externos.

“Vamos precisar de muita capacidade computacional”, disse Richard Ho, vice-presidente de hardware da OpenAI, à Axios. “E o Jalapeño é parte disso. O Cerberus é parte disso. A Nvidia é parte disso. A AMD é parte disso.”

Ainda à Axios, a empresa afirmou que espera ter um número limitado de sistemas com o Jalapeño em operação ainda este ano, com capacidade maior no ano que vem. Um chip de segunda geração já está em desenvolvimento avançado e uma terceira versão começa a ser planejada. A OpenAI diz que não pretende vender o processador a outras companhias.

O movimento não é isolado. O Google mantém a linha TPU, com chips para treinamento e para inferência, e Amazon e Microsoft também têm projetos próprios. A Anthropic confirmou neste mês que vai montar uma equipe interna de design de chips, segundo a Axios.

Para a Nvidia, o efeito prático ainda é incerto. A CNBC avalia que o Jalapeño representa uma nova ameaça às margens da empresa no segmento de inferência, hoje o de crescimento mais rápido, ainda que a fabricante siga com a maior fatia da computação de IA e com o ecossistema de software CUDA como trunfo.

O cronograma divulgado por OpenAI e Broadcom prevê o início da implantação dos racks no segundo semestre de 2026 e a conclusão até o fim de 2029, dentro de um programa de até 10 GW em aceleradores. Um obstáculo à escala é a memória HBM4 usada pelo chip, um dos componentes mais disputados do mercado de hardware.

Fontes consultadas nesta apuração

  • openai
  • nvidia
  • jalapeño
  • broadcom
  • chips de ia
  • inteligência artificial
  • semicondutores

Mais de Tecnologia