A OpenAI divulgou os primeiros resultados oficiais do Jalapeño, seu primeiro chip desenvolvido especificamente para executar modelos de inteligência artificial. Os números apresentados mostram ganhos importantes de eficiência energética e velocidade em comparação com sistemas de última geração utilizados como referência.
Desenvolvido em parceria com a Broadcom, o Jalapeño foi projetado principalmente para inferência de IA, etapa responsável por processar as solicitações dos usuários e gerar respostas a partir de modelos já treinados.
Primeiros testes mostram ganhos expressivos de desempenho
Nos testes realizados com GPT-OSS 120B, DeepSeek R1 670B e Kimi K2.5 1T, a OpenAI afirma que o Jalapeño entregou entre 1,5 e 1,9 vez mais trabalho de IA por watt do que os sistemas utilizados como comparação.
A latência de ponta a ponta também foi reduzida entre 1,7 e 3,6 vezes. Em workloads altamente interativos, a vantagem chegou a 4,1 vezes mais desempenho. OpenAI — primeiros resultados do Jalapeño
Os testes utilizaram o InferenceX, benchmark público desenvolvido pela SemiAnalysis para medir o desempenho de sistemas voltados à inferência.
Um dos destaques foi o teste com o Kimi K2.5, modelo com aproximadamente 1 trilhão de parâmetros. Nesse cenário, a OpenAI registrou cerca de 1,5 vez mais desempenho por watt e 3,4 vezes menor latência em relação ao sistema de referência.
Arquitetura combina alta capacidade de memória e largura de banda
O Jalapeño possui potência nominal de 700 watts, enquanto o consumo sustentado observado nos testes ficou em aproximadamente 550 watts ou menos.
O processador utiliza 216GB de memória HBM4, com largura de banda de aproximadamente 15,4 TB/s. A arquitetura também alcança cerca de 13,4 PFLOPS de computação em MXFP4, segundo informações apresentadas na Hot Chips 2026.
A estrutura foi criada para lidar com modelos de inteligência artificial extremamente grandes, incluindo workloads envolvendo modelos com centenas de bilhões ou até trilhões de parâmetros.
O chip foi desenvolvido especificamente para inferência de inteligência artificial
Diferentemente de uma GPU de uso geral, o Jalapeño é um ASIC, ou seja, um circuito integrado projetado para tarefas específicas.
A OpenAI desenvolveu o processador considerando simultaneamente computação, memória, rede e software, buscando reduzir movimentações de dados e melhorar a eficiência durante a execução dos modelos.
Essa especialização permite que o chip seja otimizado para as características dos modelos utilizados pela própria OpenAI.
A eficiência energética pode reduzir o custo da infraestrutura
Um dos principais objetivos do Jalapeño é permitir que a OpenAI execute uma quantidade maior de operações de IA utilizando menos energia.
Esse ganho pode ser especialmente importante com o crescimento dos agentes de inteligência artificial, que frequentemente precisam realizar diversas chamadas aos modelos para concluir uma única tarefa.
Menor latência significa respostas mais rápidas, enquanto maior eficiência energética pode permitir que a empresa amplie sua capacidade computacional sem aumentar os custos na mesma proporção.
O Jalapeño complementará as GPUs Nvidia
Apesar dos resultados apresentados, o novo chip não representa o fim da utilização de GPUs Nvidia pela OpenAI.
A empresa continuará trabalhando com diferentes fornecedores de hardware. O Jalapeño será utilizado principalmente nos workloads de inferência para os quais sua arquitetura foi otimizada.
GPUs continuam importantes para treinamento de modelos e outras tarefas que exigem maior flexibilidade.
O desenvolvimento do chip foi acelerado com inteligência artificial
A OpenAI afirma que conseguiu levar o Jalapeño do desenvolvimento inicial ao tape-out em aproximadamente nove meses.
A própria inteligência artificial foi utilizada durante partes do desenvolvimento para auxiliar engenheiros na criação, verificação e otimização de componentes do chip.
Esse processo representa uma mudança interessante: a IA não está apenas sendo executada pelo hardware, mas também começa a participar da criação do próprio hardware.
Os próximos meses serão decisivos para o Jalapeño
Os primeiros benchmarks colocam o Jalapeño em uma posição promissora, mas o verdadeiro teste acontecerá quando o processador começar a operar em escala dentro dos data centers da OpenAI.
A empresa precisará comprovar que os ganhos de desempenho, latência e eficiência energética apresentados nos testes também podem ser mantidos em grandes volumes de processamento.
Por enquanto, os resultados divulgados indicam que a OpenAI conseguiu desenvolver uma plataforma própria capaz de competir em eficiência com sistemas avançados utilizados atualmente no mercado.
Quando será implantado?
O Jalapeño não será comercializado como um processador para computadores pessoais ou servidores convencionais.
A OpenAI pretende utilizar o chip diretamente em sua própria infraestrutura.
A empresa planeja iniciar a implantação em pequenos volumes até o final de 2026, com expansão progressiva posteriormente. O projeto também faz parte de uma estratégia de várias gerações de processadores, com novos chips já em desenvolvimento. The Verge — cobertura dos benchmarks do Jalapeño
Com a implantação prevista para o final de 2026 e novas gerações já em desenvolvimento, o Jalapeño pode se tornar uma das peças mais importantes da estratégia de infraestrutura da OpenAI para os próximos anos.
Fontes: OpenAI, Reuters, The Verge, Hot Chips 2026 e ServeTheHome.
