OpenAI divulgou os primeiros resultados do chip Jalapeño, um ASIC desenvolvido em parceria com a Broadcom e projetado especificamente para inferência de IA. Nos testes, o processador superou os superchips Nvidia GB200 e GB300, entregando de 1,7 a 3,6 vezes menos latência e de 1,5 a 1,9 vezes mais trabalho por watt nos modelos GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
Comparação com a Nvidia
- Jalapeño superou os superchips Nvidia GB200 e GB300 em testes de inferência, conforme divulgado pelo The Verge
- O chip oferece de 1,5 a 1,9 vezes mais trabalho por watt nos modelos testados, segundo o The Verge
- A latência de ponta a ponta foi reduzida em 1,7 a 3,6 vezes em comparação aos sistemas de referência, conforme o The Verge
- O benchmark usado foi o InferenceX, desenvolvido pela SemiAnalysis
Estratégia de implantação
- A OpenAI planeja implantar o Jalapeño em pequenos volumes até o final de 2026, com aumento de produção em 2027, conforme o The Verge
- Richard Ho, vice-presidente de hardware da OpenAI, afirmou que o chip oferece o melhor dos dois mundos: menor latência e maior throughput
- A empresa não espera substituir toda a linha de chips com o Jalapeño, mantendo parceiros como a Nvidia, conforme o The Verge
- O desenvolvimento do chip levou nove meses, usando IA própria da OpenAI, conforme iPhone in Canada
O que cada fonte destacou sobre o Jalapeño
- O The Verge foca nos resultados de benchmark e na estratégia de implantação da OpenAI
- O iPhone in Canada detalha ganhos de eficiência energética, com consumo real abaixo de 550W contra 700W nominal, e o tempo de desenvolvimento de nove meses
- Ambas as fontes concordam que o Jalapeño representa um passo significativo para a OpenAI reduzir dependência de terceiros em hardware de IA
- O chip foi lançado com o objetivo de baixar custos operacionais e lidar com tráfego intenso sem depender apenas de GPUs


