A OpenAI, criadora do ChatGPT, informou na terça-feira, 25 de agosto de 2026, que seu novo chip Jalapeño superou os processadores da Nvidia em testes internos. Segundo a empresa, o componente tem custo 50% menor por token e maior eficiência por watt do que as GPUs da concorrente. O anúncio foi feito em um momento em que a OpenAI busca reduzir a dependência das GPUs da Nvidia para a inferência de seus modelos de inteligência artificial. A inferência é a etapa em que um modelo já treinado processa novos dados para gerar respostas em tempo real. Custo por token é uma métrica comum para medir o gasto computacional de cada resposta gerada por um modelo de IA.
Os resultados, porém, ainda não foram confirmados por benchmarks independentes. A afirmação baseia-se em testes conduzidos pela própria OpenAI, sem avaliação externa até o momento. No dia do anúncio, as ações da Nvidia e da Microsoft caíram na bolsa de valores americana, segundo relatos. A notícia repercutiu em perfis de finanças na internet ao longo do dia.
Relatos mencionam que a OpenAI avalia o uso de chips da Cerebras para acelerar a inferência de seus modelos. A Cerebras, fabricante de processadores wafer-scale, já demonstrou velocidade superior à da Nvidia em tarefas específicas. A tecnologia wafer-scale utiliza um wafer inteiro de silício como um único processador, em vez de dividi-lo em pequenos chips. Até o momento, a OpenAI não confirmou oficialmente o uso da tecnologia da Cerebras.



