tech & talk
IA13 de ago. de 2026, 19:16

OpenAI lança modo Ultrafast: GPT-5.6 Sol roda até 14x mais rápido

OpenAI abre preview limitado do Ultrafast, tier que processa até 750 tokens por segundo com o GPT-5.6 Sol. Parceria com a Cerebras mira empresas que precisam de resposta quase instantânea.

Por Marina Sato · Repórter de IA

Compartilhar

14 vezes mais rápido, por enquanto para poucos

A OpenAI anunciou nesta quinta-feira o Ultrafast, um novo tier de processamento que roda o modelo GPT-5.6 Sol até 14 vezes mais rápido que o modo padrão. O sistema entrega até 750 tokens de saída por segundo, segundo a empresa.

O recurso está em preview limitado. Só um grupo pequeno de clientes tem acesso agora. A OpenAI diz que vai expandir a liberação "conforme a capacidade crescer", sem dar prazo.

Como funciona

A velocidade vem de uma parceria com a fabricante de chips Cerebras. A arquitetura Wafer-Scale Engine da Cerebras mantém os pesos do modelo dentro do próprio chip — 44 GB de SRAM por wafer —, em vez de mover esses dados entre memória e armazenamento externo, como fazem as GPUs convencionais. É esse vaivém de dados que costuma travar a velocidade de inferência em hardware tradicional.

O Ultrafast estreia primeiro na API da OpenAI, não no ChatGPT.

Para quem é

A OpenAI aponta casos de uso corporativos específicos: resposta a incidentes, atendimento ao cliente, análise de mercados financeiros, e-commerce, voz e agentes de desenvolvedor. São tarefas onde a latência baixa importa mais do que em uma conversa comum de chatbot.

Contexto da corrida

O movimento coloca a OpenAI ao lado de concorrentes que já oferecem modos acelerados, como o Claude Fast, da Anthropic. A disputa por inferência mais rápida virou parte da briga por clientes empresariais, que pagam por volume e não toleram espera.

O que ainda falta responder

A OpenAI não informou preço do Ultrafast nem cronograma de expansão além da frase genérica sobre capacidade. Também não ficou claro se há alguma perda de qualidade ou limitação de contexto em troca da velocidade, nem quando — ou se — o modo chega ao ChatGPT para uso geral.

openaigpt-5.6cerebrasinferênciaia empresarial
Compartilhar