trampolim.net
PT EN

Trampolim · Jornal de tecnologia

Novidades da Semana

Edição 17Semana de 17 a 23 de agosto de 20268 matérias
IA

OpenAI lança modo Ultrafast com GPT 5.6 Sol 14 vezes mais rápido

OpenAI libera o modo Ultrafast, que acelera o modelo GPT 5.6 Sol para 750 tokens por segundo. Operações de inferência em alta frequência ganham novo patamar de latência.

OpenAI lança modo Ultrafast com GPT 5.6 Sol 14 vezes mais rápido
IA · 17 a 23 de agosto de 2026

No dia 13 de agosto, a OpenAI anunciou o modo Ultrafast para seu modelo mais recente, o GPT 5.6 Sol. A empresa afirma que a nova modalidade de processamento opera a uma velocidade 14 vezes maior que o padrão, com capacidade de gerar até 750 tokens de saída por segundo, de acordo com comunicado publicado no TechCrunch.

Os tokens representam as unidades de texto que um modelo de linguagem processa e gera a cada interação. Um ganho de 14x na velocidade de saída significa que, em aplicações que exigem respostas em tempo real — como chatbots de atendimento, assistentes de código e sistemas de automação — o tempo de espera cai de segundos para frações de segundo.

A OpenAI não detalhou as alterações arquiteturais que viabilizam o Ultrafast, nem se o modo exige infraestrutura específica, como GPUs dedicadas ou balanceamento de carga diferenciado. O anúncio sugere que a aceleração é uma configuração opcional, não um novo modelo.

Para operações que rodam inferência intensiva por API, o Ultrafast muda o cálculo de custo por requisição e o dimensionamento de capacidade. Um throughput 14 vezes maior pode reduzir o número de instâncias necessárias para atender o mesmo volume de chamadas, mas também pode implicar maior consumo por token se o preço não for reajustado proporcionalmente. O jornal recomenda que equipes de engenharia meçam a latência real e o custo total antes de migrar cargas inteiras para o novo modo.

Marcar conversa