A OpenAI começou a liberar nesta quinta-feira, 8 de outubro, o modo Ultrafast para GPT-6.1 Sol na API, no Codex e no ChatGPT Work. A novidade acelera a geração de respostas do modelo já existente, mas cobra mais por essa velocidade e tem regras de acesso diferentes conforme o produto. O lançamento foi anunciado pela equipe da OpenAI no fórum de desenvolvedores e consta no registro oficial de atualizações.
O que muda com Ultrafast
Ultrafast é uma modalidade de processamento, não um novo modelo. Na API, a documentação da OpenAI orienta selecionar gpt-6.1-sol e definir service_tier como ultrafast. A modalidade já existia para outros modelos; agora chega ao Sol 6.1.
No anúncio, a OpenAI afirma que o Sol nessa modalidade entrega inteligência próxima à do Astra e velocidade de até 8 vezes a do Sol Standard. O número é uma alegação do fabricante sobre velocidade de geração, não uma medição independente de tarefas completas. Uma investigação que também chama ferramentas, espera a rede e valida o resultado pode ganhar menos tempo no total. O changelog do Codex e ChatGPT Work descreve a melhoria especificamente como aceleração da geração de tokens.
Quanto custa na API
Na tabela oficial de preços, os valores abaixo são por 1 milhão de tokens de contexto curto:
- Sol 6.1 Standard: US$ 2 de entrada e US$ 10 de saída.
- Sol 6.1 Fast: US$ 4 de entrada e US$ 20 de saída.
- Sol 6.1 Ultrafast: US$ 12 de entrada e US$ 60 de saída.
Ultrafast custa 6 vezes o Standard nessas duas categorias. Para contexto longo, a tabela apresenta US$ 24 de entrada e US$ 90 de saída no Ultrafast. Há preços separados para entrada em cache e gravação de cache; endpoints regionais podem acrescentar 10% à tarifa. Assim, a escolha depende do volume, do tamanho do contexto e do valor de reduzir a espera.
O guia da API informa que todos os usuários da API podem solicitar o modo, sujeito a limites de taxa próprios. Para aplicações agênticas com várias chamadas em sequência, recomenda WebSockets: a conexão persistente reduz o tempo de rede que poderia esconder parte do ganho de inferência.
Quem tem acesso no Codex e no ChatGPT Work
Nesses produtos, o guia oficial de velocidade lista Pro US$ 500, contratos Enterprise elegíveis com cobrança por uso ou créditos e planos Edu baseados em créditos. O acesso Enterprise começa desligado; responsáveis pelo workspace precisam habilitá-lo. Outros planos individuais de autoatendimento não recebem Ultrafast no lançamento, mesmo com créditos comprados.
O consumo também muda: Ultrafast usa a franquia incluída na assinatura a 8 vezes a taxa do Standard; créditos comprados e uso Enterprise cobrado por consumo seguem 6 vezes a taxa do Standard. Esses multiplicadores medem cobrança ou consumo da franquia, não a aceleração da resposta. Quem utiliza Codex com chave de API segue a tabela da API, sem esses multiplicadores de créditos. A documentação confirma ainda residência de inferência nos Estados Unidos e na Europa (EEE e Suíça) para Sol 6.1 Ultrafast.
Onde a velocidade precisa provar valor
A OpenAI cita resposta a incidentes, agentes que navegam em aplicativos e experiências interativas como exemplos. Na leitura editorial da MnzAI Labs, o teste útil é comparar o mesmo fluxo em Standard, Fast e Ultrafast: tempo até a primeira resposta, duração de ponta a ponta, custo por tarefa concluída e qualidade do resultado. A promessa de velocidade é relevante quando a espera atrapalha o trabalho; o preço exige medir quanto dessa espera realmente desaparece.
