DiárioTI

Notícias de tecnologia, todos os dias

OpenAI lança modo Ultrafast para o GPT-6.1 Sol: até 8 vezes mais rápido, por seis vezes o preço

Novo nível de serviço do GPT-6.1 Sol promete respostas até 8x mais rápidas na API, no Codex e no ChatGPT Work, a US$ 12 e US$ 60 por milhão de tokens.

OpenAI lança modo Ultrafast para o GPT-6.1 Sol: até 8 vezes mais rápido, por seis vezes o preço

A OpenAI começou a liberar em 8 de outubro de 2026 o Ultrafast, um novo nível de serviço para o modelo GPT-6.1 Sol na API, no Codex e no ChatGPT Work. Segundo o anúncio no fórum de desenvolvedores da empresa, o modo entrega inteligência “próxima à do Astra”, o modelo mais caro da casa, com velocidade até oito vezes maior que a do Sol no modo Standard. A troca é explícita: na API, o preço é seis vezes o do Standard.

O que muda e quanto custa

O Ultrafast não é um modelo novo, e sim uma forma mais rápida de servir o mesmo GPT-6.1 Sol. Na API, basta usar a Responses API com o modelo gpt-6.1-sol e o parâmetro service_tier igual a ultrafast, conforme o guia do modo. A página do modelo informa os preços do Standard, de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída, e diz que o Ultrafast custa 6 vezes isso: US$ 12 e US$ 60, valores confirmados no anúncio, que os descreve como 1,2 vez o custo do GPT-6 Astra. O modelo tem janela de contexto de 1,05 milhão de tokens e até 128 mil tokens de saída.

O guia recomenda conexões por WebSocket, sobretudo em agentes que fazem muitas chamadas de ferramentas seguidas, porque o custo de abrir conexões a cada requisição pode consumir parte do ganho de latência. O Ultrafast tem limites de taxa próprios, separados dos modos Standard e Fast: para o GPT-6.1 Sol, 1 milhão de tokens por minuto no nível Build, 4 milhões no Launch e 40 milhões no Grow. O modo também vale para o GPT-6 Astra, com limites menores. O Sol no Ultrafast aceita residência de dados nos EUA e na União Europeia; o Astra, só nos EUA.

Quem tem acesso

Na API, o Ultrafast está disponível para todos os usuários. No Codex e no ChatGPT Work, o acesso fica restrito aos planos Pro 500, Enterprise com cobrança por uso elegível e Edu com créditos, e no Enterprise depende de o administrador habilitar o recurso. A AWS anunciou no mesmo dia o Ultrafast do GPT-6.1 Sol no Amazon Bedrock, voltado a assistentes de código e agentes interativos. Segundo o site DigIntoAI, que cita a documentação do Codex, o uso no modo consome os limites incluídos nas assinaturas a 8 vezes a taxa do Standard e os créditos comprados a 6 vezes.

O que ainda não está comprovado

O ganho de até 8 vezes e a comparação com o Astra são números da própria OpenAI, sem medição independente publicada até 10 de outubro. O DigIntoAI relatou que testadores iniciais mediram velocidades bem abaixo do prometido no Playground da OpenAI, e que Tibo Sottiaux (@thsottiaux), da OpenAI, atribuiu a lentidão ao próprio Playground, à renderização no navegador e à rede, e disse que a empresa já mudou a renderização da ferramenta. Para quem avalia o recurso, a recomendação prática é medir a latência no próprio fluxo de trabalho, com WebSocket, antes de assumir o custo seis vezes maior.

  • Faz sentido em tarefas em que segundos valem dinheiro, como depuração de incidentes, agentes que navegam em aplicativos e experiências ao vivo, exemplos citados pela OpenAI.
  • Para lotes e tarefas sem pressa, os modos Batch e Flex custam 50% menos que o Standard, segundo a página do modelo.

Fontes

Imagem destacada: ilustração gerada por computador, sem valor documental.

Deixe comentário

Seu endereço de e-mail não será publicado. Os campos necessários são marcados com *.

Fique por dentro

As principais notícias de tecnologia, todos os dias

Siga o portal nas redes sociais e acompanhe IA, cibersegurança, cloud, hardware e o mercado de tecnologia em primeira mão.