Notícias de IA
GPT-6 Astra ganha modo Ultrafast com respostas até oito vezes mais rápidas
O novo nível de serviço usa GPUs NVIDIA Blackwell e mira agentes que programam e chamam ferramentas. A velocidade extra vem com limites e processamento global, sem residência regional no Brasil.

O que você precisa saber
- A NVIDIA e a OpenAI anunciaram em 1º de outubro o modo Ultrafast para o GPT-6 Astra, com geração de tokens até oito vezes mais rápida que no nível Standard.
- O recurso já está disponível na API com limites iniciais e, segundo a NVIDIA, para usuários elegíveis do ChatGPT Work e do Codex.
- A documentação prevê processamento nos Estados Unidos ou global, sem residência regional dedicada no Brasil.
Entenda a notícia
A NVIDIA anunciou em 1º de outubro que o GPT-6 Astra passou a oferecer o modo Ultrafast. Ele não é um novo modelo separado: trata-se de um nível de serviço mais veloz para o mesmo GPT-6 Astra, executado em infraestrutura NVIDIA Blackwell.
Segundo as empresas, a geração de tokens pode ficar até oito vezes mais rápida que no nível Standard. O ganho foi pensado para tarefas em que a IA precisa responder muitas vezes seguidas, como agentes que escrevem código, usam ferramentas e percorrem várias etapas até concluir um trabalho. Esse número é uma afirmação dos fornecedores e pode variar conforme a tarefa e a conexão.
Na API, o desenvolvedor escolhe o modelo gpt-6-astra e define o nível de serviço como ultrafast. A OpenAI informa que todos os usuários da API podem testar o recurso com limites iniciais de uso. A NVIDIA também cita acesso para usuários elegíveis do ChatGPT Work e do Codex, portanto a disponibilidade pode depender do plano e da liberação da conta.
A documentação recomenda conexões WebSocket para aplicações com agentes, porque o tempo gasto entre uma chamada e outra pode reduzir parte da vantagem. Em outras palavras, acelerar o modelo não elimina gargalos da rede ou de outras ferramentas usadas no fluxo.
Sobre dados, o modo aceita residência nos Estados Unidos ou processamento global. Não há opção de processamento regional dedicada ao Brasil. Isso não impede necessariamente o uso por brasileiros, mas significa que uma empresa com exigência de residência local precisa avaliar a configuração antes de adotar o recurso.
O que muda na prática: quem desenvolve agentes pode obter respostas mais rápidas sem trocar de modelo, mas deve comparar custo, limites e tempo total do fluxo. Para a maioria das pessoas, o benefício aparece quando a espera entre várias ações sucessivas começa a atrapalhar o trabalho, não apenas em uma pergunta isolada.
Na fonte
- How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast
NVIDIA · Fonte primária · publicado em 01 out 2026 · consultado em 02 out 2026
- Ultrafast mode
OpenAI · Documentação oficial · publicado em 01 out 2026 · consultado em 02 out 2026
Encontrou algo que precisa de correção? Veja como avisar a Rensen.

