Notícias de IA

GPT-6 Astra ganha modo Ultrafast com respostas até oito vezes mais rápidas

O novo nível de serviço usa GPUs NVIDIA Blackwell e mira agentes que programam e chamam ferramentas. A velocidade extra vem com limites e processamento global, sem residência regional no Brasil.

2 min de leitura
Comparação oficial da NVIDIA entre uma tarefa executada no modo Standard e um foguete decolando no modo Ultrafast.
Imagem oficial de divulgação: NVIDIA.

O que você precisa saber

  • A NVIDIA e a OpenAI anunciaram em 1º de outubro o modo Ultrafast para o GPT-6 Astra, com geração de tokens até oito vezes mais rápida que no nível Standard.
  • O recurso já está disponível na API com limites iniciais e, segundo a NVIDIA, para usuários elegíveis do ChatGPT Work e do Codex.
  • A documentação prevê processamento nos Estados Unidos ou global, sem residência regional dedicada no Brasil.

Entenda a notícia

A NVIDIA anunciou em 1º de outubro que o GPT-6 Astra passou a oferecer o modo Ultrafast. Ele não é um novo modelo separado: trata-se de um nível de serviço mais veloz para o mesmo GPT-6 Astra, executado em infraestrutura NVIDIA Blackwell.

Segundo as empresas, a geração de tokens pode ficar até oito vezes mais rápida que no nível Standard. O ganho foi pensado para tarefas em que a IA precisa responder muitas vezes seguidas, como agentes que escrevem código, usam ferramentas e percorrem várias etapas até concluir um trabalho. Esse número é uma afirmação dos fornecedores e pode variar conforme a tarefa e a conexão.

Na API, o desenvolvedor escolhe o modelo gpt-6-astra e define o nível de serviço como ultrafast. A OpenAI informa que todos os usuários da API podem testar o recurso com limites iniciais de uso. A NVIDIA também cita acesso para usuários elegíveis do ChatGPT Work e do Codex, portanto a disponibilidade pode depender do plano e da liberação da conta.

A documentação recomenda conexões WebSocket para aplicações com agentes, porque o tempo gasto entre uma chamada e outra pode reduzir parte da vantagem. Em outras palavras, acelerar o modelo não elimina gargalos da rede ou de outras ferramentas usadas no fluxo.

Sobre dados, o modo aceita residência nos Estados Unidos ou processamento global. Não há opção de processamento regional dedicada ao Brasil. Isso não impede necessariamente o uso por brasileiros, mas significa que uma empresa com exigência de residência local precisa avaliar a configuração antes de adotar o recurso.

O que muda na prática: quem desenvolve agentes pode obter respostas mais rápidas sem trocar de modelo, mas deve comparar custo, limites e tempo total do fluxo. Para a maioria das pessoas, o benefício aparece quando a espera entre várias ações sucessivas começa a atrapalhar o trabalho, não apenas em uma pergunta isolada.

Na fonte

  1. How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast

    NVIDIA · Fonte primária · publicado em 01 out 2026 · consultado em 02 out 2026

  2. Ultrafast mode

    OpenAI · Documentação oficial · publicado em 01 out 2026 · consultado em 02 out 2026

Encontrou algo que precisa de correção? Veja como avisar a Rensen.

Mais para ler