GPT-6 Astra no plano Plus de US$ 20: onde ele aparece, quantas mensagens você tem e de onde saem os 37 pontos do benchmark

O Dani Geek — arte original
A OpenAI “liberou” o GPT-6 Astra para o plano de 20 dólares. A palavra esconde três detalhes que mudam o que você comprou: a superfície onde ele aparece, a cota que ele consome e o número que a apresentação de lançamento não explicou.
“Liberou” quer dizer Work e Codex. O Chat ficou de fora
O rollout do GPT-6 Astra começou em 3 de setembro, escalonado por plano e por produto, segundo o cronograma publicado pelo Engadget. Quatro dias depois, o Notebookcheck resumiu o que a página de ajuda da OpenAI diz sem alarde: o assinante Plus recebe o Astra dentro do ChatGPT Work e do Codex. No Chat comum, aquela aba que a maioria abre de manhã, ele continua sem o modelo.
No Chat, o Astra aparece com outro nome, “GPT-6 Pro”, e a lista de quem tem acesso é curta: Pro de US$ 100, Pro de US$ 200, Business e Enterprise. Se você paga 20 dólares e foi procurar o seletor de modelo na conversa de sempre, o que você viu é o GPT-5.6 Sol. E o Sol, no Chat, teve os limites de 5 horas apertados de novo no fim de agosto, conforme o mesmo Notebookcheck.
Isso explica o trending de setembro no X, “GPT-6 Astra Rollout Confuses ChatGPT Plus Users on Access”. Ninguém foi enganado, mas ninguém foi avisado com clareza. Se a sua empresa assina o Plus por causa do Astra, vale conferir se alguém do time abre o Work ou o Codex. Se ninguém abre, o upgrade está numa aba que ninguém usa.
Quantas mensagens cabem
Aqui a OpenAI publica números para os planos caros e uma frase para o barato. A tabela abaixo separa o que é oficial do que é estimativa de terceiros.
| Plano | Onde o Astra aparece | Cota | Fonte |
|---|---|---|---|
| Plus (US$ 20) | ChatGPT Work e Codex | “quantidade limitada” dentro da cota de Work/Codex, com créditos extras à venda | OpenAI via Notebookcheck |
| Plus (US$ 20) | Work e Codex | 5 a 45 mensagens por janela de 5 h (estimativa) | Yellow, Renascence |
| Pro (US$ 100) | Chat, como “GPT-6 Pro” | 50 msgs/semana, compartilhadas com o GPT-5.6 Sol Pro | Notebookcheck, LLM Rumors |
| Pro (US$ 200) | Chat, como “GPT-6 Pro” | 200 msgs/semana | idem |
A linha que interessa ao assinante Plus é a segunda, com uma ressalva: 5 a 45 mensagens é faixa calculada por sites de terceiros, e a OpenAI não publica o número. Para comparar, os mesmos sites estimam 10 a 100 mensagens por janela com o GPT-5.6 Sol. Na prática, a cota do Astra vale mais ou menos metade da cota do Sol pela mesma janela. A faixa larga (5 a 45) vem do tamanho das mensagens: contexto longo pesa mais.
O explainx fala em “limites cortados 4x” em setembro. Não achei fonte primária para esse multiplicador, então fica registrado como afirmação de terceiro, sem peso de fato.
Acabou a cota, a opção oficial é comprar crédito. O que acontece na tela nesse momento (aviso, bloqueio, troca automática para o Sol) nenhuma fonte descreve. Volto a isso no fim.
De onde saem os 37 pontos
O número circulou como “o benchmark independente ficou 37 pontos abaixo do anunciado”. A origem é exata e está no post do ARC Prize de 3 de setembro, publicado no mesmo dia do rollout.
No ARC-AGI-3 Semi-Private, o GPT-6 Astra fez 99,9% com o harness chamado “Provider Adapter” e 62,7% com o harness padrão, o mesmo aplicado a todos os modelos. A diferença é de 37,2 pontos.
O ARC Prize explica a diferença pela medição, nesta frase: “The Provider Adapter harness preserves opaque reasoning state between requests and uses compaction for longer conversations, allowing the model to reuse prior work.” Ou seja: o adapter deixa o modelo guardar o raciocínio entre uma jogada e outra e compacta a conversa quando ela cresce. O harness padrão apaga esse estado a cada requisição. É o mesmo modelo em duas condições de prova.
Os custos ajudam a entender o que o adapter faz. A rodada com o harness padrão custou US$ 26.098. Com o Provider Adapter, US$ 18.817. Reaproveitar trabalho anterior saiu mais barato e pontuou mais. O humano de referência custa cerca de US$ 12,78 por jogo.
A hipótese de que o Plus recebe um modelo diferente, mais fraco, é a que mais aparece nas discussões. O ARC Prize diz o contrário: o modelo é o mesmo, o harness é que muda. Não existe evidência de modelo distinto no plano barato, e dá para descartar a hipótese.
O que sobra é uma escolha de apresentação. O gráfico de lançamento no anúncio oficial da OpenAI mostra o 99,9%. Como o Vellum apontou, o gráfico não avisa que os modelos anteriores não foram testados com o mesmo adapter. Comparar o Astra com adapter contra os antigos sem adapter infla a distância. Isso é falha de comunicação, e a discrepância de 37 pontos vira escândalo só se você ignorar a nota de rodapé que o ARC Prize escreveu no mesmo dia.
O índice independente conta outra história
O benchmark do ARC mede um tipo de tarefa. Para o dia a dia de quem paga assinatura, o índice da Artificial Analysis é mais útil, porque agrega várias provas com a mesma régua para todo mundo.
Nele, o Astra fez 53, empatado com o Claude Fable 5.1 e seis pontos acima do GPT-5.6 Sol, que fez 47. No GDPval-AA v2, a parte do índice que mede tarefas de trabalho de escritório, o Astra caiu cerca de 45 pontos de Elo em relação ao Sol.
Os dois números só fazem sentido juntos. Na régua neutra, o Astra avança sobre o Sol. Em tarefas de escritório, mediu pior. Para um assinante Plus, que só tem o Astra no Work e no Codex, isso pesa: a superfície onde você tem acesso é justamente a de trabalho, e é onde o modelo novo perdeu terreno para o antecessor. Esse é o dado que eu olharia antes de decidir qualquer upgrade.
O que eu faria com um Plus hoje
Se o seu uso é conversa no Chat, o Astra não mudou nada para você. Você continua no Sol, com a cota apertada de agosto.
Se você usa o Work ou o Codex, é onde eu testaria o Astra primeiro: tarefas longas de código ou análise, onde reaproveitar contexto vale. É exatamente o cenário em que o adapter do ARC fez diferença, e faz sentido que o modelo se pague nesse tipo de sessão, com a cota curta gasta em poucas mensagens grandes em vez de muitas pequenas.
Se você compra crédito extra quando a cota acaba, anote o quanto gastou no primeiro mês. A OpenAI não publica a cota do Plus, então o seu extrato é a única tabela oficial que você vai ter.
O teste que falta
Duas coisas desta história ninguém mediu em público, e não vou fingir que medi.
A primeira é o comportamento na fronteira da cota. Quando as mensagens de Astra acabam no meio de uma tarefa no Codex, o sistema avisa, bloqueia ou troca para o Sol sem dizer? Nenhuma das fontes descreve. Isso pede gravação de tela na própria conta, e é o próximo teste da casa.
A segunda é o número exato de mensagens no Plus. A faixa de 5 a 45 por 5 horas é a melhor estimativa disponível, e continua sendo estimativa até alguém contar na conta, mensagem por mensagem, com tamanho de contexto controlado.
Fica a pergunta para quem já esbarrou no limite: na sua conta, o Codex avisou antes de parar, ou você descobriu pelo erro?
Fontes citadas: Engadget · Notebookcheck · OpenAI Help · Yellow · Renascence · LLM Rumors · ARC Prize · Artificial Analysis · Vellum · OpenAI · explainx · X trending