ODANIGEEK

PISA 2025 e IA: os 28 pontos não são de quem usa chatbot, são de quem deixa a máquina escrever

O Dani Geek — arte original

A OCDE publicou o PISA 2025 em 8 de setembro. As manchetes viraram “IA emburrece aluno”. O corte de frequência do relatório diz outra coisa, e essa outra coisa é o desenho do uso corporativo mais comum de IA hoje.

O que o relatório mediu de novo

O PISA 2025 Results (Volume I): Future-Ready Students saiu em 8 de setembro de 2026: mais de 760 mil alunos de 15 anos, 91 países e economias, avaliados em 2025, com ciências como domínio principal (OCDE).

É a primeira edição do PISA a perguntar sobre uso de IA generativa. Daí o volume de manchetes: o dado não existia antes. E é a primeira edição em que o questionário permitiu cruzar frequência e finalidade de uso com a nota, o que é bem mais interessante do que o cruzamento que virou título.

Vale registrar o retrato de fundo, porque ele não tem nada a ver com IA: as médias da OCDE são as mais baixas já observadas nas três áreas. Leitura caiu 28 pontos e matemática 22 desde 2015. Isso vinha acontecendo antes de qualquer chatbot existir no celular de um aluno de 15 anos.

Os 28 pontos, e o recorte exato deles

O número que circulou é real: 481 contra 509 em ciências, 28 pontos, uma distância que a OCDE descreve como cerca de um ano e meio de escola, já ajustada por nível socioeconômico (Statista, Business Standard).

O que caiu no caminho entre o relatório e o título foi o recorte. Os 481 pontos não são de “quem usa chatbot”. São de quem usa quase todo dia, para redigir a tarefa, e o corte aparece só na nota de ciências, que era o foco desta edição. São três qualificadores, e todos se perderam na tradução.

E quando você olha a curva inteira, ela não é uma ladeira. Quem usa chatbot uma ou duas vezes por semana rende aproximadamente no mesmo nível de quem não usa, controlando nível socioeconômico. O uso moderado teve média maior que a dos usuários raros e que a dos diários (Fortune).

O desenho é de vale: os dois extremos ficam embaixo e o meio fica em cima.

Para dimensionar: 86% dos alunos da OCDE usaram chatbot para alguma finalidade escolar, cerca de 20% quase todo dia, 14% nunca ou quase nunca (Fortune). O grupo penalizado é uma fatia dos 20%, recortada por finalidade.

A ressalva não é rodapé, é a parte honesta

A OCDE publicou o achado dizendo, no próprio texto, que é associação e não efeito: “These relationships do not necessarily imply a negative impact of AI use on science performance, but may reflect a complex mix of who adopts AI and how they use it.” (via Fortune)

Na prática: o aluno que manda o chatbot escrever a tarefa todo dia pode já estar em dificuldade antes de abrir o chatbot. O PISA é um retrato de um momento, não um experimento controlado. Não existe o grupo que foi sorteado para usar IA e o grupo que foi sorteado para não usar.

O termo “preguiça metacognitiva”, que apareceu em várias coberturas colado no PISA 2025, vem de outra publicação da mesma casa: o Digital Education Outlook 2026, de 19 de janeiro de 2026, que fala em risco de preguiça metacognitiva e desengajamento ao terceirizar a carga cognitiva para o chatbot (síntese da Comissão Europeia, 3/fev/2026). São dois relatórios, e a costura entre eles fui eu quem fez aqui. Vale a pena fazer, mas não é a OCDE dizendo isso dentro do PISA.

O achado que ninguém levou pro trabalho

Tem um dado no PISA 2025 que não está no questionário de IA e que é o mais aproveitável de todos: o padrão de leitura apressada. Alunos respondendo rápido e superficialmente, errando exatamente as questões que exigiam análise mais funda do texto. O comportamento quase dobrou desde 2018 e aparece no conjunto da OCDE, inclusive no Brasil (CNN Brasil).

Esse gesto é medido em outro instrumento, sem chatbot nenhum na equação. E é o mesmo gesto de quem cola o resumo do Copilot na reunião: passou o olho, reteve a forma, não checou o conteúdo.

No Brasil, o recorte que virou manchete foi de adoção: 48% dos alunos brasileiros usam chatbot ao menos uma vez por semana para aprender, contra 46% da média da OCDE. Por finalidade, 40% para pesquisa rápida sobre um tema (OCDE 31%) e 27% para escrever uma redação inteira (OCDE 29%) (Iede, Sou Brasília).

Uma coisa que o relatório não oferece, e que eu não vou inventar: não encontrei corte de nota por uso de IA específico do Brasil. O que existe é adoção brasileira acima da média e a diferença de nota na média da OCDE. Quem disser “o brasileiro que usa IA está 28 pontos atrás” está somando duas tabelas diferentes.

Os três hábitos, que são as três variáveis que a OCDE mediu

O relatório mede escola, mas o que ele descreve é um desenho de uso. Dose diária, a máquina redigindo no seu lugar, ninguém conferindo a saída. Se você trabalha com conhecimento, reconheça o desenho.

1. Dose. O vale existe porque quem usa uma ou duas vezes por semana está usando para uma tarefa, não para todas. Na prática isso significa escolher onde a IA entra: o rascunho de e-mail chato, a primeira versão de um resumo longo, o script que você não quer escrever; não em tudo, todo dia, por padrão. Uso que virou reflexo é dependência.

2. Quem escreve a primeira versão. Esta é a variável que a OCDE isolou e que virou os 28 pontos: a diferença não estava em consultar, estava em draft, deixar o modelo redigir a entrega. A estrutura de um texto é onde o raciocínio mora. Se você nunca escreve a primeira versão de nada, você para de exercitar a parte que organiza a ideia, e sobra só a parte que revisa a organização de outro. Minha régua: o modelo escreve a segunda versão, nunca a primeira, quando a peça é minha argumentação. Quando é execução, tanto faz.

3. Se você confere. O dado mais acionável do relatório: alunos que foram ensinados a avaliar conteúdo gerado por IA tiveram 14 pontos de vantagem em ciências sobre os usuários intensos que não receberam essa orientação (OCDE). E os alunos desfavorecidos são justamente os que ficam sem a orientação.

Essa terceira variável é a mais cara de implementar no trabalho e a única que não custa ferramenta nenhuma. Conferir significa abrir a fonte que o modelo citou, recalcular o número que ele te deu e reescrever com suas palavras a parte que você vai apresentar como sua conclusão, porque escrever é o teste de se você entendeu.

É o mesmo gesto que a leitura apressada do PISA flagra na ausência. E é o gesto que ninguém mede no trabalho, porque no trabalho não tem prova.

O que fica

O relatório da OCDE mede escola e o dado dele é sobre workflow. Nenhuma das três variáveis é uma propriedade da ferramenta: são propriedades de como você a encaixou no seu dia. Trocar de modelo não muda nenhuma delas.

Fica uma pergunta concreta: nos últimos sete dias, quantos dos documentos que você entregou tiveram a primeira versão escrita por um modelo? Não a revisão nem a pesquisa: a primeira versão.

Se a resposta for “todos”, você está no mesmo recorte dos 481 pontos. A diferença é que ninguém vai te aplicar a prova.

E aqui abre a próxima linha, que é mais desconfortável que a do aluno: a OCDE conseguiu medir isso porque a escola tem instrumento. No trabalho, o output entregue no prazo é o instrumento inteiro, e ele não distingue quem entendeu de quem colou. Qual seria o teste de compreensão do trabalhador do conhecimento, e quem teria interesse em aplicá-lo?

Se você tem uma resposta pra isso, ou uma discordância sobre as três variáveis, tô no X em @odanigeek e no LinkedIn em odanigeek.