A OpenAI publicou em 27 de agosto de 2026 os resultados de um experimento conduzido em conjunto com a Bocconi University, na Itália, sobre o impacto do ChatGPT e de treinamento em pensamento crítico no desempenho de estudantes universitários em tarefas reais. O estudo contou com mais de 1.000 alunos de graduação do primeiro ano, que participaram de um exercício prático de recomendações de marketing para a loja da universidade.

Estrutura do experimento

Os estudantes foram distribuídos aleatoriamente em quatro grupos: um com acesso ao ChatGPT (GPT-4o), outro com treinamento em raciocínio causal, um terceiro com ambos, e um quarto sem nenhum dos dois recursos. O raciocínio causal, foco do exercício de pensamento crítico, é uma abordagem voltada para ligar causas e efeitos e explicar por que determinada solução pode ou não funcionar. O treinamento envolveu jogos, exemplos, perguntas e feedback, mas não incluiu uso de IA.

As entregas dos alunos foram avaliadas por corretores humanos segundo um critério de cinco pontos, além de análises automatizadas de texto para medir número e variedade de ideias, sinais de raciocínio causal e similaridade com respostas de especialistas.

Resultados: IA eleva padrão, pensamento crítico amplia diversidade

O acesso ao ChatGPT aumentou em quase um ponto a nota média dos alunos na escala de cinco pontos. As respostas desse grupo apresentaram mais ideias, lógica mais clara e maior semelhança com recomendações de especialistas, indicando que a IA ajudou estudantes inexperientes a produzir trabalhos mais profissionais. Importante: os alunos não apenas copiaram respostas do ChatGPT, mas precisaram decidir o que perguntar, avaliar as respostas e compor o texto final.

Já o treinamento em pensamento crítico não elevou as notas na avaliação tradicional, mas fez diferença na análise de originalidade. Os alunos desse grupo geraram ideias mais diversas e distintas entre si, mesmo que o critério de correção priorizasse apenas dois objetivos clássicos de marketing. Isso evidencia uma limitação de rubricas tradicionais, que tendem a valorizar clareza e estrutura, mas podem ignorar a originalidade.

O grupo que recebeu tanto acesso ao ChatGPT quanto o treinamento em pensamento crítico apresentou benefícios combinados: variedade de ideias semelhante à do grupo com treinamento, notas e número de ideias próximas ao grupo com IA, além de maior coesão lógica e mais questionamento de premissas.

Implicações para avaliação escolar

O estudo ressalta um desafio para escolas e universidades: se a IA pode ajudar alunos a criar textos polidos e “de especialista”, o produto final passa a dizer menos sobre o real entendimento do estudante. Avaliações baseadas apenas no texto final podem não captar aspectos como originalidade e raciocínio. Os autores sugerem que critérios de avaliação devem evoluir para premiar não só clareza e estrutura, mas também diversidade de ideias e explicitação de raciocínios.

Por que importa

O experimento reforça que IA e pensamento crítico não são opostos, mas complementares no desenvolvimento acadêmico. Enquanto o ChatGPT eleva o padrão técnico das respostas, o treinamento crítico amplia a variedade e profundidade das ideias. Para o Brasil, onde o debate sobre uso de IA na educação é recente, o estudo sugere que políticas e práticas pedagógicas devem ir além da preocupação com plágio ou “cola” digital, focando em como integrar IA e habilidades analíticas para formar profissionais mais completos.

Tags
  • #openai
  • #chatgpt
  • #educação
  • #critical thinking
  • #experimento