Um experimento conduzido pela emissora francesa France 3 avaliou uma redação do ChatGPT sobre o tema filosófico “A verdade é sempre convincente?”. O teste gerou resultados contrastantes entre a correção humana e a avaliação feita por diferentes IAs.
Enquanto uma professora, ciente do uso da IA, atribuiu nota 8 em 20, alegando erros na introdução e superficialidade na análise, sistemas de IA como Gemini, Perplexity, DeepSeek e Copilot deram notas significativamente mais altas, variando entre 15 e 17. As IAs elogiaram a estrutura coerente e a argumentação convincente, mas não perceberam o erro apontado pela professora.
O teste, que se insere em um contexto crescente de aplicação de IA na educação, levanta questões sobre o uso de ferramentas automatizadas na correção de trabalhos acadêmicos. Nos Estados Unidos, muitos educadores já utilizam IA para auxiliar no planejamento de aulas e criação de conteúdo, embora preocupações sobre o uso excessivo de tecnologias nas escolas ainda permaneçam.
O estudo destaca as diferenças entre avaliação humana e automatizada, refletindo sobre o papel da IA na educação e suas limitações no fomento ao pensamento crítico e originalidade dos estudantes.
Leia Mais: