Um professor universitário viralizou nas redes sociais após revelar que reprovou 32 de 35 alunos em uma avaliação depois de criar uma estratégia para identificar o uso de inteligência artificial (IA) nas atividades.
O caso aconteceu na Alcorn State University, no Mississippi, nos Estados Unidos. O professor de História Jason Gibson contou, em vídeos publicados no TikTok, que aplicou uma prova em que os estudantes deveriam escrever uma redação sobre a Revolução Industrial.
No enunciado da atividade, ele inseriu uma mensagem escondida, escrita com letras brancas sobre um fundo também branco. A instrução determinava que a palavra “Madagascar” deveria aparecer no texto, mesmo sem qualquer relação com o tema da redação.
A frase não era percebida por quem apenas visualizava o documento na tela. Porém, ao copiar todo o enunciado e colar em ferramentas como o ChatGPT, o comando oculto era levado junto, fazendo com que a IA inserisse a palavra no conteúdo produzido.
Após corrigir as avaliações, o professor encontrou frases sem sentido envolvendo Madagascar, como exemplos em que a palavra aparecia em situações aleatórias.
“Ficou mais do que evidente que os alunos nem voltaram para reler as respostas”, afirmou Gibson nas redes sociais.
O que é prompt injection?
A técnica utilizada pelo professor se relaciona ao conceito de prompt injection, uma prática em que comandos ocultos ou enganosos são usados para influenciar o comportamento de sistemas de inteligência artificial.
No contexto da segurança digital, esse tipo de técnica pode ser explorado para tentar fazer sistemas ignorarem regras, acessarem informações indevidas ou revelarem dados protegidos.
Pesquisas sobre prompt injection começaram a ganhar destaque em 2022, quando especialistas identificaram vulnerabilidades em modelos de linguagem e alertaram para os riscos do uso inadequado dessas ferramentas.