RESUMOS FEITOS POR IA PODEM REESCREVER SUA MEMÓRIA
A IA generativa está se espalhando por trabalhos de alto risco: departamentos de polícia já podem gerar boletins automaticamente a partir das gravações de câmeras corporais ou de áudio; a IA também aparece em contratações e na saúde. Ela comete erros. Num caso relatado, um boletim policial gerado por IA afirmou que um policial tinha se transformado em sapo — ela havia captado a trilha sonora de A Princesa e o Sapo, que tocava ao fundo.
A salvaguarda habitual é um humano que confere o resultado. Mas a memória humana também é falível.
Um efeito de 50 anos
Em 1978, a psicóloga Elizabeth Loftus mostrou que informações recebidas depois de um acontecimento podem mudar a forma como nos lembramos dele: o efeito de desinformação. Em seu experimento clássico, as pessoas assistiam a um acidente de carro num cruzamento com uma placa de “pare” ou de “dê a preferência”, depois liam um texto que citava a placa errada — e muitas se lembravam errado. Até um único verbo (“espatifaram” em vez de “bateram”) pode mudar a velocidade com que as pessoas se lembram de os carros estarem.
Mattea Sim, Yael Eiger e Tadayoshi Kohno, da Universidade de Georgetown e da Universidade de Washington, perguntaram se os resumos de IA poderiam fazer o mesmo.
Etapa 1: quão precisos são os resumos de IA?
Eles usaram dois vídeos animados de 25 segundos vindos de uma replicação moderna do estudo de Loftus: um carro vermelho chega a um cruzamento com uma placa de “pare” ou de “dê a preferência”, vira à direita, atropela um pedestre que cai e se levanta, e o motorista desce. Pediram ao ChatGPT-5.5 e ao Gemini 2.5 Flash-Lite resumos factuais e neutros de pelo menos 300 palavras que incluíssem “tudo o que é importante” — 20 resumos no total.
- Todos os resumos continham erros: de 7 a 21 cada um, em cerca de 305 palavras.
- Em média, 51,6% dos detalhes centrais estavam ausentes.
- 19 dos 20 resumos omitiram a própria colisão — o acontecimento mais importante de todos.
- 60% acrescentaram detalhes que não existiam, como pedestres ou veículos inventados. Um resumo chegou a afirmar que “nenhum outro personagem ou veículo interagiu diretamente com a cena”.
- Os erros mudavam de uma tentativa para outra: o carro virava à direita num resumo e à esquerda em outro.
Etapa 2: isso muda o que as pessoas lembram?
328 participantes nos Estados Unidos assistiram a um dos vídeos. Um a dois dias depois, leram um resumo de 21 frases escrito pelo ChatGPT. Ele citava a placa de trânsito correta ou a errada. A alguns foi dito que uma IA o escrevera; a outros, que um transcritor humano profissional o fizera — o texto era idêntico. Em seguida veio um teste de memória.
- Com um resumo correto, 83,6% se lembraram da placa certa.
- Com um resumo enganoso, apenas 44,8%.
- Não fez diferença se as pessoas achavam que o resumo vinha de uma IA (46,3% de acerto) ou de um humano (43,4%).
- Nem a confiança na IA nem a frequência com que as pessoas a usavam fizeram diferença significativa.

Proporção de participantes que se lembraram da placa de trânsito certa: cerca de 80% após um resumo correto, menos de 50% após um enganoso — fosse ele rotulado como de IA ou de humano. — Figura 1, Sim, Eiger & Kohno (2026), arXiv:2609.28820.
Os participantes se lembravam do vídeo em si: 96,6% recordaram corretamente que o acidente aconteceu de dia, um detalhe ausente do resumo. Curiosamente, o resumo “humano” foi avaliado como mais claro, embora fosse idêntico palavra por palavra.
Um humano no circuito não basta
Os autores concluem que a pessoa encarregada de corrigir a IA pode, em vez disso, ter sua memória alterada pelos erros dela — sem intenção maliciosa de ninguém. Em contextos como o policial, onde a memória das testemunhas oculares é há muito tempo motivo de preocupação, eles questionam se a IA deveria ser usada. Uma versão resumida deste trabalho foi publicada nos anais da AAAI/ACM Conference on AI, Ethics, and Society (outubro de 2026).
Limites
Dois vídeos animados simples, um único prompt e 20 resumos; um só tipo de detalhe enganoso, testado on-line. O resumo mostrado aos participantes foi escolhido entre várias tentativas e levemente editado para ficar mais preciso.
