Computação e IAPré-publicaçãoAnálise de dados4 min de leitura

AINDA FINANCIADA, JÁ NÃO CONTABILIZADA

Os financiadores de pesquisa cada vez mais descobrem o que financiam deixando um software classificar o texto de seus financiamentos. Os Institutos Nacionais de Saúde (NIH) dos EUA fazem isso desde 2008. Seu sistema RCDC analisa o título, o resumo, a declaração de relevância para a saúde pública e os objetivos específicos de cada financiamento, e todo ano a agência informa ao Congresso e ao público quanto gastou em mais de 300 categorias, do câncer à saúde das minorias. Pesquisadores, ativistas e funcionários dos NIH usam esses totais como o registro de qual ciência o público paga.

Os estudos dessas classificações pressupõem que quem escreve o texto é o candidato. Fangfang Xie (Universidade de Nanquim), Jingwen Zhang (Universidade de Hubei) e Haining Wang (Escola de Medicina da Universidade de Indiana) perguntaram o que acontece quando o próprio financiador edita o texto que seu software contabiliza.

O que mudou em 2025

Segundo os documentos citados no artigo, decretos presidenciais de 20 e 21 de janeiro de 2025 visaram os programas de diversidade, equidade e inclusão (DEI) e a “ideologia de gênero”. Em 4 de março de 2025, uma orientação dos NIH disse aos gestores de programa que os financiamentos que “não apoiam atividades DEI, mas podem conter linguagem relacionada a DEI” deveriam ser atualizados “com a linguagem DEI removida” antes da liberação dos recursos. Um tribunal federal anulou essas diretrizes em 16 de junho de 2025; em 21 de agosto, a Suprema Corte manteve essa decisão, suspendendo porém a parte que anulava os encerramentos de financiamentos. Em dezembro de 2025, os NIH introduziram um filtro automático de texto, que verificaria pelo menos 235 termos.

Seguindo as palavras

Os autores rastrearam os nomes de grupos populacionais em 37.790 financiamentos em continuação, usando arquivos públicos dos NIH, e os compararam com registros que a revisão de 2025 não tocou: quem os ensaios clínicos vinculados recrutaram, como os artigos vinculados haviam sido indexados por bibliotecários humanos, e quem os critérios de elegibilidade dos ensaios nomeavam. Eles se concentraram na categoria Pesquisa em Saúde das Minorias Raciais e Étnicas e submeteram alguns projetos a avaliadores que não conheciam sua identidade nem sua categoria.

Diagrama de como uma revisão edita o resumo do qual a contagem é extraída, e um gráfico dos resumos que perderam termos filtrados conforme o atraso.

A revisão atua sobre o resumo, a contagem é extraída do resumo; a proporção de continuações sinalizadas que perderam todos os termos filtrados cresceu com o atraso na sua emissão. — Figura 1, Xie, Zhang & Wang (2026), arXiv:2610.03443.

O que os números mostram

  • As edições foram maciças. Dos 5.461 financiamentos em continuação com um termo filtrado em 2024, 39,7% não tinham mais nenhum em 2025, contra 0,08% no ano anterior. Quanto mais tarde uma renovação era emitida, mais ela perdia — até 54,6% depois de mais de 90 dias. As edições levavam o sentido em conta: “uma minoria de células” raramente foi tocada.
  • Os nomes não eram decoração. Em novos financiamentos com ensaios que informavam o recrutamento, um título que nomeava populações negras previa uma proporção de participantes negros 60 pontos percentuais maior.
  • A contagem seguiu os nomes. Entre os projetos em continuação com a categoria de saúde das minorias, 99,4% a mantiveram quando o resumo não mudou, mas só 15,7% quando ele deixou de nomear uma população racial ou étnica — enquanto os projetos mantinham seu financiamento.
  • Os projetos perdidos cumpriam a definição. Avaliadores às cegas julgaram que 42 de 50 perdas sorteadas aleatoriamente cumpriam a definição da categoria em 2024. Comparando os resumos de antes e depois de 70 perdas, constataram que os objetivos declarados sobre a população haviam sido reescritos em 49; lidos isoladamente, 63 dos novos resumos já não cumpriam a definição. “A categoria leu corretamente o texto editado.”
  • Um buraco nos totais. O total publicado pelos NIH para a categoria caiu de US$ 2.612 milhões (2024) para US$ 1.944 milhões (2025). Na análise dos autores, os projetos em continuação que perderam o rótulo depois de perder o nome respondem por cerca de um quinto da queda líquida que eles conseguiram rastrear — uma parte invisível nos números publicados.

Palavras ou pessoas?

Para as minorias sexuais e de gênero, o padrão foi diferente. Dos financiamentos de 2024 que as nomeavam, 46,7% foram registrados como encerrados em algum momento, contra 4,8% do conjunto dos financiamentos — 37,8 pontos a mais após ajuste por vocabulário, instituto e tipo de financiamento, contra +3,2 para as populações hispânicas e +0,2 para as negras. Em março de 2026, a maioria deles constava como possivelmente restabelecida. Como as formas listadas e não listadas dos nomes foram removidas da mesma maneira, os autores interpretam isso como alvo sobre a população: a pressão estava no grupo, não nas palavras.

Um registro que não consegue dizer

Os autores chamam o principal resultado de “ciência não contabilizada”: pesquisa que o financiador ainda paga, que outros registros mostram envolver a população, mas que sua própria contagem já não registra. O problema, enfatizam, vale qualquer que seja a direção da política: quando as palavras que um financiador conta são também as palavras que ele policia, sua política volta como se fosse um fato sobre a ciência.

Os limites são declarados com franqueza: alguns testes se baseiam em números pequenos (20 projetos rigorosamente documentados), a concordância entre avaliadores às vezes foi apenas razoável, as datas e os autores das edições são desconhecidos, e a janela é curta demais para saber se a própria pesquisa mudou. Os autores declaram não ter recebido financiamento para o estudo. “Uma classificação que lê texto”, concluem, “só é tão válida quanto a governança desse texto.”

Legal notice