Informatik & KIPreprintDatenanalyse4 Min. Lesezeit

WEITER FINANZIERT, NICHT MEHR GEZÄHLT

Forschungsförderer erfahren zunehmend, was sie fördern, indem sie Software den Text ihrer Förderungen klassifizieren lassen. Die US-amerikanischen National Institutes of Health (NIH) tun das seit 2008. Ihr System RCDC wertet Titel, Abstract, Erklärung zur Relevanz für die öffentliche Gesundheit und spezifische Ziele jeder Förderung aus, und jedes Jahr berichtet die Behörde dem Kongress und der Öffentlichkeit, wie viel sie in mehr als 300 Kategorien ausgegeben hat, von Krebs bis zur Gesundheit von Minderheiten. Forschende, Interessenvertreter und NIH-Mitarbeitende nutzen diese Summen als Nachweis darüber, welche Wissenschaft die Öffentlichkeit bezahlt.

Studien zu solchen Klassifikationen gehen davon aus, dass der Antragsteller den Text schreibt. Fangfang Xie (Universität Nanjing), Jingwen Zhang (Universität Hubei) und Haining Wang (Indiana University School of Medicine) fragten, was passiert, wenn der Förderer selbst den Text bearbeitet, den seine Software zählt.

Was sich 2025 änderte

Laut den in der Arbeit zitierten Dokumenten richteten sich Präsidialerlasse vom 20. und 21. Januar 2025 gegen Programme für Diversität, Gleichberechtigung und Inklusion (DEI) und gegen „Gender-Ideologie“. Am 4. März 2025 wies eine NIH-Richtlinie die Programmverantwortlichen an, Förderungen, die „keine DEI-Aktivitäten unterstützen, aber Sprache mit DEI-Bezug enthalten können“, vor der Freigabe der Mittel „mit entfernter DEI-Sprache“ zu aktualisieren. Ein Bundesgericht hob diese Anweisungen am 16. Juni 2025 auf; am 21. August ließ der Oberste Gerichtshof diese Entscheidung bestehen, setzte aber den Teil aus, der Förderkündigungen aufhob. Im Dezember 2025 führten die NIH einen automatischen Textfilter ein, der Berichten zufolge mindestens 235 Begriffe prüft.

Den Wörtern folgen

Die Autoren verfolgten die Namen von Bevölkerungsgruppen durch 37.790 fortlaufende Förderungen anhand öffentlicher NIH-Dateien und verglichen sie mit Aufzeichnungen, die die Überprüfung von 2025 nicht berührte: wen verknüpfte klinische Studien einschlossen, wie verknüpfte Artikel von menschlichen Bibliothekaren verschlagwortet worden waren und wen die Einschlusskriterien der Studien nannten. Sie konzentrierten sich auf die Kategorie Forschung zur Gesundheit rassischer und ethnischer Minderheiten und ließen einige Projekte von Gutachtern beurteilen, die weder deren Identität noch deren Kategorie kannten.

Schema, wie eine Überprüfung die Zusammenfassung bearbeitet, aus der die Zählung gewonnen wird, und ein Diagramm der Zusammenfassungen, die je nach Verzögerung gefilterte Begriffe verloren.

Die Überprüfung wirkt auf die Zusammenfassung, die Zählung wird aus der Zusammenfassung gewonnen; der Anteil markierter Fortsetzungen, die jeden gefilterten Begriff verloren, stieg mit der Verzögerung ihrer Bewilligung. — Abbildung 1, Xie, Zhang & Wang (2026), arXiv:2610.03443.

Was die Zahlen zeigen

  • Die Änderungen waren massiv. Von 5.461 fortlaufenden Förderungen mit einem gefilterten Begriff im Jahr 2024 enthielten 39,7 % im Jahr 2025 keinen mehr, gegenüber 0,08 % im Vorjahr. Je später eine Verlängerung bewilligt wurde, desto mehr verlor sie – bis zu 54,6 % nach mehr als 90 Tagen. Die Änderungen achteten auf die Bedeutung: „eine Minderheit von Zellen“ wurde selten angetastet.
  • Die Namen waren keine Dekoration. Bei neuen Förderungen mit Studien, die ihre Teilnehmenden meldeten, sagte ein Titel, der schwarze Bevölkerungsgruppen nannte, einen um 60 Prozentpunkte höheren Anteil schwarzer Teilnehmender voraus.
  • Die Zählung folgte den Namen. Unter den fortlaufenden Projekten mit der Kategorie Minderheitengesundheit behielten 99,4 % sie, wenn die Zusammenfassung unverändert blieb, aber nur 15,7 %, wenn sie keine rassische oder ethnische Bevölkerungsgruppe mehr nannte – während die Projekte ihre Finanzierung behielten.
  • Die verlorenen Projekte erfüllten die Definition. Verblindete Gutachter urteilten, dass 42 von 50 zufällig gezogenen Verlusten 2024 die Definition der Kategorie erfüllt hatten. Beim Vergleich der Zusammenfassungen vor und nach der Änderung bei 70 Verlusten stellten sie fest, dass die erklärten Ziele zur Bevölkerungsgruppe in 49 Fällen umgeschrieben worden waren; für sich gelesen erfüllten 63 der neuen Zusammenfassungen die Definition nicht mehr. „Die Kategorie hat den bearbeiteten Text korrekt gelesen.“
  • Ein Loch in den Summen. Die von den NIH veröffentlichte Summe für die Kategorie fiel von 2.612 Millionen Dollar (2024) auf 1.944 Millionen Dollar (2025). Nach der Analyse der Autoren machen fortlaufende Projekte, die das Etikett verloren, nachdem sie den Namen verloren hatten, etwa ein Fünftel des Nettorückgangs aus, den sie nachverfolgen konnten – ein Teil, der in den veröffentlichten Zahlen unsichtbar ist.

Wörter oder Menschen?

Bei sexuellen und geschlechtlichen Minderheiten war das Muster anders. Von den Förderungen aus dem Jahr 2024, die sie nannten, wurden 46,7 % irgendwann als beendet verbucht, gegenüber 4,8 % aller Förderungen – 37,8 Punkte mehr nach Bereinigung um Vokabular, Institut und Förderart, verglichen mit +3,2 für hispanische und +0,2 für schwarze Bevölkerungsgruppen. Bis März 2026 waren die meisten davon als möglicherweise wieder aufgenommen gelistet. Da gelistete und nicht gelistete Formen der Namen gleichermaßen entfernt wurden, deuten die Autoren dies als gezieltes Vorgehen gegen eine Bevölkerungsgruppe: Der Druck richtete sich auf die Gruppe, nicht auf die Wörter.

Ein Register, das es nicht erkennen kann

Die Autoren nennen das Hauptergebnis „ungezählte Wissenschaft“: Forschung, die der Förderer weiter bezahlt und die laut anderen Aufzeichnungen die Bevölkerungsgruppe betrifft, die seine eigene Zählung aber nicht mehr erfasst. Das Problem, betonen sie, besteht unabhängig von der Richtung der Politik: Wenn die Wörter, die ein Förderer zählt, zugleich die Wörter sind, die er überwacht, erscheint seine Politik im Ergebnis als Tatsache über die Wissenschaft.

Die Grenzen werden offen genannt: Manche Tests beruhen auf kleinen Zahlen (20 streng dokumentierte Projekte), die Übereinstimmung der Gutachter war teils nur mäßig, Datum und Urheber der Änderungen sind unbekannt, und das Zeitfenster ist zu kurz, um zu wissen, ob sich die Forschung selbst verändert hat. Die Autoren geben an, keine Finanzierung für die Studie erhalten zu haben. „Eine Klassifikation, die Text liest“, schließen sie, „ist nur so valide wie die Steuerung dieses Textes.“

Legal notice