Ein von Google entwickeltes KI-Modell hat in der jüngsten Bewertung des US-amerikanischen Centers for Disease Control and Prevention den ersten Platz bei der Vorhersage von Grippe-Krankenhausaufnahmen belegt. Das am 30. September 2026 veröffentlichte End-of-Season-Rating der FluSight-Initiative sah das Modell von Google bei der Prognose der Saisondaten ganz vorn.
Die Centers for Disease Control and Prevention haben ihre umfassende Auswertung der FluSight-Vorhersagesaison für den Zeitraum 2025 bis 2026 vorgelegt. Dabei ging das Modell Google_SAI-FluEns als der Spitzenreiter unter insgesamt 39 zugelassenen und gewerteten Modellen hervor. Wie das CDC berichtete, holte die Behörde für diese Aufgabe wöchentliche Prognosen von akademischen, industriellen sowie staatlichen Teams ein, die von November 19, 2025, through May 20, 2026 (laut blog.google: From October through May) eingereicht wurden.
Bewertung der Grippewelle 2025 bis 2026 durch die Behörden
Die Melderunde lief vom 19. November 2025 bis zum 20. Mai 2026 (laut blog.google begannen die wöchentlichen Einsendungen bereits im Oktober). Das Hauptziel der Vorhersagen bestand darin, die wöchentlichen Influenza-Krankenhausaufnahmen für die jeweils laufende Woche sowie für bis zu drei Wochen im Voraus für die Vereinigten Staaten, jeden einzelnen Bundesstaat, Puerto Rico und Washington, D.C. zu berechnen. Als Datengrundlage dienten die wöchentlichen Kennzahlen zu respiratorischen Krankenhausdaten (Weekly Hospital Respiratory Data Metrics by Jurisdiction) aus dem National Healthcare and Safety Network (NHSN) und data.cdc.gov4. Die endgültigen Zieldaten für die Auswertung wurden am 1. Juli 2026 veröffentlicht.

In der vorläufigen Schweregradbewertung stufte das CDC die Saison als moderat ein. Die höchsten wöchentlichen Einweisungen überstiegen die Marke von 40.000. Die Aufnahmen begannen Mitte November 2025 zu steigen und erreichten landesweit in der Woche zum 27. Dezember 2025 ihren Scheitelpunkt.
Methodik und Kriterien der FluSight-Auswertung
Insgesamt trugen 34 Teams im Laufe der Saison Grippehospitalisierungswahrscheinlichkeiten aus 53 eigenständigen Modellen bei. Für die offizielle Auswertung qualifizierten sich schließlich 39 Modelle, da sie mindestens 75 Prozent der geforderten Vorhersageziele (oder bezogen auf cdc.gov: Models that submitted less than 75% of the total forecasts from all remaining weeks and jurisdictions were excluded) einreichten. Nationale Prognosen wurden wegen unterschiedlicher Skalierungen vom Scoring ausgeschlossen, während Daten zu Puerto Rico aufgrund fehlender Informationen unberücksichtigt blieben.
Die Bewertung erfolgte primär über den relativen gewichteten Intervallscore. Dieser misst, wie exakt die Vorhersageintervalle mit den letztlich beobachteten Werten übereinstimmen. Ein Wert unter 1 bedeutet dabei eine bessere Leistung als das behördliche Referenzmodell. Das CDC schuf jede Woche eine solche Baseline (FluSight baseline, die einen Median vorhersagte, der dem der letzten Woche entsprach) sowie ein kombiniertes Ensemble (FluSight ensemble, das den Median aus Modellen bildete, die sich für die Ensemble-Inklusion qualifiziert hatten und mit dem Paket hubEnsembles R erzeugt wurde), das als offizielle Grundlage für die behördliche Risikokommunikation diente.
Hintergrund zu Googles wissenschaftlichem KI-Werkzeug
Die nun ausgezeichneten Vorhersagen entstanden unter Einsatz von Empirical Research Assistance
(ERA), einem KI-System, das von Google als Generator von Optimierungsalgorithmen für verschiedene wissenschaftliche Disziplinen beschrieben wird. Die zugrundeliegende Forschung zu ERA wurde in der Fachzeitschrift Nature veröffentlicht, und die Technologie steht vertrauenswürdigen Testern (trusted testers) über experimentelle Wissenschaftswerkzeuge (experimental science tools) des Unternehmens zur Verfügung.
This performance validates our confidence that AI combined with human ingenuity will improve our ability to forecast diseases worldwide.
Zahra Shamsi, Google Research
Von den 39 untersuchten Einreichungen schnitten 33 besser ab als die Baseline der Behörde. Das offizielle FluSight-Ensemble belegte den siebten Platz im Gesamtranking und zählte zu den zwölf Modellen, die in allen Regionen durchgehend bessere Ergebnisse als das Referenzmodell lieferten. Gleichzeitig deckte der Bericht auch Grenzen auf: So antizipierten die Intervalle des Ensembles den sprunghaften Anstieg im späten Dezember 2025 sowie den darauffolgenden Rückgang im Januar 2026 nicht vollständig. Das CDC veranstaltet solche Grippeprognose-Wettbewerbe bereits seit der Saison 2013 bis 2014, unterbrochen lediglich im Zeitraum 2020 bis 2021, als die geringe Grippeaktivität keine stabilen Vorhersagen zuließ.
Weiterlesen