Das Unternehmen veröffentlichte Details zu Versuchen, darunter einen Antrag zur Genveränderung des Chikungunya-Virus, während Sicherheitsbedenken innerhalb der KI-Branche wachsen.
Wie das Unternehmen in seinem dritten Bericht seit März 2025 mitteilte, ermöglichen immer leistungsfähigere Sprachmodelle auch unerfahrenen Anwendern den Zugriff auf komplexe Bedrohungsszenarien, die noch vor einem Jahr nicht realisierbar gewesen wären.
Blockierter Antrag zur Erforschung des Chikungunya-Virus
Zwischen Dezember 2025 und August 2026 registrierten die Forscher von Anthropic verschiedene Missbrauchsversuche, die von Spionagesoftware-Anbietern über staatlich unterstützte Propagandagruppen bis hin zu politisch motivierten Einzelpersonen reichten. In einem konkreten Fall blockierten die Systeme eine Anfrage an den KI-Assistenten Claude zur Unterstützung bei einem wissenschaftlichen Förderantrag.
Der Antrag betraf sogenannte Gain-of-Function-Forschung am Chikungunya-Virus, einem durch Mücken übertragenen Erreger, der schweres Fieber und Schmerzen auslöst. Die untersuchten genetischen Veränderungen zielten darauf ab, die Übertragbarkeit und die Mechanismen zur Umgehung des Immunsystems des Erregers gezielt zu verstärken. Laut dem Bericht von Anthropic können solche Untersuchungen zwar zur Entwicklung besserer Behandlungen beitragen, bergen jedoch gleichzeitig das Risiko, gefährlichere Pathogene zu erzeugen.
Verschärfte Schutzvorkehrungen bei den neuesten KI-Modellen
Anthropic erklärte, dass ältere Modelle wie Claude Opus 4 und Claude Sonnet 4.5 aus dem Jahr 2025 weit unterhalb der Schwelle lagen, bei der sie komplexe biowissenschaftliche Forschung sinnvoll hätten unterstützen können. Die damaligen Schutzmaßnahmen konzentrierten sich demnach vor allem darauf, Novizen vom Nachbau bekannter Biowaffen abzuhalten.
Bei den neueren Systemen, darunter Claude Fable 5, verhält sich die Situation laut dem Unternehmen grundlegend anders. Angesichts der erweiterten Fähigkeiten bei komplexen wissenschaftlichen Aufgaben hat Anthropic nach eigenen Angaben strengere Sicherheitsfilter implementiert, die den Zugriff auf eine breite Palette von Fragen zur Dual-Use-Bioforschung einschränken.
Die Fälle, die wir hier teilen, sind kein typischer Missbrauch, sondern eher Beispiele für die bemerkenswertesten und neuartigsten Bedrohungsaktivitäten, die wir bisher identifiziert haben. Anthropic, aus dem Bericht über KI-Missbrauch
Einflussoperationen und interne Debatten über Sicherheitsrisiken
Neben biologischen Risiken dokumentierte der Bericht auch verdeckte Einflusskampagnen. So stieß das Unternehmen auf Gruppen, die hunderte gefälschte Social-Media-Konten einsetzten, um politische Inhalte zu verbreiten. Anthropic identifizierte neun solcher Fälle, deren Ursprünge in Russland, im Iran, in der Türkei, in Ländern der Golfregion, Südasien, Afrika und Europa lagen.
Die Veröffentlichung des Berichts folgt auf den Rücktritt des Anthropic-Forschers Jacob Coxon, der Bedenken geäußert hatte, dass Anthropic und sein Konkurrent OpenAI zu schnell auf selbstreferenzielle Superintelligenz hinarbeiten und damit ein hohes Risiko für die Menschheit eingehen.
Weiterlesen