Wenn KI Schwachstellen besser findet als Menschen (die Wende von 2026)2026 wurde eine Schwelle überschritten: Die besten Frontier-Modelle sind inzwischen in der Lage, Software-Schwachstellen zu entdecken und auszunutzen, und zwar auf dem Niveau der allerbesten menschlichen Experten und in nie dagewesenem Umfang. So hat das Modell Mythos von Anthropic Tausende unbekannter Sicherheitslücken („Zero-Days“) in allen großen Betriebssystemen und Browsern aufgedeckt, von denen einige jahrzehntelang unbemerkt geblieben waren (eine 27 Jahre alte Lücke in OpenBSD, eine weitere, 16 Jahre alte in der Videokomponente FFmpeg, die kein automatisierter Test gefunden hatte). Das ist ein typisches zweischneidiges Schwert: Dieselbe Fähigkeit, die ein Modell in den falschen Händen gefährlich macht, macht es wertvoll, um Lücken zu schließen, bevor sie ausgenutzt werden. Daraus entstand im April 2026 das Projekt Glasswing, eine defensive Koalition aus Anthropic und großen Akteuren der Tech- und Finanzbranche (Amazon, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, die Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks ...), die diese Fähigkeiten in den Dienst der Sicherheit stellen soll, auch zugunsten der Maintainer von Open-Source-Software; andere Labore entwickeln parallel eigene Werkzeuge (etwa Big Sleep und CodeMender bei Google). Die Kehrseite zeigte sich im Juni 2026: Unter Berufung auf Exportkontrollen und die nationale Sicherheit setzte die US-Regierung von einem Tag auf den anderen den Zugang zu den Modellen Fable und Mythos für alle ausländischen Staatsangehörigen aus, weil sie einen Missbrauch ihrer Cyberfähigkeiten befürchtete. Der Vorgang löste eine heftige Kontroverse aus: Für die Regierung ging es um die nationale Sicherheit; für Anthropic war die Maßnahme unverhältnismäßig und stützte sich auf eine geringfügige Umgehung, die auch andere öffentlich verfügbare Modelle aufwiesen; für manche Beobachter wird ein Produkt, das als eine Art „Waffe“ präsentiert wird, vom Staat am Ende auch als solche behandelt. Es ist einer der ersten Fälle, in denen eine Exportkontrolle ein KI-Modell trifft und nicht mehr nur Chips (Kapitel 22 und 25). Die Beschränkung währte nur kurz: Das US-Handelsministerium hob diese Kontrollen am 30. Juni 2026 auf, und Anthropic stellte Fable 5 bereits am 1. Juli wieder weltweit bereit, mit einem verstärkten Sicherheitsklassifikator, der die gemeldete Umgehungstechnik nun in mehr als 99 Prozent der Fälle blockiert (Mythos 5 wurde seinerseits für eine Reihe US-amerikanischer Organisationen wiederhergestellt). Bemerkenswert ist, dass die während der Krise durchgeführten Tests die Position von Anthropic bestätigten: Weniger leistungsfähige Modelle (darunter Opus 4.8, GPT-5.5 oder Kimi K2.7) fanden dieselben Schwachstellen, sodass die Umgehung keine Cyberfähigkeit offenlegte, die allein Mythos eigen wäre. Dennoch veranlasste der Vorgang Anthropic und seine Partner (Amazon, Microsoft, Google), einen gemeinsamen Rahmen zur Messung der Schwere von Jailbreaks auf den Weg zu bringen und die Zusammenarbeit mit dem Staat bei Tests vor der Bereitstellung zu vertiefen. Dieser Rahmen hat inzwischen einen Namen und einen Status: Die Skala „Cyber Jailbreak Severity“ (von CJS-0 bis CJS-4), die der Logik des CVSS-Scores nachempfunden ist, wurde von Anthropic am 2. Juli 2026 als vorläufige Fassung veröffentlicht; ein von der Branche angenommener Standard ist sie noch nicht. Anschließend wurde die Modellreihe erneuert: Am 1. September 2026 veröffentlichte Anthropic Claude Fable 5.1 (allgemein verfügbar, 10 US-Dollar pro Million Eingabe-Token und 50 pro Million Ausgabe-Token) und Claude Mythos 5.1 (eingeschränkter Zugang), die als ein und dasselbe Modell mit unterschiedlichen Schutzvorkehrungen vorgestellt wurden. Fable 5.1 kann nun Schwachstellen in Quellcode identifizieren, verweist aber bei Penetrationstests, der Erzeugung von Exploits und der Analyse von Binärdateien weiterhin auf andere Modelle. Mythos 5.1 ist verifizierten Fachleuten vorbehalten, über zwei Programme (Cyber Verification Program und Life Sciences Verification Program), und steht vorerst nur US-amerikanischen Organisationen offen; Anthropic stimmt sich nach eigenen Angaben mit der US-Regierung ab, um diesen Zugang auszuweiten. Auf europäischer Seite bestätigte die Kommission am 10. September 2026, dass die Cybersicherheitsagentur ENISA nach dreimonatigen, Ende Mai aufgenommenen Verhandlungen Zugang zu Mythos 5 (und nicht zur Version 5.1) für defensive Zwecke erhalten hat.