Anthropic hat erstmals eine größere Zahl aus Project Glasswing veröffentlicht: Partner des Programms fanden zwischen April und Juli 2026 mindestens 129.000 verifizierte Software-Schwachstellen. Mehr als 33.000 davon wurden bislang als kritisch oder hoch eingestuft. Anthropic selbst meldet zusätzlich 5.500 verifizierte Schwachstellen aus eigenen Open-Source-Scans zwischen April und Oktober.
Die Zahlen stammen von Anthropic und aus Befragungen eines Teils der Glasswing-Partner. Sie sind keine unabhängige Messung der Gesamtleistung von Claude. Reuters bestätigt die Veröffentlichung und die genannten Größenordnungen.
Anthropic koppelt stärkere Cyber-Fähigkeiten an drei Zugriffsstufen
Mit dem am 6. Oktober erweiterten Cyber Verification Program ordnet Anthropic den Zugriff auf seine stärksten Cyber-Fähigkeiten neu. Defense Access ist für defensive Aufgaben gedacht. Red Team Access erlaubt verifizierten Organisationen autorisierte Penetrationstests mit weniger Modellblockaden. Specialized Access ist für ausgewählte Organisationen vorgesehen, die sicherheitskritische Systeme wie Stromnetze, Flugbetriebssysteme, Telekommunikation oder Interbank-Infrastruktur testen.
Für die höchste Stufe prüft Anthropic Organisationen nach eigenen Angaben gemeinsam mit der US-Regierung. Bestehende Glasswing-Teilnehmer wechseln in diese Stufe.
Auf CyScenarioBench blockierten die Schutzsysteme bei Claude Opus 5.5 in Defense Access 46 von 50 Aufgaben. In Red Team Access wurde keine der 50 Aufgaben durch diese Schutzschicht blockiert; 34 wurden erfolgreich abgeschlossen. Anthropic schreibt, dass dies derselben Completion Rate wie bei einem Lauf ohne diese Safeguards entspricht.
Die Zugriffskontrolle wandert auf die Account-Ebene
Anthropic verwendet damit nicht dieselbe Cyber-Policy für alle Nutzer. Die erlaubte Capability hängt von verifizierter Organisation, Workspace und Zugriffsstufe ab.
Für Agentensysteme ist das ein brauchbares Sicherheitsmuster: Hochriskante Tool- und Modellrechte lassen sich an Identität und extern erzwungene Policies binden, statt die Entscheidung allein dem Modell zu überlassen.
Die 129.000 Schwachstellen zeigen zugleich, warum die Zugriffspolitik relevant wird. Frontier-Modelle werden inzwischen in großem Umfang für reale Vulnerability Research eingesetzt.
Quellen: Anthropic, „Expanding the Cyber Verification Program“, 6. Oktober 2026; Reuters, 6. Oktober 2026.