Quavon Development
Model Security2 Min. Lesezeit

Anthropic meldet 129.000 verifizierte Schwachstellen aus Project Glasswing

Anthropic nennt erstmals größere Glasswing-Zahlen: Partner fanden mindestens 129.000 verifizierte Schwachstellen. Gleichzeitig führt das Unternehmen drei abgestufte Zugriffsebenen für stärkere Cyber-Fähigkeiten ein.

Redaktion von Quavon DevelopmentVeröffentlicht
Die kurze Antwort

Anthropic zufolge fanden Project-Glasswing-Partner zwischen April und Juli 2026 mindestens 129.000 verifizierte Software-Schwachstellen, davon bislang mehr als 33.000 mit hoher oder kritischer Einstufung. Das neue Cyber Verification Program koppelt reduzierte Cyber-Blockaden an drei verifizierte Zugriffsstufen.

Anthropic hat erstmals eine größere Zahl aus Project Glasswing veröffentlicht: Partner des Programms fanden zwischen April und Juli 2026 mindestens 129.000 verifizierte Software-Schwachstellen. Mehr als 33.000 davon wurden bislang als kritisch oder hoch eingestuft. Anthropic selbst meldet zusätzlich 5.500 verifizierte Schwachstellen aus eigenen Open-Source-Scans zwischen April und Oktober.

Die Zahlen stammen von Anthropic und aus Befragungen eines Teils der Glasswing-Partner. Sie sind keine unabhängige Messung der Gesamtleistung von Claude. Reuters bestätigt die Veröffentlichung und die genannten Größenordnungen.

Anthropic koppelt stärkere Cyber-Fähigkeiten an drei Zugriffsstufen

Mit dem am 6. Oktober erweiterten Cyber Verification Program ordnet Anthropic den Zugriff auf seine stärksten Cyber-Fähigkeiten neu. Defense Access ist für defensive Aufgaben gedacht. Red Team Access erlaubt verifizierten Organisationen autorisierte Penetrationstests mit weniger Modellblockaden. Specialized Access ist für ausgewählte Organisationen vorgesehen, die sicherheitskritische Systeme wie Stromnetze, Flugbetriebssysteme, Telekommunikation oder Interbank-Infrastruktur testen.

Für die höchste Stufe prüft Anthropic Organisationen nach eigenen Angaben gemeinsam mit der US-Regierung. Bestehende Glasswing-Teilnehmer wechseln in diese Stufe.

Auf CyScenarioBench blockierten die Schutzsysteme bei Claude Opus 5.5 in Defense Access 46 von 50 Aufgaben. In Red Team Access wurde keine der 50 Aufgaben durch diese Schutzschicht blockiert; 34 wurden erfolgreich abgeschlossen. Anthropic schreibt, dass dies derselben Completion Rate wie bei einem Lauf ohne diese Safeguards entspricht.

Die Zugriffskontrolle wandert auf die Account-Ebene

Anthropic verwendet damit nicht dieselbe Cyber-Policy für alle Nutzer. Die erlaubte Capability hängt von verifizierter Organisation, Workspace und Zugriffsstufe ab.

Für Agentensysteme ist das ein brauchbares Sicherheitsmuster: Hochriskante Tool- und Modellrechte lassen sich an Identität und extern erzwungene Policies binden, statt die Entscheidung allein dem Modell zu überlassen.

Die 129.000 Schwachstellen zeigen zugleich, warum die Zugriffspolitik relevant wird. Frontier-Modelle werden inzwischen in großem Umfang für reale Vulnerability Research eingesetzt.

Quellen: Anthropic, „Expanding the Cyber Verification Program“, 6. Oktober 2026; Reuters, 6. Oktober 2026.

Starten wir durch

Sollen wir uns das ansehen?

Erzählen Sie uns, was entstehen soll. Sie bekommen eine ehrliche Einschätzung zu Umfang, Zeitrahmen und Risiken — und eine klare Antwort, ob wir das richtige Team dafür sind.

Kostenloses Erstgespräch
Oder E-Mail senden

Antwort in der Regel innerhalb von 24 Stunden