Project Glasswing

Anthropic erweitert Cyber-Zugang für Sicherheitsteams

Über das Cyber Verification Program erhalten geprüfte Teams Modelle mit weniger Schutzmechanismen. Glasswing fand laut Anthropic 129.000 Schwachstellen.

Anthropic erweitert Cyber-Zugang für Sicherheitsteams
Bildquelle: Casimiro PT/Shutterstock.com

Das KI-Unternehmen Anthropic hat am 6. Oktober sein Cyber Verification Program (CVP) ausgeweitet. Darüber können geprüfte Sicherheitsfachleute die KI-Modelle des Unternehmens mit reduzierten Schutzmechanismen und weniger blockierenden Klassifikatoren für Sicherheitsarbeit nutzen. Zugänglich sind unter anderem Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1 sowie künftige Modelle.

Drei Zugangsstufen

Das Programm umfasst drei Stufen, für die sich Organisationen bewerben können. Defense Access ist für defensive Aufgaben wie Incident Response, Reverse Engineering von Schadsoftware sowie Analyse und Prüfung von Schwachstellen gedacht. Red Team Access erlaubt zusätzlich autorisierte Penetrationstests und Red Teaming. Specialized Access hat die wenigsten Schutzmechanismen und ist einem kleinen Kreis geprüfter Organisationen vorbehalten, die Sicherheitssysteme testen dürfen.

In einer Bewertung mit dem Benchmark CyScenarioBench blockierten die Schutzmechanismen von Claude Opus 5.5 auf der Stufe Defense Access nach Angaben von Anthropic 46 von 50 Aufgaben. Auf der Stufe Red Team Access wurde keine Aufgabe blockiert, das Modell erledigte 34 von 50, genauso viele wie ganz ohne Schutzmechanismen. Ohne CVP-Zugang wurde jede Aufgabe bereits bei der ersten Anfrage blockiert.

Anzeige

129.000 Schwachstellen über Glasswing

Anthropic gibt an, dass über Project Glasswing zwischen April und Juli 2026 mindestens 129.000 Schwachstellen in Software gefunden und bestätigt wurden. Über das Scannen von Open-Source-Software kamen zwischen April und Oktober weitere 5.500 hinzu. Mehr als 33.000 der bestätigten Schwachstellen wurden als kritisch oder hoch eingestuft.

„Dies ist wahrscheinlich eine Untererfassung, da es auf Umfragedaten nur eines Teils der Glasswing-Partner beruht.“

Anthropic

Das Unternehmen erwartet eine mindestens fünfmal so große tatsächliche Wirkung. Unabhängig überprüfen lassen sich diese Zahlen nicht.

Wenige Lücken aktiv ausgenutzt

Patrick Garrity vom Sicherheitsunternehmen VulnCheck hat 300 Schwachstellen mit CVE-Kennung ausgewertet, die Anthropic oder Project Glasswing entdeckt haben. Davon wurden zwei, also 0,67 Prozent, nachweislich in freier Wildbahn ausgenutzt: eine SQL-Injection in Ghost CMS (CVE-2026-26980) und eine Lücke zur Fälschung von Sitzungen im Rejetto HTTP File Server (CVE-2026-61500). 39 der 300 Schwachstellen stufte Garrity als kritisch ein, 141 als hoch.

Laut einem Bericht von Veracode bergen auch von KI erzeugte Korrekturen Risiken. In Tests führten demnach rund 44 Prozent der Aufgaben zur Codeerzeugung durch KI eine sicherheitsrelevante Schwachstelle ein. Die durchschnittliche Erfolgsquote bei Sicherheitsprüfungen lag über alle Modelle hinweg bei 56 Prozent und damit kaum höher als im ersten Bericht mit 55 Prozent.

(red)

Anzeige
Anzeige