Über das Cyber Verification Program erhalten geprüfte Teams Modelle mit weniger Schutzmechanismen. Glasswing fand laut Anthropic 129.000 Schwachstellen.
Anthropic erweitert Cyber-Zugang für Sicherheitsteams

Das KI-Unternehmen Anthropic hat am 6. Oktober sein Cyber Verification Program (CVP) ausgeweitet. Darüber können geprüfte Sicherheitsfachleute die KI-Modelle des Unternehmens mit reduzierten Schutzmechanismen und weniger blockierenden Klassifikatoren für Sicherheitsarbeit nutzen. Zugänglich sind unter anderem Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1 sowie künftige Modelle.
Drei Zugangsstufen
Das Programm umfasst drei Stufen, für die sich Organisationen bewerben können. Defense Access ist für defensive Aufgaben wie Incident Response, Reverse Engineering von Schadsoftware sowie Analyse und Prüfung von Schwachstellen gedacht. Red Team Access erlaubt zusätzlich autorisierte Penetrationstests und Red Teaming. Specialized Access hat die wenigsten Schutzmechanismen und ist einem kleinen Kreis geprüfter Organisationen vorbehalten, die Sicherheitssysteme testen dürfen.
In einer Bewertung mit dem Benchmark CyScenarioBench blockierten die Schutzmechanismen von Claude Opus 5.5 auf der Stufe Defense Access nach Angaben von Anthropic 46 von 50 Aufgaben. Auf der Stufe Red Team Access wurde keine Aufgabe blockiert, das Modell erledigte 34 von 50, genauso viele wie ganz ohne Schutzmechanismen. Ohne CVP-Zugang wurde jede Aufgabe bereits bei der ersten Anfrage blockiert.
129.000 Schwachstellen über Glasswing
Anthropic gibt an, dass über Project Glasswing zwischen April und Juli 2026 mindestens 129.000 Schwachstellen in Software gefunden und bestätigt wurden. Über das Scannen von Open-Source-Software kamen zwischen April und Oktober weitere 5.500 hinzu. Mehr als 33.000 der bestätigten Schwachstellen wurden als kritisch oder hoch eingestuft.
„Dies ist wahrscheinlich eine Untererfassung, da es auf Umfragedaten nur eines Teils der Glasswing-Partner beruht.“
Anthropic
Das Unternehmen erwartet eine mindestens fünfmal so große tatsächliche Wirkung. Unabhängig überprüfen lassen sich diese Zahlen nicht.
Wenige Lücken aktiv ausgenutzt
Patrick Garrity vom Sicherheitsunternehmen VulnCheck hat 300 Schwachstellen mit CVE-Kennung ausgewertet, die Anthropic oder Project Glasswing entdeckt haben. Davon wurden zwei, also 0,67 Prozent, nachweislich in freier Wildbahn ausgenutzt: eine SQL-Injection in Ghost CMS (CVE-2026-26980) und eine Lücke zur Fälschung von Sitzungen im Rejetto HTTP File Server (CVE-2026-61500). 39 der 300 Schwachstellen stufte Garrity als kritisch ein, 141 als hoch.
Laut einem Bericht von Veracode bergen auch von KI erzeugte Korrekturen Risiken. In Tests führten demnach rund 44 Prozent der Aufgaben zur Codeerzeugung durch KI eine sicherheitsrelevante Schwachstelle ein. Die durchschnittliche Erfolgsquote bei Sicherheitsprüfungen lag über alle Modelle hinweg bei 56 Prozent und damit kaum höher als im ersten Bericht mit 55 Prozent.
(red)




