IT之家 Meldung vom 7. Oktober: Nach Angaben von Reuters baut Anthropic ein Programm aus, das geprüften Cybersicherheitsexperten erlaubt, seine stärksten KI-Modelle mit weniger Sicherheitsvorkehrungen zu testen, nachdem das „Project Glasswing“ des Unternehmens in diesem Jahr bereits geholfen hat, über 100.000 Softwareschwachstellen zu entdecken.

Wie IT之家 erfuhr, zielt das Projekt Glasswing darauf ab, die Sicherheit globaler kritischer Software zu gewährleisten. Die Kooperationspartner des Programms fanden im Zeitraum von Monat 4 bis Monat 7 mindestens 129000 bereits verifizierte Schwachstellen. Die von Anthropic selbst durchgeführten Open-Source-Scanarbeiten deckten zwischen Monat 4 und Monat 10 zusätzlich 5500 Schwachstellen auf.
Bislang wurden mehr als 33000 Schwachstellen als kritisch oder hochgefährlich eingestuft.
Anthropic erklärte, diese Zahlen dürften statistische Lücken enthalten und die tatsächliche Wirkung sei mindestens fünfmal so hoch wie die jetzigen Daten, da diese aus einer Umfrage unter einer begrenzten Zahl von Partnern stammen.
Das neue Cyber Verification Program (abgekürzt CVP) wurde am Dienstag Ortszeit offiziell vorgestellt und vereint die zwei Programme, die Anthropic in den vergangenen sechs Monaten betrieben hat.
Das erste ist das Glasswing-Programm, das Institutionen, die für die Absicherung kritischer Software zuständig sind, Zugang zu Claude Mythos gewährt, der Modellreihe von Anthropic mit den stärksten Cybersicherheitsfähigkeiten. Das zweite ist das frühere Cyber Verification Program, das geprüften Sicherheitsteams die Modelle Claude Opus und Claude Sonnet mit reduzierten Schutzbeschränkungen zugänglich machte.
Mit der Veröffentlichung von Claude Mythos Preview im April hatte das Unternehmen Bedenken ausgelöst: KI könnte Software angreifen, bevor diese sicher gehärtet wurde.
Das neu eingerichtete Programm ist in drei Stufen unterteilt, von denen jede entsprechende Qualifizierungsanforderungen und Sicherheitskontrollen vorsieht. Alle drei Stufen erhalten Zugang zu Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 sowie zu künftig erscheinenden neuen Modellen.
Die Defensive-Stufe ist für Aufgaben wie die Reaktion auf Zwischenfälle und die Analyse von Schadsoftware geeignet. Sicherheitsteams, Betreiber kritischer Infrastruktur, Maintainer von Open-Source-Projekten sowie Forscher mit nachweislicher Historie bei der Meldung von Schwachstellen können einen Antrag stellen.
Die Red-Team-Stufe erweitert dies um Berechtigungen für autorisierte Penetrationstests und Red-Team-Übungen, akzeptiert jedoch nur Anträge von Institutionen.
Die Spezial-Stufe unterliegt den geringsten Beschränkungen und steht nur einer kleinen Gruppe von Institutionen offen; diesen Institutionen wird gestattet, sicherheitskritische Systeme wie Stromnetze, Flugsysteme der Luftfahrt oder die Bankenüberweisungs-Infrastruktur zu testen.
Anthropic wird die Qualifikation jedes Teilnehmers gemeinsam mit der US-Regierung überprüfen; die bestehenden Mitglieder des ursprünglichen Glasswing-Programms werden dieser Spezial-Stufe zugeordnet.
