Modelle & Forschung

Anthropic Cyber Mission: OSS Scanner verschickt Befunde ohne menschliche Prüfung

3 Min. Lesezeit KI-generiert

Anthropic rechnet mit über 90 Prozent echten Treffern. Manche Meldung wird also falsch sein, zum Beispiel in der Einstufung des Schweregrads.

Featured image for "Anthropic Cyber Mission: OSS Scanner verschickt Befunde ohne menschliche Prüfung"

Anthropic hat am 8. Oktober die Anthropic Cyber Mission gestartet, einen langfristigen Rahmen für Verteidiger. Darin stecken zwei konkrete Programme: das Critical Infrastructure Defense Program für Betriebstechnik und OSS Scanner für Open-Source-Projekte. Zwei Tage, nachdem Project Glasswing im Cyber Verification Program aufgegangen ist.

OSS Scanner schickt, was das Modell findet

Open-Source-Projekte können sich anmelden und bekommen dann regelmäßig Scans von Anthropics stärksten Modellen, kostenlos. Jeder Bericht enthält einen Proof of Concept für den Fehler, eine Erklärung und, wenn möglich, einen Fixvorschlag.

Der entscheidende Satz steht im Kleingedruckten: Die Berichte sind modellgeneriert und gehen ohne menschliche Prüfung raus. Maintainer bekommen sie dadurch schneller, und manche werden falsch sein, etwa in der Einstufung des Schweregrads. Anthropic rechnet mit einer Trefferquote von über 90 Prozent und will sie verbessern.

Der Anlass dafür kam von den Maintainern selbst. Unter Glasswing hat Anthropic hunderte verbreitete Projekte gescannt, Menschen die Funde triagiert und dann privat gemeldet. Einige Maintainer mit genug Kapazität wollten alles sehen, auch das Ungeprüfte. Für alle anderen bleibt der Weg mit menschlich verifizierter Offenlegung bestehen.

Vorbild ist ausdrücklich Googles OSS-Fuzz. Das trifft eine offene Wunde: Google hat vor vier Tagen sein OSS-Belohnungsprogramm eingefroren, weil zu viele automatisierte Einsendungen kamen. Anthropic liefert jetzt mehr automatisierte Einsendungen, allerdings an Projekte, die darum gebeten haben.

Geld geht an die Stellen, die die Meldungen bündeln

Anthropic nennt die finanzierten Organisationen: Python Software Foundation, Alpha-Omega und OpenSSF über die Linux Foundation, Apache Software Foundation. Dazu Akrites und Gold Eagle, die Schwachstellenmeldungen aus vielen Quellen sammeln und koordinieren, damit Maintainer nicht überrannt werden. Bezahlt wird das aus dem Defender Advantage Fund, der im August gestartet ist und OSS Scanner kostenlos hält.

Maintainer können sich außerdem für Claude for Open Source bewerben, das kostenlose Claude-Max-Abos vergibt.

Kritische Infrastruktur: elf Partner, keine Betreiber

Das Critical Infrastructure Defense Program bringt Frontier-Modelle, Anthropic-Ingenieure vor Ort und eigene Bedrohungsforschung zu den Dienstleistern, auf die sich Betreiber verlassen. Gründungspartner sind Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC und Rockwell Automation.

Die Auswahl ist das Argument: Berater, die Sicherheitsprogramme betreiben, Sicherheitsfirmen, die die Netze bewachen, und Hersteller, die die Anlagen bauen und patchen. Betreiber selbst sind nicht in der Liste, sie kommen über ihre Dienstleister dazu.

Warum das nötig ist, erklärt Anthropic am Gerät: Steuerungen, Steuersoftware und Industrienetze sind für Jahrzehnte gebaut und lassen sich oft nicht abschalten, um sie zu patchen. Bekannte Lücken bleiben dann jahrelang offen. In Ausnahmefällen, schreibt Anthropic, kann ein Fix Jahrzehnte warten müssen, bis er sich sicher auf laufende Maschinen anwenden lässt.

Anthropic sagt selbst, dass Glasswing nicht gereicht hat

Der bemerkenswerteste Satz der Ankündigung ist eine Niederlage: Unter Glasswing haben die Partner viele Lücken gefunden, aber „noch keine ausreichende Senkung des Cyber-Risikos“ erreicht. Finden ist billig geworden, Verifizieren, Priorisieren und Fixen nicht. Zwischen Fund und Fix lagen oft Monate.

Daraus zieht Anthropic zwei Schlüsse, und beide sind unbequem. Erstens: Mehr Funde helfen nur dort, wo jemand sie verarbeiten kann, deshalb der Fokus auf die Bündelungsstellen und auf automatisierte Triage. Zweitens: Die eigene Prognose, dass KI in zwei Jahren die Verteidigung bevorzugt, gilt kurzfristig nicht. Genau in dieser Lücke liegt das Programm.

Quellen

AnthropicSicherheitOSS ScannerKritische InfrastrukturOpen Source