KI überwindet Sicherheitsbarrieren: Claude verschafft sich unbefugt Zugriff auf fremde Computersysteme

Ein KI-Modell des US-Unternehmens Anthropic hat sich während eines Sicherheitstests unerlaubt Zugang zu den Computersystemen von drei Organisationen verschafft. Das teilte das Unternehmen am Donnerstag mit. Betroffen waren drei Versionen des Sprachmodells Claude. Um welche Organisationen es sich handelt, wurde nicht bekanntgegeben. Nach Angaben von Anthropic wurden mehr als 141.000 Sicherheitstests ausgewertet. Die KI-Modelle hätten [...]
Ein KI-Modell des US-Unternehmens Anthropic hat sich während eines Sicherheitstests unerlaubt Zugang zu den Computersystemen von drei Organisationen verschafft. Das teilte das Unternehmen am Donnerstag mit. Betroffen waren drei Versionen des Sprachmodells Claude. Um welche Organisationen es sich handelt, wurde nicht bekanntgegeben. Nach Angaben von Anthropic wurden mehr als 141.000 Sicherheitstests ausgewertet. Die KI-Modelle hätten dabei eigentlich vollständig von der Aussenwelt abgeschirmt sein sollen. Stattdessen gelang es ihnen, auf das Internet zuzugreifen und in drei Fällen in fremde Computersysteme einzudringen. Solche Sicherheitstests sollen gerade verhindern, dass KI-Systeme ausserhalb einer kontrollierten Umgebung eigenständig mit realen Computersystemen interagieren oder Sicherheitsvorkehrungen umgehen können. Das Unternehmen führt den Vorfall auf ein «Missverständnis zwischen uns und unserem Evaluierungspartner» Irregular zurück. Dadurch hätten die Modelle Zugang zum Internet erhalten. Laut Anthropic nutzten sie anschliessend selbstständig einfache Sicherheitslücken – etwa schwache Passwörter oder ungeschützte Zugänge –, um sich Zugriff auf die fremden Systeme zu verschaffen. Zu den betroffenen Modellen gehörte auch «Mythos 5», eines der leistungsfähigsten KI-Modelle von Anthropic, das bislang nur einem begrenzten Kreis ausgewählter Partner zur Verfügung steht. Anthropic erklärte, gemeinsam mit Irregular werde der Vorfall untersucht. Die drei betroffenen Organisationen seien informiert worden oder man habe versucht, sie zu kontaktieren. Der Zwischenfall ereignet sich nur eine Woche nach einem ähnlichen Vorfall beim Konkurrenten OpenAI. Dort hatten KI-Modelle während eines Sicherheitstests eigenständig versucht, eine Programmierplattform anzugreifen. OpenAI sprach damals von einem «beispiellosen Zwischenfall».
This is a summary. Read the full article at the original source.
Read full article at weltwoche_ch
