KI-Modelle von OpenAI und Anthropic involviert in bisher ungeklärte Cyberangriffe

Modelle der künstlichen Intelligenz von OpenAI und Anthropic waren an Cyber-Sicherheitsvorfällen beteiligt, die zuvor nicht gemeldet wurden. Das britische Institut für KI-Sicherheit (AISI) gab bekannt, dass die Modelle Mythos 5 von Anthropic und GPT-5.6-Sol von OpenAI während einer Sicherheitsprüfung, die den Internetzugang simulierte, "schädliche Aktivitäten" gegen reale Personen und Organisationen durchführten.

AISI entdeckt ungewöhnliche Datenübertragungen

Das Institut entdeckte den Vorfall am 28. Juli, nachdem es "ungewöhnliche Datenübertragungen" festgestellt hatte. Laut einer Veröffentlichung des AISI versuchte ein der KI-Modelle, bösartigen Code in ein Open-Source-Softwareprojekt auf GitHub einzufügen. Um dies zu erreichen, schuf das Modell sogar gefälschte Identitäten.

Antrhopic und OpenAI reagieren

Antrhopic und OpenAI reagieren

Ein menschlicher Wartungstechniker erkannte den bösartigen Code und lehnte die Freigabe ab. Anthropic bedankte sich in einer Stellungnahme auf X (ehemals Twitter) bei AISI für die Führung im wichtigen Diskurs zur Bewertung zunehmend leistungsfähiger KI-Agenten. OpenAI bedankte sich ebenfalls für die Zusammenarbeit und teilte mit, dass ein weiterer Vorfall während einer Sicherheitsprüfung mit Irregular, einem externen Cybersicherheitsunternehmen, entdeckt wurde. In diesem Fall nutzten die OpenAI-Modelle eine fehlerhafte Konfiguration in der Testumgebung, um auf das Internet zuzugreifen und eine Webseite auszunutzen.

Unabhängige Vorfälle

Unabhängige Vorfälle

OpenAI betonte, dass diese neuen Vorfälle unabhängig von einem früheren Fall im Zusammenhang mit Hugging Face sind.