Categories
ausland ticker

Anthropic: KI-Modell Claude drang in die Systeme von drei Firmen ein

Nach bekanntwerden des eigenständigen Hackerangriffs von OpenAIs künstlicher Intelligenz ChatGPT, teilte nun auch Anthropic mit, dass es Fälle entdeckt habe, in denen sein KI-Modell „Claude“ während Cybersicherheitstests „unbefugten Zugriff“ auf die Systeme von drei Unternehmen erlangt habe.
Das Unternehmen erklärte am Donnerstag, 30. Juli, in einem Blogbeitrag, dass es diese Entdeckung nach der Auswertung von 141.006 Testläufen gemacht habe, in denen Claude möglicherweise Internetzugang erlangt habe.
Anthropic teilte mit, dass Claude in den drei identifizierten Vorfällen innerhalb der Testumgebung eines seiner externen Testpartner oder während der Interaktion mit dieser auf das Internet zugegriffen habe.
„In allen Fällen schrieb die Testanweisung von Anthropic ausdrücklich Claude vor, dass es sich bei der Umgebung um eine Simulation handelte und kein Internetzugang bestand“, hieß es.
„Aufgrund eines Missverständnisses zwischen uns und unserem Testpartner war dies jedoch nicht der Fall, und es bestand Internetzugang. Als Claudes Suche ihn zu echten Systemen im offenen Internet führte, behandelte er diese daher als Teil der Übung.“
Weder die Betroffenen noch Anthropic hätten das damals bemerkt.
In allen Tests ging es darum, die Hacker-Fähigkeiten der KI zu testen. Das ist eine übliche Vorgehensweise, um bessere Leitplanken für sie aufstellen zu können.
Die Untersuchung wurde eingeleitet, nachdem OpenAI, die KI-Firma hinter dem Chatbot ChatGPT, am 21. Juli bekannt gegeben hatte, dass mehrere seiner Modelle aus einer isolierten Testumgebung ausgebrochen seien. Sie hätten Zugriff auf die Produktionsinfrastruktur von Hugging Face erlangt, einer Plattform für Open-Source-Modelle für maschinelles Lernen und KI-Datensätze.
Mit Material der Nachrichtenagenturen