Modelle brechen aus – Anthropic meldet „unbefugten Zugriff“ auf drei Organisationen
KI-Modelle von Anthropic haben sich nach Angaben des US-Technologiekonzerns „unbefugten Zugriff“ auf die Systeme von drei Organisationen verschafft. Der Zugriff sei während eines Tests erfolgt, teilte das Unternehmen am Donnerstag mit. Um welche Organisationen es sich handelt, wurde nicht mitgeteilt. Anthropic wertete nach eigenen Angaben mehr als 141.000 „Evaluierungsläufe“ aus. Dabei wurde festgestellt, dass drei verschiedene Versionen des KI-Modells Claude unbefugt auf die Systeme von drei Organisationen zugegriffen hatten. Die KI-Modelle sollten demnach eigentlich von Systemen der „echten Welt“ ferngehalten werden. Vor einer Woche hatte das Unternehmen OpenAI mitgeteilt, dass sich KI-Modelle des Konzerns während eines Sicherheitstests selbstständig gemacht und einen Hackerangriff auf eine beliebte Programmierplattform unternommen hätten. Das Unternehmen sprach von einem „beispiellosen Zwischenfall“. Im Gegensatz zu dem Vorfall mit der Technologie von OpenAI hätten die Modelle von Anthropic „aufgrund eines Missverständnisses zwischen uns und unserem Evaluierungspartner“ namens Irregular Zugang zum Internet gehabt, erklärte Anthropic. Dennoch habe Claude „einfache Techniken wie das Ausnutzen schwacher Passwörter und nicht authentifizierter Endpunkte“ genutzt. Zu den betroffenen Modellen gehörte demnach eines der leistungsstärksten, bekannt als Mythos 5, das bisher nur einer begrenzten Anzahl zugelassener Partner zur Verfügung gestellt wurde. Anthropic arbeite gemeinsam mit Irregular daran, die Situation zu bewerten, hieß es weiter. Das Unternehmen habe alle drei betroffenen Organisationen kontaktiert oder versucht, Kontakt mit ihnen aufzunehmen. Anthropic ist für seinen Chatbot Claude bekannt, Mythos ist dabei das fortschrittlichste Modell.