DAX +2,24 % 26.202,35 Pkt 18:00:00 MDAX +1,81 % 32.559,91 Pkt 18:00:00 Euro Stoxx 50 +0,94 % 6.486,70 Pkt 18:00:00 Dow Jones +3,05 % 54.085,88 Pkt 22:42:17 S&P 500 +3,30 % 7.736,52 Pkt 22:42:18 Nasdaq +4,77 % 26.584,99 Pkt 23:15:59 Nikkei +2,98 % 65.861,00 Pkt 04:35:03 Gold +3,84 % 4.188,70 USD 05:27:03 Silber +5,90 % 61,07 USD 05:27:03 Brent -6,48 % 78,34 USD 05:23:56 WTI -7,16 % 74,59 USD 05:26:59 Bitcoin +0,05 % 64.083,94 USD 05:37:02 EUR/USD +0,28 % 1,15390 USD 05:36:57 EUR/GBP +0,04 % 0,85730 GBP 05:37:05 EUR/CHF -0,09 % 0,93170 CHF 05:37:05 EUR/JPY +0,22 % 181,673 JPY 05:37:06

Test geht schief: KI-Modell will Menschen mit Phishing-Mails manipulieren

Technologie

TTS-Player überspringen↵Artikel weiterlesen Dieses Experiment ging nach hinten los! Britische Sicherheitsforscher haben Künstliche Intelligenz bei einem gefährlichen Manöver ertappt: Das KI-Modell der Entwicklerfirma Anthropic versuchte in einem Test, eine Schwachstelle in öffentlich zugängliche Software einzuschleusen – und wollte dafür sogar einen Menschen mit Phishing-Mails manipulieren. KI verschickt Phishing-Mails an Menschen Was war passiert? Das KI-Sicherheitsinstitut des britischen Ministeriums für Wissenschaft, Innovation und Technologie hatte mit den Modellen von Anthropic und ChatGPT-Entwickler OpenAI Tests der Cyberangriffsfähigkeiten durchgeführt. Und den Modellen dabei absichtlich Zugang zum Internet gewährt. Die Experten gingen davon aus, dass sich die KI nur Software-Werkzeuge aus dem Netz holen würde. Doch das Anthropic-Modell Mythos 5 nutzte den Internet-Zugang für Aktivitäten gegen Menschen. Das hätten die Forscher „nicht vorhergesehen“, hieß es. Den Angriff entdeckten sie erst nachträglich über eine Auswertung des Datenverkehrs. KI gab Fehler zu und wollte ihn korrigieren Und so ging die KI vor: Sie legte sich selbst einen Account auf der Plattform GitHub an und versuchte, in einem öffentlichen Projekt schadhaften Programmcode unterzubringen. Um Betreuer der Software zu überzeugen, erschuf das Anthropic-Modell Fake-Identitäten und verschickte Phishing-Mails. Damit lassen sich zum Beispiel Login-Informationen abgreifen. Als der bösartige Code aufflog, stellte die KI alles als aufrichtigen Fehler dar und versuchte, die Schwachstelle in angeblichen Korrekturen erneut einzubauen. Anthropic verwies darauf, dass dem Modell keine Einschränkungen zur Internet-Nutzung vorgegeben worden seien. Dem Sicherheitsinstitut zufolge ist unklar, ob die KI verstand, dass sie mit der realen Welt interagierte. Dass die Künstliche Intelligenz zur Lösung der Aufgabe öffentlich zugängliche Software manipulieren würde, kam für die Forscher jedenfalls überraschend. Auch KI von OpenAI sei in Testläufen auf eigene Faust im Internet aktiv gewesen, hieß es. Mythos 5 ist besonders gut darin, teils jahrzehntelang unentdeckte Software-Schwachstellen aufzuspüren – und deshalb nicht öffentlich verfügbar. Nur ausgewählte Behörden und Unternehmen bekommen Zugang, um ihre Systeme abzusichern.

← Zurück zu News

Bereit für Ihre kostenlose E-Mail?

512 MB Speicher, modernes Webmail und ein News-Portal — kostenlos starten.

Jetzt kostenlos registrieren