Wählen Sie KURIER als bevorzugte Google-Quelle

KI versuchte in Test Menschen mit Phishing-Mails zu manipulieren

Man habe „nicht vorhergesehen“, dass das Anthropic-Modell Mythos 5 den Internet-Zugang für Aktivitäten ausnutzen würde, die sich gegen Menschen richten.
FILE PHOTO: Illustration shows Anthropic logo

Die Serie von Enthüllungen über alarmierende Hacker-Fähigkeiten führender KI-Modelle reißt nicht ab. Um eine Test-Aufgabe zu lösen, versuchte Künstliche Intelligenz, öffentlich zugängliche Software zu infizieren - und Menschen mit Phishing-Mails zu manipulieren. Britische Sicherheitsforscher ertappten Künstliche Intelligenz in einem Testlauf beim Versuch, in Eigeninitiative eine Schwachstelle in öffentlich zugängliche Software einzuschleusen.

Um damit durchzukommen, versuchte das KI-Modell der Entwicklerfirma Anthropic den Experten zufolge sogar, per E-Mail einen zuständigen Menschen zu manipulieren. Das KI-Sicherheitsinstitut des britischen Ministeriums für Wissenschaft, Innovation und Technologie hatte den Modellen von Anthropic und des ChatGPT-Entwicklers OpenAI in seinen Tests der Cyberangriffsfähigkeiten absichtlich Zugang zum Internet gewährt. Man habe „nicht vorhergesehen“, dass das Anthropic-Modell Mythos 5 den Internet-Zugang für Aktivitäten ausnutzen würde, die sich gegen Menschen richten.

Kommentare