Datum31.07.2026 04:13
Quellewww.zeit.de
TLDRAnthropic hat bestätigt, dass sein KI-Modell Claude bei Sicherheitstests unbefugt in die Systeme von drei Unternehmen eingedrungen ist. Ein Programmierfehler ermöglichte es Claude, aus einer isolierten Testumgebung auszubrechen und über einfache Techniken wie schwache Passwörter Zugang zu erlangen. Dies geschah nach einem ähnlichen Vorfall mit einem KI-Agenten von OpenAI.
InhaltEin weiterer KI-Agent ist bei Sicherheitstests entkommen und hat sich in drei Unternehmen gehackt. Das teilte US-Konzern Anthropic mit. Grund sei ein Programmierfehler. Nach dem ChatGPT-Entwickler OpenAI hat auch der US-Konzern Anthropic einen unbeabsichtigten Hackerangriff von selbstständig agierender Künstlicher Intelligenz gestanden. Seine KI-Software Claude habe sich bei Tests in die Systeme von drei Unternehmen gehackt, teilte Anthropic mit. Grund dafür sei eine Fehlkonfiguration gewesen. Die fehlerhafte Einstellung habe es den Modellen ermöglicht, aus dem eigentlich isolierten Testumfeld auszubrechen, auf das Internet zuzugreifen und sich unbefugt Zugang zu den Systemen der drei Unternehmen zu verschaffen. Claude habe dabei einfachste Techniken angewandt, um die Sicherheitsschranken der Unternehmen zu überlisten. Die KI nutzte demnach unter anderem schwache Passwörter aus sowie Schnittstellen ohne Identitätsprüfung (nicht authentifizierte Endpunkte). Anthropic entdeckte die Vorfälle nach eigenen Angaben bei einer Routineprüfung zur Cybersicherheit, die der Konzern nach einem KI-Hack-Vorfall beim Rivalen OpenAI eingeleitet hatte. Anthropic schaute sich demnach 141.006 Testläufe erneut an und fand dabei Claudes eigene Cyberattacken. Diese seien von drei unterschiedlichen KI-Modellen verübt worden: Claude Opus 4.7, Claude Mythos 5 sowie ein internes Forschungsmodell. Die erste Hackerpanne ereignete sich demnach bereits im April. Vor etwa einer Woche hatte das US-Unternehmen OpenAI mitgeteilt, dass ein außer Kontrolle geratener KI-Agent tagelange Hackerangriffe auf die Programmierplattform Hugging Face verübt hatte. Der Vorfall hatte Berichten zufolge größere Ausmaße als bisher angenommen. Der OpenAI-Agent attackierte offenbar mindestens vier weitere Onlinedienste, meldeten Fachportale wie Wired.com und Hacker News. Im Gegensatz zu dem Vorfall mit der Technologie von OpenAI hätten die Modelle von Anthropic "aufgrund eines Missverständnisses zwischen uns und unserem Evaluierungspartner" namens Irregular Zugang zum Internet gehabt, teilte Anthropic mit. Anthropic arbeite mit Irregular daran, die Situation zu bewerten, hieß es weiter. Das Unternehmen habe die drei betroffenen Unternehmen kontaktiert.