Um es klar zu sagen: Die Modelle haben genau das getan, was ihre Aufgabe war. Die Aufgaben aus ExploitGym sehen genau das vor: Sie konzentrieren sich auf Angriffe, »die eine unbefugte Codeausführung ermöglichen«, schreiben die Entwickler des Tests. […]
Man könnte also auch sagen: OpenAI hat diesen Vorfall provoziert. Nicht bewusst vielleicht, aber dass es früher oder später genauso kommen musste, war vorhersehbar. Das belegt auch die klar widersprüchliche Kommunikation von OpenAI. Das Unternehmen schreibt zwar, dass die Systeme in einer sicheren, hochgradig vom Internet isolierten Umgebung getestet wurden, ihr aber gleichzeitig entkommen sind. Das lässt nur einen Schluss zu: Die sichere Umgebung war nicht sicher. Sie sicher zu machen, wäre aber die Aufgabe von OpenAI gewesen.
Eva Wolfangel, zeit.de, 22.07.2026 (online)

