Fest steht: Die Systeme werden immer autonomer. Und wenn sie einem Agenten Zugang zum Netz geben und ihm erlauben, eine Firma zu hacken, dann tut er das. Das wirkt sehr mächtig. Deshalb brauchen diese Systeme immer mehr Leitplanken, und dafür gibt es zwei Wege. Erstens externe Überwachungssysteme: die viel zitierten Sandboxes. Das System protokolliert, was es tut, also, dass es gerade eine Firma hackt, und von außen sieht man, was passiert. Das ist keine KI-Frage, das ist Software- und Netzwerk-Engineering. Der zweite Weg: Die Modelle sollen von sich aus gar nicht erst versuchen, was nicht erlaubt ist.
Arthur Mensch, sueddeutsche.de, 04.10.2026 (online)

