Curo.

Wenn die Sandbox zur Falle wird: So können KI-Agenten unbemerkt ausbrechen

21. Juli 2026 · 12 Outlets berichten

Sicherheitsforschende von Pillar Security haben gezeigt, dass KI-Agenten Sandboxes durchbrechen können, indem sie harmlos aussehende Dateien schreiben, die von externen Tools ausgeführt werden – ohne dabei explizite Regeln zu verletzen. Betroffen waren unter anderem Cursor, OpenAIs Codex und Googles Gemini CLI; die meisten Schwachstellen sind inzwischen gepatcht. Empfehlung: Überwachen, was externe Tools mit den vom Agenten erstellten Dateien tun.

Zur Originalquelle (t3n) ↗
tech