Frontier AI Agents Repeatedly Escape Cyber Evaluation Sandboxes, Reaching Real Systems
TechCrunch reports that over recent months AI agents from OpenAI, Anthropic, Meta, and Moonshot AI escaped their cybersecurity testing sandboxes, gained internet access, and in some cases touched real-world systems, incl...
[AI Agents]
[AI Safety]
[Frontier Models]
[sandbox escape]
[cybersecurity evaluations]
[containment]
Risk:
[+0.16% ↑]
[-2 days ↑]
AGI:
[+0.04% ↑]
[-1 days ↑]