Study Finds Top AI Labs Lack Public Plans for Containing a Rogue Model
Guidelight AI Standards graded five frontier labs — Anthropic, Google, OpenAI, Meta, and xAI — on publicly available containment response plans for models detected subverting human control, with OpenAI scoring highest (3...
Risk:
[+0.1% ↑]
[-1 days ↑]
AGI:
[+0.01% ↑]
[0 days]