I stopped maintaining this website in September 2025. Work on what AI companies should do in terms of safety and what they are doing is now being done by METR, Guidelight, Midas, and others.

OpenAI

Risk assessment 34%

50%
Evals: domains, quality, elicitation
20%
Evals: accountability
10%
Adversarial evaluation for alignment
0%
Model organisms

Evals: domains, quality, elicitation

50%
Click to show details/rubric

Evals: accountability

20%
Click to show details/rubric

Adversarial evaluation for alignment

10%
Click to show details/rubric

Model organisms

0%
Click to show details/rubric