AI Safety Evaluation Datasets Collection Datasets and viewer resources for studying evaluation awareness, instrumental behaviour, sabotage, and monitoring in AI agents. • 3 items • Updated 5 days ago
Agent Trajectories Collection Agent trajectories from the AI Safety and Alignment Group’s benchmarks, released for analysing agent behaviour, capabilities, and safety. • 4 items • Updated 5 days ago