AI Safety Evaluation Datasets Datasets and viewer resources for studying evaluation awareness, instrumental behaviour, sabotage, and monitoring in AI agents. aisa-group/EvalAwareBench Viewer • Updated May 25 • 103k • 337 • 6 aisa-group/instrumental-choices-agent-traces Updated 12 days ago • 94 • 1 aisa-group/ResearchArena-Trajectories Updated 3 days ago • 17.2k • 1
Agent Trajectories Agent trajectories from the AI Safety and Alignment Group’s benchmarks, released for analysing agent behaviour, capabilities, and safety. aisa-group/ResearchArena-Trajectories Updated 3 days ago • 17.2k • 1 aisa-group/PostTrainBench-Trajectories Updated 29 days ago • 15k • 8 aisa-group/InferenceBench-Trajectories Updated Jun 21 • 208 • 3 aisa-group/instrumental-choices-agent-traces Updated 12 days ago • 94 • 1
AI Safety Evaluation Datasets Datasets and viewer resources for studying evaluation awareness, instrumental behaviour, sabotage, and monitoring in AI agents. aisa-group/EvalAwareBench Viewer • Updated May 25 • 103k • 337 • 6 aisa-group/instrumental-choices-agent-traces Updated 12 days ago • 94 • 1 aisa-group/ResearchArena-Trajectories Updated 3 days ago • 17.2k • 1
Agent Trajectories Agent trajectories from the AI Safety and Alignment Group’s benchmarks, released for analysing agent behaviour, capabilities, and safety. aisa-group/ResearchArena-Trajectories Updated 3 days ago • 17.2k • 1 aisa-group/PostTrainBench-Trajectories Updated 29 days ago • 15k • 8 aisa-group/InferenceBench-Trajectories Updated Jun 21 • 208 • 3 aisa-group/instrumental-choices-agent-traces Updated 12 days ago • 94 • 1