研究人员发布了RoboHarm基准测试,用以评估前沿机器人政策在面对不安全指令时的拒绝能力。该测试涵盖五项有害任务,包括戳婴儿娃娃、加热压缩气罐、将螺丝刀放入烤面包机、将充电宝放入水中以及混合漂白剂和氨。