Folia
← 返回头版

MIT开发算法强制AI遵守安全约束

麻省理工学院的研究团队开发了名为HardFlow的算法,能够在不重新训练模型的情况下,强制生成式AI的输出满足严格的安全约束条件1。这一方法已发表在《IEEE模式分析与机器智能汇刊》上,由MIT机械工程系研究生Zeyang Li、副教授Kaveh Alim和Navid Azizan等人主导1。

HardFlow的核心创新在于其约束执行机制1。该算法不要求每个中间步骤都满足约束,而是仅在最后一步检查约束是否达成1。Zeyang Li表示,"对于约束满足,最终重要的是模型的最终输出,因为内部过程会被丢弃。通过不要求每个中间步骤都满足约束,我们给予模型更多自由度来寻找高质量的可行解"1。

在模拟测试中,该方法在D3IL机器人操作基准、迷宫导航、物理过程边界条件控制和文本到图像编辑等四个任务中均满足约束要求1。然而,所有验证结果均源自模拟基准测试,尚未在真实机器人或生产系统中经过测试1。


评论