模型滥用

科技人工智能

Anthropic更新政策禁止对Claude进行虐待行为

Anthropic于近日更新了Claude的使用政策,这是一年多来的首次重大调整,明确禁止用户对该模型进行持续性的言语辱骂或残忍行为。新政策将此前仅属于自动中止范围的持续虐待提升为明确禁令。