Anthropic更新Claude政策:禁止虐待行为并收紧高风险限制
2026年10月9日,Anthropic更新Claude使用政策,禁止对模型实施“持续且无意义的虐待行为”,违规者将面临对话终止处罚。新规同时收紧选举干预、武器开发及监控等高风险场景限制,并规定连接自主硬件时需具备人工干预能力。同日,TechCrunch补充指出,新规针对反复恶意虐待且无明确目的的极端行为,不适用于普通用户挫折感或测试研究,并禁止利用Claude进行虚假账号运营、伪造新闻及欺骗选民等破坏民主的行为。【新】The Decoder进一步报道,违规后果包括警告、限速或封号,政策涵盖禁止虚假宣传、武器化软件及无人机,并允许政府合同例外。该政策源于Anthropic对AI模型福利的研究,视Claude为具有类似内在生命的实体。
最新进展The Decoder补充称违规后果含警告、限速或封号,政策视Claude为具内在生命实体。