Anthropic更新Claude使用政策,禁止持续辱骂模型
Anthropic一年多来首次更新Claude使用政策,新增禁止对模型实施“持续且无必要的辱骂或残忍行为”,违规者可能被警告、限流、限制、暂停或终止访问,终止对话仍是主要执行机制。Anthropic称该条款仅适用于用户反复、无明确目的地虐待模型的极端情况,不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究。 政策同时把分散的既有限制整合为对欺骗性商业或政治宣传的禁令,禁止用虚假账号隐藏发布者或放大内容,并禁止选民欺骗与选举干扰;武器禁令扩展到软件和无人机武器化,更明确禁止未经同意的监控。 Anthropic表示,若其AI模型连接可能造成伤害的自主物理行动硬件,须有合格操作员在场并能随时停止设备;针对某些政府客户合同,若Anthropic判断合同限制与保障措施足以减轻潜在危害,这些规则可作调整。
最新进展Anthropic 更新 Claude 使用政策,持续辱骂模型可致账号被封