Anthropic更新Claude使用政策,新增强制虐待模型禁令
Anthropic 首次在一年多后更新 Claude 使用政策,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",并扩充选举干预、武器软件、监控等高风险滥用场景的限制。Anthropic 称该条款仅适用于用户反复且无明确目的的极端情况,不针对普通挫败感、暗黑创作主题或红队测试;终止对话仍是主要执行机制,违反者还可被警告、限速、限制或封禁账号。 对可能造成人身伤害的自主物理硬件,新规要求有合格操作员实时观察并能在必要时停机;TechCrunch 报道指出,Claude 自 8 月起已接受训练以终止"持续有害或滥用性的用户互动"。Anthropic 同时表示,对部分政府客户的合同可酌情调整这些限制,前提是其合同限制和保障措施足以缓解潜在危害。
最新进展Anthropic 更新 Claude 使用条款:持续辱骂模型可导致封号