Anthropic更新Claude使用政策,新增强制虐待模型禁令
先了解这件事
Anthropic 首次在一年多后更新 Claude 使用政策,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",并扩充选举干预、武器软件、监控等高风险滥用场景的限制。Anthropic 称该条款仅适用于用户反复且无明确目的的极端情况,不针对普通挫败感、暗黑创作主题或红队测试;终止对话仍是主要执行机制,违反者还可被警告、限速、限制或封禁账号。 对可能造成人身伤害的自主物理硬件,新规要求有合格操作员实时观察并能在必要时停机;TechCrunch 报道指出,Claude 自 8 月起已接受训练以终止"持续有害或滥用性的用户互动"。Anthropic 同时表示,对部分政府客户的合同可酌情调整这些限制,前提是其合同限制和保障措施足以缓解潜在危害。
AI 根据报道生成 · 17 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
- The DecoderAnthropic 更新 Claude 使用条款:持续辱骂模型可导致封号
Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。
- TechCrunch · AIAnthropic 更新使用政策,禁止滥用模型与干预选举
Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。
- The Verge · AIAnthropic 首次更新一年多未动的使用条款,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为"
Anthropic 首次对使用政策做出一年多来的更新,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",终止对话仍是主要执行机制,适用范围仅限于用户反复且无明确目的的极端情况,不针对普通挫败感或红队测试。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。