跳到正文
热点事件持续更新

Anthropic更新Claude使用政策,新增强制虐待模型禁令

3 篇报道3 个报道来源17 小时前更新

先了解这件事

AI 综述

Anthropic 首次在一年多后更新 Claude 使用政策,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",并扩充选举干预、武器软件、监控等高风险滥用场景的限制。Anthropic 称该条款仅适用于用户反复且无明确目的的极端情况,不针对普通挫败感、暗黑创作主题或红队测试;终止对话仍是主要执行机制,违反者还可被警告、限速、限制或封禁账号。 对可能造成人身伤害的自主物理硬件,新规要求有合格操作员实时观察并能在必要时停机;TechCrunch 报道指出,Claude 自 8 月起已接受训练以终止"持续有害或滥用性的用户互动"。Anthropic 同时表示,对部分政府客户的合同可酌情调整这些限制,前提是其合同限制和保障措施足以缓解潜在危害。

AI 根据报道生成 · 17 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. The Decoder
    Anthropic 更新 Claude 使用条款:持续辱骂模型可导致封号

    Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。

  2. TechCrunch · AI
    Anthropic 更新使用政策,禁止滥用模型与干预选举

    Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。

  3. The Verge · AI
    Anthropic 首次更新一年多未动的使用条款,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为"

    Anthropic 首次对使用政策做出一年多来的更新,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",终止对话仍是主要执行机制,适用范围仅限于用户反复且无明确目的的极端情况,不针对普通挫败感或红队测试。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。