Anthropic 更新 Claude 使用条款:持续辱骂模型可导致封号
Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。
Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。
Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。
Anthropic 首次对使用政策做出一年多来的更新,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",终止对话仍是主要执行机制,适用范围仅限于用户反复且无明确目的的极端情况,不针对普通挫败感或红队测试。
AWS 发布博客解读 ISO/IEC 42005:2025 国际标准,帮助客户在企业风险治理体系中高效整合 AI 系统影响评估。标准涵盖评估全生命周期(范围界定、执行、分析报告、持续监测与复评),并提供触发复评的条件与简化流程,Annex D 支持与现有 IT/隐私/安全等评估协同去重,Annex E 提供独立实施的即用模板。
OpenAI 宣布将在欧盟对 ChatGPT 生成的输出默认加水印,其他地区虽提供该功能但默认关闭。欧盟的做法是为遵循 8 月生效的 EU AI Act,后者要求以可被工具检测的方式标记 AI 生成内容。OpenAI 的水印方法名为 textGrain,已发表技术论文说明原理,初期将向有限数量的研究者和机构开放检测器访问权,并设有审批申请流程。
OpenAI 公开其在欧盟文本水印规则下的实施方案:水印适用于符合欧盟相关条款的文本内容,可通过专门机制进行检测,目前相关检测能力首先向研究人员开放。