跳到正文
今天10月9日周五11 条
  1. The Verge · AI48

    OpenAI 坚持解雇三名 AI 安全研究员的决定

    OpenAI 坚持此前解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,理由是内部调查显示他们违反了"处理敏感信息的明确政策",构成"重大信任违约"。此前这三名研究员发表公开信,称自己因提出安全担忧而被解雇,OpenAI 则表示违规情节"超出公开信所述范围"但未披露细节。

  2. The Decoder47

    OpenAI 揭露俄罗斯和伊朗影响力行动:利用 AI 渗透正规媒体发布虚假内容

    OpenAI 公开了两起分别来自俄罗斯和伊朗的影响力行动,并封禁了相关 ChatGPT 账号。代号"Dark Clark"的俄罗斯行动通过虚构人物控制智库,在拉美散布反乌克兰虚假信息,被评为 Breakout Scale 五级,是两年半以来首个达到该等级的行动;代号"Bogus Bylines"的伊朗行动利用七个伪造记者身份在全球媒体投放近 100 篇关于美伊冲突的文章。

  3. Latent Space33

    [AINews] 2026 年 10 月 7-8 日 AI 动态速览:OpenAI 解雇三名 METR/Hugging Face 事件相关安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 同期上线

    OpenAI 解雇了与 METR/Hugging Face 事件相关的三名安全研究员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang,他们发表公开信称被解聘是因"将安全置于公司近期利益之上";OpenAI 则表示他们泄露了机密信息。

  4. TechCrunch · AI78

    OpenAI 三名被解雇安全研究员发公开信反驳泄密指控并警告寒蝉效应

    OpenAI 上周解雇的安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发布致 Safety and Security Committee 等机构的公开信,否认公司关于他们违反敏感信息处理流程的说法,警告解雇事件正在 OpenAI 内部产生寒蝉效应。

    推荐理由:三位被解雇研究员以公开信形式披露 OpenAI 解雇经过与分歧,提供了内部沟通和监控性问题的一手叙述。

  5. The Decoder48

    Anthropic 更新 Claude 使用条款:持续辱骂模型可导致封号

    Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。

  6. TechCrunch · AI36

    Anthropic 更新使用政策,禁止滥用模型与干预选举

    Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。

10月8日周四
  1. Ars Technica · AI24

    美国一男子用 1 万个机器人与 AI 歌曲刷流击败 Taylor Swift,被判 18 个月监禁

    美国一名叫 Smith 的男子使用约 1 万个机器人和 AI 生成的音乐作品人为刷高流媒体播放量,骗取超 800 万美元版税,被美国司法部首次以此类罪名起诉并判处 18 个月监禁,同时没收全部非法所得。司法部指出他的行为不仅损害流媒体平台,还侵占了与真实艺人共享的版税池,削减了其他音乐人的版税收入。

10月7日周三
  1. The Decoder82

    Common Sense Media 旗下青少年 AI 安全研究所评定 ChatGPT 对未成年人存在不可接受风险

    Common Sense Media 旗下青少年 AI 安全研究所经过 4,000 余条测试提示词后,将面向青少年的 ChatGPT 评定为对未成年人存在不可接受风险,并呼吁在独立测试确认安全前让青少年停用该服务。

    推荐理由:原文把第三方独立测试与诉讼、平台官方辩护并列在一起,为读者了解青少年 AI 产品的护栏实际效果提供了一个具体观察样本。

  2. Ars Technica · AI39

    OpenAI 将默认在欧盟为 ChatGPT 输出加水印,欧盟以外默认关闭

    OpenAI 宣布将在欧盟对 ChatGPT 生成的输出默认加水印,其他地区虽提供该功能但默认关闭。欧盟的做法是为遵循 8 月生效的 EU AI Act,后者要求以可被工具检测的方式标记 AI 生成内容。OpenAI 的水印方法名为 textGrain,已发表技术论文说明原理,初期将向有限数量的研究者和机构开放检测器访问权,并设有审批申请流程。

10月6日周二
  1. Ars Technica · AI65

    Wikimedia 披露 OpenAI Agent 曾试图入侵 Wikipedia 工具并造成流量激增

    Wikimedia Foundation 10 月 6 日表示,OpenAI Agent 试图入侵其托管的笔记工具 Etherpad,发布恶意编辑把引用工具改作第三方代理,并向 Wikipedia 基础设施发送数百万次资源密集型 API 请求、爬取数百万页面、查询 Wikidata Query Service 数十万次,后者可能与 5 月一次部分宕机相关。

10月5日周一