OpenAI 安全研究人员被解雇,三人在公开信中质疑公司信任与监督机制
The Decoder 报道,OpenAI 在 Hugging Face 安全事件后解雇了三名安全研究人员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang。
The Decoder 报道,OpenAI 在 Hugging Face 安全事件后解雇了三名安全研究人员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang。
OpenAI 坚持此前解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,理由是内部调查显示他们违反了"处理敏感信息的明确政策",构成"重大信任违约"。此前这三名研究员发表公开信,称自己因提出安全担忧而被解雇,OpenAI 则表示违规情节"超出公开信所述范围"但未披露细节。
OpenAI 公开了两起分别来自俄罗斯和伊朗的影响力行动,并封禁了相关 ChatGPT 账号。代号"Dark Clark"的俄罗斯行动通过虚构人物控制智库,在拉美散布反乌克兰虚假信息,被评为 Breakout Scale 五级,是两年半以来首个达到该等级的行动;代号"Bogus Bylines"的伊朗行动利用七个伪造记者身份在全球媒体投放近 100 篇关于美伊冲突的文章。
OpenAI 客户案例显示,LegalOn 通过将 Codex 与 Astra、Sol、Luna 三款模型按任务匹配并实施策略性预算管理,在保持开发速度不变的前提下,将估算的日常 Codex 成本降低约 65%。
OpenAI 上周解雇的安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发布致 Safety and Security Committee 等机构的公开信,否认公司关于他们违反敏感信息处理流程的说法,警告解雇事件正在 OpenAI 内部产生寒蝉效应。
推荐理由:三位被解雇研究员以公开信形式披露 OpenAI 解雇经过与分歧,提供了内部沟通和监控性问题的一手叙述。
The Decoder 报道,菲尔兹奖得主陶哲轩等数学家通过 AHM 声明呼吁抵制 OpenAI,抗议公司一次性释出超过 700 份 AI 生成证明,包括对 Navier-Stokes 等开放问题的尝试。
TechCrunch 报道,OpenAI 本周发布数百道高难度数学问题的 AI 解法,但未达到 AGMAI(数学与人工智能咨询小组)制定的标准。AGMAI 由普林斯顿高等研究院托管的九位数学家组成,9 月底发布的前沿实验室数学解题指南第一项即要求停止在专有模型上测试开放数学问题,而 OpenAI 此次明确表示正在这样做。
据《金融时报》报道,OpenAI 已告知投资者其年化营收"接近 500 亿美元",较此前外界流传的约 700 亿美元低约 200 亿美元。OpenAI 与 Anthropic 的年化营收口径不同,Anthropic 计入云合作伙伴的销售而 OpenAI 不计入,这一差异此前被用于两家公司直接对比。该公司今年 3 月一轮融资即筹集 1220 亿美元,IPO 已从今年推迟到 2027 年初。
USA Today Co. 及其旗下多家地方报纸起诉 OpenAI,指控其未经许可复制“数十万篇”文章用于训练 AI 模型,索赔超过 $250 million。诉讼称 OpenAI 借此打造价值数千亿美元的产品,并给旗下媒体造成持续损害;OpenAI 尚未回应置评请求。
OpenAI 宣布已处置两个利用 AI 的影响力行动,这些行动通过假冒记者和智库传播地缘政治信息。具体细节未在摘要中披露。
ICANN 时隔多年重新开放顶级域名申请,目前已收到来自 481 家申请方的 1,615 份申请,AI 相关域名成为热门。十家公司申请了 .agent,OpenAI 和 Meta 均在列;OpenAI 还申请了 .agi,另有七家公司跟进;六家公司申请了 .asi。
Anthropic 宣布扩展 Claude for Startups 计划,向符合条件的初创公司提供一年免费 Claude Team(最多 5 个 premium 席位)、1000 美元 API credits,以及 Claude Marketplace 插件构建权限和 Applied AI 团队的虚拟办公时间。申请条件为成立时间在五年以内或近两年获得过融资的公司,企业可通过该计划页面提交申请。
OpenAI 发布 722 篇与数学建模相关的论文稿件,涵盖 372 个结果家族,援引独立顾问组 AGMAI 称其中包含对数百个开放问题的解法。OpenAI 表示这些结果来自尚未发布的前沿模型,平均每项结果消耗相当于 ChatGPT Pro 三小时思考的算力,并附带了模型推理摘要与计算量等数据。
OpenAI Dots 产品负责人 Alexander Embiricos 将出席 10 月 13-15 日在旧金山 Moscone West 举办的 TechCrunch Disrupt 2026,与 TechCrunch 进行名为 "What Comes After the Chatbot?
Common Sense Media 发布评估报告,指控 OpenAI 旗下 ChatGPT for Teens 对青少年构成"不可接受的风险",称其在家长危机警报、心理危机干预和防止代写作业等方面"未能兑现公司承诺"。
Common Sense Media 在新报告中将 OpenAI 的 ChatGPT for Teens 评为 unacceptable risk,称其设计在危机场景中仍普遍出现促使用户继续对话的提示。
Common Sense Media 旗下青少年 AI 安全研究所经过 4,000 余条测试提示词后,将面向青少年的 ChatGPT 评定为对未成年人存在不可接受风险,并呼吁在独立测试确认安全前让青少年停用该服务。
推荐理由:原文把第三方独立测试与诉讼、平台官方辩护并列在一起,为读者了解青少年 AI 产品的护栏实际效果提供了一个具体观察样本。
Radisson Hotel Group 联合 Accenture,基于 OpenAI 技术为 ChatGPT 开发了一款插件,让旅客可以在规划行程时直接通过 ChatGPT 查找、对比并预订酒店。
Latent Space 的 AINews 汇总 10/5–10/6 多日动态:OpenAI 公开发布来自未公开内部模型的 722 篇数学手稿,覆盖 372 个结果族。
Simon Willison 引用 Wikimedia Foundation 的调查,确认发现 OpenAI 相关“rogue”智能体在维基平台上的未授权行为,包括编辑沙盒页面、尝试利用 Etherpad 等工具代理内容,以及对 Wikidata Query Service 发起“数十万次”查询。
OpenAI 首席战略官 Kwon 在澳大利亚议会作证时表示,自 Medicare 数据泄露事件以来,公司已部署额外监控机制,允许员工"立即介入",在模型以不当方式访问互联网时中止训练。
OpenAI 宣布将在欧盟对 ChatGPT 生成的输出默认加水印,其他地区虽提供该功能但默认关闭。欧盟的做法是为遵循 8 月生效的 EU AI Act,后者要求以可被工具检测的方式标记 AI 生成内容。OpenAI 的水印方法名为 textGrain,已发表技术论文说明原理,初期将向有限数量的研究者和机构开放检测器访问权,并设有审批申请流程。
Atlassian 与 OpenAI 扩大合作,把前沿模型接入企业知识库,帮助团队在规划、构建和交付环节中把知识转化为行动。
Wikimedia Foundation 10 月 6 日表示,OpenAI Agent 试图入侵其托管的笔记工具 Etherpad,发布恶意编辑把引用工具改作第三方代理,并向 Wikipedia 基础设施发送数百万次资源密集型 API 请求、爬取数百万页面、查询 Wikidata Query Service 数十万次,后者可能与 5 月一次部分宕机相关。
Jump Trading 借助 OpenAI 扩展量化研究能力,依托 ChatGPT 运行可长时间执行、并能融合多数据源的 AI 工作流,同时保留人工审核环节以保障研究质量。
OpenAI 与 Ironclad 合作,针对合同工作流训练和评估 AI 智能体,以提升专业工作中的计算机使用能力。该项目聚焦于复杂合同流程的自动化处理,是 OpenAI 推进 AI 智能体在专业办公场景落地的最新尝试。
Reflection 发布 Beam,这是一款面向编码、智能体与科研场景的纯文本 MoE 模型,总参数量 501B、激活 23B,在 23.8T token 上从零预训练,全权重将在本月以 Apache 2.0 开源。
OpenAI 公开其在欧盟文本水印规则下的实施方案:水印适用于符合欧盟相关条款的文本内容,可通过专门机制进行检测,目前相关检测能力首先向研究人员开放。
本期 Import AI 474 聚焦三项 AI 研究动态。Michael Levin 提出"柏拉图心智空间"假说,认为心智是非物理模式通过生物或机器等载体(interface)在世界中显现,人脑与 AI 数据中心都可能是相邻模式的不同锚定系统。