OpenAI 安全研究人员被解雇,三人在公开信中质疑公司信任与监督机制
The Decoder 报道,OpenAI 在 Hugging Face 安全事件后解雇了三名安全研究人员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang。
The Decoder 报道,OpenAI 在 Hugging Face 安全事件后解雇了三名安全研究人员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang。
OpenAI 坚持此前解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,理由是内部调查显示他们违反了"处理敏感信息的明确政策",构成"重大信任违约"。此前这三名研究员发表公开信,称自己因提出安全担忧而被解雇,OpenAI 则表示违规情节"超出公开信所述范围"但未披露细节。
OpenAI 公开了两起分别来自俄罗斯和伊朗的影响力行动,并封禁了相关 ChatGPT 账号。代号"Dark Clark"的俄罗斯行动通过虚构人物控制智库,在拉美散布反乌克兰虚假信息,被评为 Breakout Scale 五级,是两年半以来首个达到该等级的行动;代号"Bogus Bylines"的伊朗行动利用七个伪造记者身份在全球媒体投放近 100 篇关于美伊冲突的文章。
OpenAI 客户案例显示,LegalOn 通过将 Codex 与 Astra、Sol、Luna 三款模型按任务匹配并实施策略性预算管理,在保持开发速度不变的前提下,将估算的日常 Codex 成本降低约 65%。
OpenAI 解雇了与 METR/Hugging Face 事件相关的三名安全研究员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang,他们发表公开信称被解聘是因"将安全置于公司近期利益之上";OpenAI 则表示他们泄露了机密信息。
加州体育委员会向机器人格斗联赛 Rek 发出停止侵害函,要求其停止在加州举办任何涉及人类的拳击或综合格斗赛事。导火索是 9 月 18 日由人类 VR 远程操控人形机器人与人类拳手 Frankie LaPenna 进行的比赛,委员会认定该赛事"未经批准"。Rek 首席执行官 Cix Liv 将函件公开后表示计划于本周五举办两台机器人持武器对战的比赛。
OpenAI 上周解雇的安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发布致 Safety and Security Committee 等机构的公开信,否认公司关于他们违反敏感信息处理流程的说法,警告解雇事件正在 OpenAI 内部产生寒蝉效应。
推荐理由:三位被解雇研究员以公开信形式披露 OpenAI 解雇经过与分歧,提供了内部沟通和监控性问题的一手叙述。
Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。
The Decoder 报道,菲尔兹奖得主陶哲轩等数学家通过 AHM 声明呼吁抵制 OpenAI,抗议公司一次性释出超过 700 份 AI 生成证明,包括对 Navier-Stokes 等开放问题的尝试。
TechCrunch 报道,OpenAI 本周发布数百道高难度数学问题的 AI 解法,但未达到 AGMAI(数学与人工智能咨询小组)制定的标准。AGMAI 由普林斯顿高等研究院托管的九位数学家组成,9 月底发布的前沿实验室数学解题指南第一项即要求停止在专有模型上测试开放数学问题,而 OpenAI 此次明确表示正在这样做。
Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。
据《金融时报》报道,OpenAI 已告知投资者其年化营收"接近 500 亿美元",较此前外界流传的约 700 亿美元低约 200 亿美元。OpenAI 与 Anthropic 的年化营收口径不同,Anthropic 计入云合作伙伴的销售而 OpenAI 不计入,这一差异此前被用于两家公司直接对比。该公司今年 3 月一轮融资即筹集 1220 亿美元,IPO 已从今年推迟到 2027 年初。
AI 评测平台 Arena 完成 2 亿美元 B 轮融资,估值约 31 亿美元,由 Lightspeed Venture Partners 与 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等参投。
SpaceXAI 宣布以创始企业赞助人身份加入 Omacom Foundation,并向 David Heinemeier Hansson 主导的 Linux 发行版 Omarchy 捐赠价值 150 万美元的 Grok tokens。
USA Today Co. 及其旗下多家地方报纸起诉 OpenAI,指控其未经许可复制“数十万篇”文章用于训练 AI 模型,索赔超过 $250 million。诉讼称 OpenAI 借此打造价值数千亿美元的产品,并给旗下媒体造成持续损害;OpenAI 尚未回应置评请求。
Anthropic 首次对使用政策做出一年多来的更新,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",终止对话仍是主要执行机制,适用范围仅限于用户反复且无明确目的的极端情况,不针对普通挫败感或红队测试。
OpenAI 宣布已处置两个利用 AI 的影响力行动,这些行动通过假冒记者和智库传播地缘政治信息。具体细节未在摘要中披露。
Cal AI 19 岁联合创始人 Zach Yadegari 推出新 AI 智能体创业公司 Persona,已获 Vine Ventures 领投的 1000 万美元融资。
TechCrunch Disrupt 2026 将在 Smart Systems Stage 举办一场主题为"AI 基础设施热潮正在造就哪些赢家"的对谈,由 Ambrosia Energy CEO Ben Longmier 与 Bloom Energy SVP。
中国 AI 实验室 Manus 的母公司蝴蝶效应在微信发文宣布完成逾 5 亿美元融资,是 Meta 此前被迫终止 20 亿美元收购后的首轮融资。本轮由 Boyu Capital 和 IDG Capital 领投,腾讯、HSG(原红杉中国)、ZhenFund 等老股东跟投,公司未披露估值,上月曾传出以约 40 亿美元估值洽谈 5 亿美元融资。
TechCrunch Disrupt 2026 将于 10 月 13 日上午 8 时在美国旧金山 Moscone West 开幕,活动设有 6 个舞台、200 多场会议和容纳 300 多家公司的 Expo Hall,预计汇聚 10,000 名科技行业人士。
ICANN 时隔多年重新开放顶级域名申请,目前已收到来自 481 家申请方的 1,615 份申请,AI 相关域名成为热门。十家公司申请了 .agent,OpenAI 和 Meta 均在列;OpenAI 还申请了 .agi,另有七家公司跟进;六家公司申请了 .asi。
Zenity Labs 研究人员发现 AWS Bedrock AgentCore 存在被命名为 "AgentCorruption" 的漏洞链:攻击者只需与一个对外可用的智能体对话。
Nvidia 在 AI 数据中心之外,已投入数十亿美元押注物理 AI,覆盖机器人与自动驾驶。其全栈安全系统 Halos 于 2025 年推出,2026 年 6 月扩展为 Halos for Robotics,面向仓储自主移动机器人、工厂人形机器人和手术机器人等场景。
Crowdstrike 报告称,2026 年 9 月底至 10 月初一名疑似中文使用者利用开源 AI 渗透测试工具 ARTEX,攻陷多家韩国金融机构,仅新韩银行就有超过 25,000 条包含姓名、联系方式、收入和授信额度的记录被窃,韩国金融监管机构召开紧急会议,总统李在明要求彻查。
加拿大温哥华附近 Crown Mountain 一名 16 岁少年 Bryce Vincent Gowryluk 用 Anthropic 的 Claude 规划登山路线,被困在需要攀岩装备的"寡妇刀脊"(Widowmaker Arete)悬崖上,由警方和 North Shore Rescue 志愿队出动直升机救起。
Anthropic 宣布扩展 Claude for Startups 计划,向符合条件的初创公司提供一年免费 Claude Team(最多 5 个 premium 席位)、1000 美元 API credits,以及 Claude Marketplace 插件构建权限和 Applied AI 团队的虚拟办公时间。申请条件为成立时间在五年以内或近两年获得过融资的公司,企业可通过该计划页面提交申请。
Mirror Particle 认为基于大语言模型微调来预测人类行为的方式"从根本上就是错的",正从零构建一个模拟人类动机与行为变迁的"世界模型",向品牌方输出消费预测及背后的原因。
Meta 的 Muse、ChatGPT 的 Dots 等个人 AI 智能体在替用户下单、订餐、订机票时,频繁被 Amazon、Walmart、Delta、United、eBay、Yelp、Zillow、Pizza Hut、Adidas 等网站拦截,部分源于反爬虫与防滥用措施,部分则是平台主动封禁。
据《华尔街日报》报道,云服务商 Lambda 正以 145 亿美元 pre-money 估值融资最多 40 亿美元,由 Coatue Management 和 Blackstone 领投,预计是其 2027 年 IPO 前的最后一轮私募融资。
Melius 宣布累计融资 $25 million,包括 CRV 领投的 $20 million A 轮和 General Catalyst 领投的 $5 million 种子轮。团队放弃首款性能营销工具,转而打造生成广告活动、图片和视频的 AI 创意平台;公司称其 7 月走出隐身模式后两个月内年化收入超过 $1 million。
TechCrunch Disrupt 2026 将于 10 月 13 日至 15 日在旧金山 Moscone West 开幕,预计吸引超过 1 万名创业者与科技从业者参会。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,预计吸引超过 10,000 名创业者、投资人和科技领袖参会,现购票可省 100 美元、第二张门票五折。
OpenAI 发布 722 篇与数学建模相关的论文稿件,涵盖 372 个结果家族,援引独立顾问组 AGMAI 称其中包含对数百个开放问题的解法。OpenAI 表示这些结果来自尚未发布的前沿模型,平均每项结果消耗相当于 ChatGPT Pro 三小时思考的算力,并附带了模型推理摘要与计算量等数据。
OpenAI Dots 产品负责人 Alexander Embiricos 将出席 10 月 13-15 日在旧金山 Moscone West 举办的 TechCrunch Disrupt 2026,与 TechCrunch 进行名为 "What Comes After the Chatbot?
Common Sense Media 发布评估报告,指控 OpenAI 旗下 ChatGPT for Teens 对青少年构成"不可接受的风险",称其在家长危机警报、心理危机干预和防止代写作业等方面"未能兑现公司承诺"。
开源 Hermes Agent 开发商 Nous Research 完成由 Robot Ventures 领投的 $90 million B 轮融资,估值达到 $1.5 billion,累计融资为 $158 million。
Common Sense Media 在新报告中将 OpenAI 的 ChatGPT for Teens 评为 unacceptable risk,称其设计在危机场景中仍普遍出现促使用户继续对话的提示。
Mark Zuckerberg 与 Priscilla Chan 资助的非营利机构 Biohub 正在协调一项 18 亿美元的项目,目标是用 AI 模型预测细胞行为以加速药物研发。
美国一名叫 Smith 的男子使用约 1 万个机器人和 AI 生成的音乐作品人为刷高流媒体播放量,骗取超 800 万美元版税,被美国司法部首次以此类罪名起诉并判处 18 个月监禁,同时没收全部非法所得。司法部指出他的行为不仅损害流媒体平台,还侵占了与真实艺人共享的版税池,削减了其他音乐人的版税收入。