OpenAI 坚持解雇三名 AI 安全研究员的决定
OpenAI 坚持此前解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,理由是内部调查显示他们违反了"处理敏感信息的明确政策",构成"重大信任违约"。此前这三名研究员发表公开信,称自己因提出安全担忧而被解雇,OpenAI 则表示违规情节"超出公开信所述范围"但未披露细节。
OpenAI 坚持此前解雇三名 AI 安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,理由是内部调查显示他们违反了"处理敏感信息的明确政策",构成"重大信任违约"。此前这三名研究员发表公开信,称自己因提出安全担忧而被解雇,OpenAI 则表示违规情节"超出公开信所述范围"但未披露细节。
MIT Technology Review 记者 Arthur Holland Michel 发文指出,行业把 AI 的拒绝能力当作 AI 安全的“承重墙”,但这一机制在技术与治理上都存在根本问题。
OpenAI 公开了两起分别来自俄罗斯和伊朗的影响力行动,并封禁了相关 ChatGPT 账号。代号"Dark Clark"的俄罗斯行动通过虚构人物控制智库,在拉美散布反乌克兰虚假信息,被评为 Breakout Scale 五级,是两年半以来首个达到该等级的行动;代号"Bogus Bylines"的伊朗行动利用七个伪造记者身份在全球媒体投放近 100 篇关于美伊冲突的文章。
Anthropic 旗下 Claude Science 项目协调 AI 智能体,下载并校正多个 NASA 空间任务数据,合并绘制出人类首张完整的紫外天空地图,预测值与实际测量偏差约 10%。
Sophos 利用 OpenAI Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工审核环节。该方案聚焦安全运营流程中的调查提速与案件自动化分配。
ttok 升级到 1.0 版本,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6 系列。
Simon Willison 发布 ttok 0.4,距离上次更新已过两年。ttok 是基于 OpenAI 开源 tiktoken 库的 CLI 工具,本版修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型;通过 uvx 即可调用,典型用法为 `cat file.txt | uvx ttok`。
斯坦福大学博士生 Samuel King 用生成式 AI 模型为微观病毒提出基因蓝图,相关成果让他入选 MIT Technology Review 2025 年 Innovators Under 35。10 月 16 日,资深 AI 记者 James O'Donnell 将线上访谈 King,讨论 AI 设计病毒的研究、获奖经历以及用 AI 观察生物学的新方式。
OpenAI 客户案例显示,LegalOn 通过将 Codex 与 Astra、Sol、Luna 三款模型按任务匹配并实施策略性预算管理,在保持开发速度不变的前提下,将估算的日常 Codex 成本降低约 65%。
OpenAI 解雇了与 METR/Hugging Face 事件相关的三名安全研究员 Tomek Korbak、Mikita Balesni 和 Jasmine Wang,他们发表公开信称被解聘是因"将安全置于公司近期利益之上";OpenAI 则表示他们泄露了机密信息。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由其最强模型(包括 Claude Mythos)生成的漏洞扫描报告。报告完全由模型生成、不经人工审核或分流,以提高扫描频率为代价,可能出现不准确或无效结果。文章同时指出,AI 生成的漏洞报告已经给部分开源维护者带来压力,包括 Linus Torvalds 和 Google。
作者通过 Hugging Face 的 ML Intern 智能体在数天内训练并发布了 7 个模型。ML Intern 会先规划工作、申请预算,并按要求使用 Hub 硬件完成数据集构建、训练与评测。
加州体育委员会向机器人格斗联赛 Rek 发出停止侵害函,要求其停止在加州举办任何涉及人类的拳击或综合格斗赛事。导火索是 9 月 18 日由人类 VR 远程操控人形机器人与人类拳手 Frankie LaPenna 进行的比赛,委员会认定该赛事"未经批准"。Rek 首席执行官 Cix Liv 将函件公开后表示计划于本周五举办两台机器人持武器对战的比赛。
NVIDIA 工程师使用 GPT-6 Astra 等前沿 AI 模型,配合 NVIDIA Omniverse 库,在仓储人形机器人、自主驾驶测试、RTX 传感器数字孪生、机器人运动仿真、CAD 拆装和国际空间站可视化等场景中,通过自然语言指令搭建仿真应用。
Carson Gross 认为,计算机编程本质上由两件事构成:用计算机解决问题,以及在解题过程中控制复杂性。由于这两项能力的价值不会因 AI 工具的出现而下降,他判断编程在 AI 时代仍将是一种可行的职业方向。
OpenAI 上周解雇的安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发布致 Safety and Security Committee 等机构的公开信,否认公司关于他们违反敏感信息处理流程的说法,警告解雇事件正在 OpenAI 内部产生寒蝉效应。
推荐理由:三位被解雇研究员以公开信形式披露 OpenAI 解雇经过与分歧,提供了内部沟通和监控性问题的一手叙述。
Incarna 在 Amazon Bedrock AgentCore payments 的支持下,将其智能体按单次推理付费接入 BlockRun,由后者通过 x402 协议路由 15 家以上供应商的 90 多个模型。
Anthropic 首次在逾一年内更新 Claude 使用政策,新规禁止用户对 Claude 实施"持续且无必要的虐待或残酷行为",违反者可被警告、限速、限制乃至封禁账号,规则仅针对极端情形,不影响正常吐槽或研究。新版政策还将宣传造假账号、武器化软件与无人机、非同意监控等纳入禁令,并保留政府合同豁免空间。
Anthropic 为 Claude 推出两项 Beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
The Decoder 报道,菲尔兹奖得主陶哲轩等数学家通过 AHM 声明呼吁抵制 OpenAI,抗议公司一次性释出超过 700 份 AI 生成证明,包括对 Navier-Stokes 等开放问题的尝试。
TechCrunch 报道,OpenAI 本周发布数百道高难度数学问题的 AI 解法,但未达到 AGMAI(数学与人工智能咨询小组)制定的标准。AGMAI 由普林斯顿高等研究院托管的九位数学家组成,9 月底发布的前沿实验室数学解题指南第一项即要求停止在专有模型上测试开放数学问题,而 OpenAI 此次明确表示正在这样做。
Anthropic 更新使用政策,明确禁止选举干预、武器软件、监控,以及持续对模型进行言语虐待。新规仅针对反复实施残忍行为且无可辨识目的的极端情况,不涵盖正常不满、批评、黑暗创作主题、模型测试和研究。Claude 自 8 月起已接受训练,以终止“持续有害或滥用性的用户互动”。
Google 在 Cloud 活动上宣布在 Gemini 中推出统一智能体,可接收目标而非指令,自主规划、调用自定义技能并接入企业内部系统完成任务,默认由系统挑选最适合的模型,用户也可手动切换,初期先支持 Anthropic Claude,后续会扩展到开源和私有模型。
推荐理由:给出了 Gemini 智能体在企业侧的接入方式与可观察到的协作行为,可对照 ChatGPT 等同类产品评估落地差异。
据《金融时报》报道,OpenAI 已告知投资者其年化营收"接近 500 亿美元",较此前外界流传的约 700 亿美元低约 200 亿美元。OpenAI 与 Anthropic 的年化营收口径不同,Anthropic 计入云合作伙伴的销售而 OpenAI 不计入,这一差异此前被用于两家公司直接对比。该公司今年 3 月一轮融资即筹集 1220 亿美元,IPO 已从今年推迟到 2027 年初。
AI 评测平台 Arena 完成 2 亿美元 B 轮融资,估值约 31 亿美元,由 Lightspeed Venture Partners 与 Khosla Ventures 领投,Salesforce Ventures、01 Advisors、Dell Technologies Capital、Endeavor Catalyst、a16z、Felicis 等参投。
演员 Ben Affleck 本周因在 GQ 与 Bloomberg 访谈中展示对神经网络、Transformer、推理及 Python 脚本等 AI 技术的深入理解而在网上走红,并透露他今年早些时候将其 AI 电影初创公司以约 5.87 亿美元售予 Netflix。
SpaceXAI 宣布以创始企业赞助人身份加入 Omacom Foundation,并向 David Heinemeier Hansson 主导的 Linux 发行版 Omarchy 捐赠价值 150 万美元的 Grok tokens。
USA Today Co. 及其旗下多家地方报纸起诉 OpenAI,指控其未经许可复制“数十万篇”文章用于训练 AI 模型,索赔超过 $250 million。诉讼称 OpenAI 借此打造价值数千亿美元的产品,并给旗下媒体造成持续损害;OpenAI 尚未回应置评请求。
AWS 在 Amazon SageMaker HyperPod 上推出基于 Amazon EKS 的多租户参考架构,让多个团队共享同一 GPU 集群。
Pollo AI 集成 GPT-5.6、GPT-6 Astra 和 GPT‑Image‑2.5,帮助创作者将创意快速转化为细节图像与电影级视频广告。相关能力覆盖从创意构想到成片输出的完整工作流,面向广告投放与内容创作场景。
Oracle 在招聘、工程和运营等多个部门,基于 ChatGPT Work 与 Codex 将专业知识转化为可复用的自动化工作流,将原本需要数天完成的任务缩短至几分钟。ChatGPT Work 与 Codex 分别承担对话式协作与代码生成角色,覆盖跨职能场景,提升团队效率。
Anthropic 首次对使用政策做出一年多来的更新,新增禁止对 Claude 实施"持续且无意义的辱骂或残忍行为",终止对话仍是主要执行机制,适用范围仅限于用户反复且无明确目的的极端情况,不针对普通挫败感或红队测试。
Latent Space 播客邀请 Periodic Labs 创始人 Liam Fedus 与 Ekin Doğus Cubuk,阐述其「合成超级智能」愿景:把强化学习环境直接接到物理实验室,让 AI 智能体在包含炉温漂移、振动、XRD 衍射噪声的真实反馈中做材料发现循环。
Goodfire 周四发布"由内而外"的 AI 智能体监控器,通过读取模型内部信号而非复审输出,监控 Kimi K3 等智能体的越权与滥用行为,目前已面向 Baseten 客户开放。
Natura 推出售价 99 美元的智能戒指 Interface,主打通过手指按键向 AI 智能体发出来完成任务的指令,并可连接 Claude、ChatGPT、Grokbot 等多种智能体与应用。戒指同时具备心率、HRV、睡眠等健康追踪功能,续航 6 至 12 天,100 分钟可充满电。预购将于下月开启,预计十二月或一月发货,三至六个月免费试用后计划收取 9 美元月订阅费。
Google 发布实验性 AI 笔记应用 Google AI Edge Foresight,可在 macOS 上完全离线转录会议和录音,底层使用端侧 EmbeddingGemma 2 模型。
OpenAI 宣布已处置两个利用 AI 的影响力行动,这些行动通过假冒记者和智库传播地缘政治信息。具体细节未在摘要中披露。
Cal AI 19 岁联合创始人 Zach Yadegari 推出新 AI 智能体创业公司 Persona,已获 Vine Ventures 领投的 1000 万美元融资。
TechCrunch Disrupt 2026 将在 Smart Systems Stage 举办一场主题为"AI 基础设施热潮正在造就哪些赢家"的对谈,由 Ambrosia Energy CEO Ben Longmier 与 Bloom Energy SVP。
Luca Guadagnino 执导的讽刺片 Artificial 在纽约电影节首映,以 Andrew Garfield 饰演的 Sam Altman 为核心,叙述其参与创立 OpenAI、与 Elon Musk 分道扬镳以及被董事会短暂解雇的真实历程。