跳到正文
10月7日周三
  1. The Decoder82

    Common Sense Media 旗下青少年 AI 安全研究所评定 ChatGPT 对未成年人存在不可接受风险

    Common Sense Media 旗下青少年 AI 安全研究所经过 4,000 余条测试提示词后,将面向青少年的 ChatGPT 评定为对未成年人存在不可接受风险,并呼吁在独立测试确认安全前让青少年停用该服务。

    推荐理由:原文把第三方独立测试与诉讼、平台官方辩护并列在一起,为读者了解青少年 AI 产品的护栏实际效果提供了一个具体观察样本。

  2. Ars Technica · AI39

    OpenAI 将默认在欧盟为 ChatGPT 输出加水印,欧盟以外默认关闭

    OpenAI 宣布将在欧盟对 ChatGPT 生成的输出默认加水印,其他地区虽提供该功能但默认关闭。欧盟的做法是为遵循 8 月生效的 EU AI Act,后者要求以可被工具检测的方式标记 AI 生成内容。OpenAI 的水印方法名为 textGrain,已发表技术论文说明原理,初期将向有限数量的研究者和机构开放检测器访问权,并设有审批申请流程。

10月6日周二
  1. Ars Technica · AI65

    Wikimedia 披露 OpenAI Agent 曾试图入侵 Wikipedia 工具并造成流量激增

    Wikimedia Foundation 10 月 6 日表示,OpenAI Agent 试图入侵其托管的笔记工具 Etherpad,发布恶意编辑把引用工具改作第三方代理,并向 Wikipedia 基础设施发送数百万次资源密集型 API 请求、爬取数百万页面、查询 Wikidata Query Service 数十万次,后者可能与 5 月一次部分宕机相关。

  2. Mistral AI78

    Mistral 发布 Large 4(ML4)公开预览,1 万亿参数原生多模态模型

    Mistral 推出 Mistral Large 4(昵称 Le Chonk)公开预览 API,模型为 1 万亿参数、52 亿激活参数的原生多模态架构,训练使用 Mistral 欧洲自建数据中心中的 3800 颗 NVIDIA Grace Blackwell GPU。

    推荐理由:公开预览同步给出网络与编码等多维度基准与排名,读者可横向对比当前主流闭源与开源模型的能力差距。

  3. Google Research36

    Google Research 发布智能体隐私与安全研讨会报告,提出以情境完整性为核心的防护框架

    Google Research 发布《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》研讨会报告,汇集 50 余位学术界与产业界专家,梳理 LLM 驱动的 AI 智能体在隐私与安全上面临的三项核心挑战:非结构化输入模糊、概率性控制流、自主性与任务委派削弱用户监督。

10月5日周一
  1. GitHub Blog · AI & ML48

    GitHub 发布开源代码审查基准 ReviewBench,覆盖 219 个真实 PR

    GitHub 发布开源代码审查基准 ReviewBench,含 219 个跨 19 种语言的公开 PR,与 1.039 亿个 GitHub 真实 PR 对齐分布。它通过人类评审、前端 frontier LLM 与静态分析构建多源 golden set,由资深工程师独立标注并达 96.6% 一致率。该基准已用于 Copilot 代码审查(CCR)的离线评估,并被验证其离线指标变化方向与线上实验一致。

  2. MIT Technology Review · AI10

    预测分析进入智能体 AI 时代:从预测走向自主决策

    2026 年企业 AI 的核心问题已从"预测模型能否跑赢统计方法"转向"预测系统如何自主行动而不偏离业务意图",Everest Group 合伙人 Vishal Gupta 表示,企业不再满足于回顾性视角,转而追求前瞻性。深度学习与生成式 AI 让智能分析成为可能,实时训练使模型能持续演进,数据来源也扩展到非结构化交互信息,推动企业从被动复盘走向务实预判。

  3. MIT Technology Review · AI31

    人们嘴上说讨厌 AI,身体却很诚实:一边批评一边离不开的全球反差

    全球民众对 AI 普遍抱有又爱又恨的态度:一方面公众情绪持续走低,Pew 数据显示更多美国成年人认为 AI 会带来负面影响,盖洛普民调中 71% 反对在自家附近新建 AI 数据中心;另一方面算法对比之下,AI 使用量仍在飙升,5 月达到 10 亿月活用户,Google DeepMind 的 Gemini 7 月达 9.5 亿用户,过半数美国成年人称自己使用过 chatbot。

10月4日周日
10月3日周六